Latest episode

Pourquoi les IA ont besoin de "token" ?
02:35|ChatGPT ne lit pas réellement votre phrase mot par mot. Avant de répondre, il la découpe en petites unités appelées « tokens », et cette mécanique détermine à la fois ce qu’une IA peut lire, combien elle coûte et jusqu’où elle peut suivre une conversation.Un token peut correspondre à un mot entier, mais aussi à une partie de mot, quelques caractères ou un signe de ponctuation. Le découpage dépend du tokenizer, le logiciel utilisé par chaque famille de modèles. Une même phrase peut donc nécessiter un nombre différent de tokens selon l’IA et la langue employée. Chez OpenAI, l’ordre de grandeur souvent donné pour l’anglais est d’environ quatre caractères par token, soit trois quarts d’un mot. Une fois le texte découpé, le modèle manipule ces unités pour calculer, à partir du contexte, quel token a le plus de chances de suivre les précédents. Il en génère un, puis recommence jusqu’à constituer sa réponse. Un token n’est donc ni une pensée ni une idée : c’est une unité informatique permettant au modèle de représenter et de produire du contenu.Ces unités servent également à mesurer sa capacité de travail. Une fenêtre de contexte de 200 000 tokens signifie qu’un modèle peut traiter une certaine quantité d’informations simultanément : votre demande, les instructions, l’historique de la discussion ou des documents. Ce n’est pas pour autant une mémoire permanente. Lorsque cette fenêtre se remplit, certaines informations doivent être condensées ou retirées. Les tokens sont aussi devenus l’unité économique de l’IA. Dans les API utilisées par les entreprises, les fournisseurs facturent généralement séparément les tokens envoyés au modèle et ceux qu’il génère. Certains distinguent aussi les données déjà mises en cache et les tokens utilisés par les modèles pour raisonner avant d’afficher leur réponse.Et le principe dépasse désormais le texte : images, audio et vidéo peuvent eux aussi être convertis en unités comptabilisées par les modèles multimodaux.Le token paraît donc minuscule, mais il constitue l’un des compteurs fondamentaux de l’intelligence artificielle : il mesure à la fois ce qu’elle reçoit, ce qu’elle peut garder sous les yeux et une partie du calcul nécessaire pour nous répondre.Source : Clubic
More episodes
View all episodes

La Chine construit sa propre chaîne d'IA complète ?
01:52|Alibaba ne veut plus seulement entraîner ses modèles d’intelligence artificielle : le groupe chinois veut aussi fabriquer une part croissante des puces et des data centers qui les font fonctionner.À sa conférence Apsara, Alibaba a dévoilé le Zhenwu V900, un accélérateur conçu par sa filiale T-Head pour entraîner les grands modèles et exécuter leurs réponses. Le groupe affirme qu’il offre trois fois les performances du Zhenwu M890 présenté en mai. Cette comparaison reste toutefois interne : Alibaba n’a pas publié les données de calcul permettant de confronter directement le V900 aux puces de Nvidia, Huawei ou d’autres concurrents. Les caractéristiques annoncées donnent néanmoins une idée de la stratégie. Chaque puce dispose de 216 gigaoctets de mémoire et d’une liaison entre accélérateurs pouvant atteindre 1 200 gigaoctets par seconde. Surtout, Alibaba affirme que son architecture peut relier jusqu’à 500 000 cartes dans un même cluster. La production en série et la commercialisation sont prévues au premier trimestre 2027.L’enjeu n’est donc pas simplement de fabriquer une puce chinoise supplémentaire. Alibaba cherche à contrôler toute la chaîne : processeurs, interconnexions, serveurs, réseau, modèles Qwen et services cloud. Une intégration devenue particulièrement stratégique alors que les restrictions américaines compliquent l’accès de la Chine aux accélérateurs IA occidentaux les plus avancés.Cette course au matériel accompagne une hausse spectaculaire des besoins. Alibaba prévoit des futurs modèles Qwen comptant entre 5 000 et 10 000 milliards de paramètres, même si la taille seule ne détermine pas la qualité d’une IA. Pour les alimenter, Alibaba Cloud veut dépasser 20 gigawatts de capacité mondiale de data centers en 2032. Le Zhenwu V900 n’a donc pas encore prouvé qu’il pouvait rivaliser avec les meilleures puces disponibles. Son importance est ailleurs : la bataille de l’IA se déplace progressivement du modèle vers l’infrastructure entière. Et Alibaba veut dépendre de moins en moins de technologies qu’un autre pays peut décider de ne plus lui vendre.Source : Stack Chronicle
Claude a aidé des hackers à pirater OpenAI ?
02:03|Trois chercheurs ont atteint un dépôt interne d’OpenAI en moins de 72 heures, avec Claude Opus 5 comme accélérateur d’exploitation. Mais l’IA n’a pas « piraté OpenAI toute seule ».L’opération a été menée en juillet par Hacktron AI, une équipe de chercheurs en cybersécurité. Leur point de départ se trouvait sur le forum communautaire d’OpenAI, construit avec le logiciel Discourse. Une faille dans une bibliothèque chargée de décoder certaines images permettait d’exécuter du code sur le serveur. Les chercheurs avaient d’abord essayé de construire un exploit fiable avec Claude Opus 4.8, sans parvenir à contourner certaines protections mémoire. Le soir de la sortie d’Opus 5, ils ont recommencé. Selon Hacktron, le nouveau modèle a produit en environ trois heures un exploit fonctionnel sur leur environnement de test, avant de l’adapter à la configuration utilisée par Discourse.Cette première brèche n’aurait cependant pas suffi. Une seconde faiblesse, cette fois dans le système d’authentification unique d’OpenAI, permettait de transformer l’accès au forum en prise de contrôle de comptes ChatGPT et Codex d’utilisateurs connectés, notamment des employés. Pour démontrer l’impact sans consulter de code confidentiel, les chercheurs ont utilisé le Codex d’un employé connecté à GitHub pour ouvrir une modification inoffensive dans le dépôt interne d’OpenAI. Ils disent avoir arrêté leurs tests immédiatement après. OpenAI a corrigé sa partie du problème environ quatorze heures après le signalement et a versé 6 500 dollars pour la faille d’authentification. Discourse a de son côté corrigé la vulnérabilité de traitement d’images, classée 8,8 sur 10 en gravité dans son bulletin de sécurité. L’épisode ne démontre donc pas qu’un agent autonome peut aujourd’hui pénétrer seul une grande entreprise. Hacktron souligne que des chercheurs expérimentés ont choisi les cibles, orienté les essais et décidé jusqu’où aller.Source : Stack Chronicle
Une IA écoute toute votre journée pour alimenter Claude et Codex ?
02:03|Les prochains écouteurs de Viaim veulent transformer les conversations de votre journée en mémoire exploitable par vos agents IA, sans conserver en permanence l’enregistrement sonore. Le produit s’appelle Rise. Sous l’apparence d’écouteurs sans fil, Viaim a surtout construit un dispositif de capture : leur boîtier possède trois microphones et peut fonctionner comme un enregistreur posé sur une table, même lorsque les écouteurs restent rangés.La fonction la plus inhabituelle s’appelle « Always-on Listening ». Lorsqu’elle est activée, l’application analyse les conversations environnantes par séquences d’environ cinq minutes. Son logiciel Vitana en extrait les sujets abordés, les décisions prises et les questions restées ouvertes pour constituer progressivement une mémoire textuelle. Selon Viaim, l’audio brut de ces séquences n’est ensuite pas conservé. Pour garder un véritable enregistrement, il faut lancer explicitement cette fonction.Cette mémoire peut ensuite être associée à des documents, des liens et l’historique d’un projet. L’idée est qu’après une réunion, l’IA sache non seulement ce qui vient d’être dit, mais aussi comment cela modifie les décisions précédentes. Viaim veut aller encore plus loin avec un système baptisé Task Broker. Après validation de l’utilisateur, une tâche issue d’une conversation pourrait être transmise à Google Workspace, Claude Code, Codex, Cursor ou Copilot. Une discussion sur une modification logicielle pourrait ainsi devenir directement une instruction préparée pour un agent de programmation. Viaim précise toutefois que la disponibilité de ces intégrations variera selon les plateformes et les régions.La promesse de confidentialité mérite également une nuance. Ne pas conserver l’audio limite la quantité de données stockées, mais le microphone doit tout de même capter les paroles pour les analyser. En France, le Code pénal protège précisément les paroles prononcées à titre privé ou confidentiel contre une captation sans consentement.Source : Clubic
Adobe Premiere devient gratuit sur Android ?
02:04|Adobe vient de faire un choix inhabituel pour l’un de ses logiciels phares : mettre une version de Premiere sur Android gratuitement, sans abonnement, sans publicité et sans filigrane. Disponible depuis le 22 septembre, Premiere mobile n’est pas Premiere Pro simplement réduit à l’écran d’un smartphone. Adobe a conçu une application spécifique au mobile, avec une timeline multipiste pour superposer vidéos, musiques, voix et effets, du montage précis à l’image près et des exports pouvant atteindre la 4K. L’accès est particulièrement ouvert pour un produit Adobe. Aucun abonnement Creative Cloud n’est nécessaire et il n’est même pas obligatoire de créer un compte pour monter une vidéo, l’enregistrer localement ou l’exporter. L’application fonctionne sur Android 13 ou une version plus récente, avec au moins 5 gigaoctets de mémoire vive.La gratuité a cependant ses limites. Adobe commercialise du stockage supplémentaire et des crédits pour ses outils d’intelligence artificielle Firefly. Certaines fonctions restent également en développement, notamment Adobe Fonts, la détection du rythme et surtout la possibilité de commencer un montage sur téléphone puis de le poursuivre directement dans Premiere sur ordinateur. Cette arrivée marque aussi la fin d’une transition engagée depuis un an. Adobe avait retiré Premiere Rush des boutiques en septembre 2025. Son support doit s’arrêter le 30 septembre 2026. Le nouveau Premiere mobile prend désormais sa place sur Android, près d’un an après son lancement sur iPhone. Le choix du gratuit change surtout le terrain sur lequel Adobe se bat. Sur smartphone, l’entreprise affronte des applications comme CapCut, où l’utilisateur s’attend à pouvoir filmer, monter et publier sans acheter au préalable un logiciel professionnel.Premiere mobile sert donc moins à transporter le modèle économique historique d’Adobe sur Android qu’à faire entrer une nouvelle génération de créateurs dans son écosystème.Source : Stack Chronicle
Rockstar prépare le multi de GTA VI pour 2027 ?
02:24|Le multijoueur de GTA VI pourrait ne pas accompagner la sortie du jeu en novembre. Et l’indice le plus précis à ce jour ne vient pas de Rockstar, mais du patron de Twitch.Dan Clancy a déclaré à Bloomberg que Twitch avait passé « beaucoup de temps » à discuter avec Rockstar de ses projets et de la manière d’impliquer les créateurs de contenus. Il anticipe un premier bond d’audience avec GTA VI, puis « un encore plus important l’année prochaine quand ils lanceront le multijoueur ». Comme l’entretien date de septembre 2026, « l’année prochaine » désigne donc 2027. Mais cette nuance est essentielle : Rockstar n’a annoncé ni date, ni nom, ni fonctionnement pour un nouveau GTA Online. Clancy ne parle pas au nom du studio, même si ses échanges directs avec Rockstar donnent davantage de poids à son commentaire qu’à une simple rumeur.Pour l’instant, la communication officielle est beaucoup plus prudente. GTA VI sortira le 19 novembre sur PlayStation 5 et Xbox Series X et S, et Rockstar le présente explicitement comme une expérience solo. Le décalage serait notable. En 2013, GTA Online avait été lancé seulement deux semaines après GTA V. Cette fois, l’actuel GTA Online doit continuer à être soutenu même après l’arrivée de GTA VI, ce qui permettrait à Rockstar de faire cohabiter temporairement l’ancien multijoueur et le nouveau jeu solo.Cette séparation peut aussi avoir une logique industrielle. Le multijoueur d’un GTA est devenu un produit de très longue durée, alimenté pendant des années par du contenu, des communautés et notamment le jeu de rôle, extrêmement populaire sur Twitch. Le lancer séparément permettrait à Rockstar de concentrer d’abord l’attention sur l’histoire de Jason et Lucia, avant de provoquer une seconde vague médiatique. Pour l’instant, 2027 reste donc une indication crédible, pas un calendrier officiel. Mais lorsqu’un dirigeant de Twitch évoque cette fenêtre après avoir travaillé directement avec Rockstar, la frontière entre rumeur et information devient nettement plus intéressante.Source : Bloomberg
Project Lily : des humains scrutent vos conversations avec l’IA ?
02:24|Certaines conversations avec ChatGPT peuvent être lues par de vraies personnes pour améliorer le modèle. Pas toutes, et pas avec votre nom affiché, mais suffisamment pour rappeler qu’un chatbot n’est pas un journal intime.L’existence de ce dispositif, baptisé en interne « Project Lily », a été révélée par une enquête de 404 Media fondée sur des documents internes et des exemples de conversations. OpenAI ferait appel à des centaines de sous-traitants chargés d’évaluer des échanges provenant de vrais utilisateurs.Leur travail consiste notamment à comprendre ce que l’utilisateur demande, puis à comparer et noter plusieurs réponses générées par ChatGPT. L’objectif est d’améliorer le comportement du modèle : éviter certaines erreurs, limiter les réponses excessivement complaisantes ou encore l’empêcher de se présenter comme s’il était humain.Les conversations ne sont pas censées arriver brutes. Les évaluateurs ne voient pas le nom du compte et OpenAI utilise un système baptisé Privacy Filter pour retirer des informations personnelles. Mais selon l’enquête, certains échanges contiennent malgré tout des détails sensibles. Les évaluateurs peuvent aussi recevoir du contexte provenant des conversations précédentes afin de comprendre la demande. Il faut cependant éviter un raccourci : cela ne signifie pas que des employés lisent systématiquement toutes les conversations ChatGPT. Project Lily porte sur un échantillon utilisé pour évaluer et améliorer les modèles. OpenAI indique publiquement que, sur ses services destinés aux particuliers, les conversations peuvent servir à entraîner ses modèles. Les utilisateurs peuvent désactiver cette utilisation dans les paramètres, sous « Contrôles des données », puis « Améliorer le modèle pour tous ». Les nouvelles conversations ne servent alors plus à cet entraînement.Project Lily met surtout en lumière une réalité rarement visible. Derrière l’impression d’un dialogue entièrement automatisé, l’amélioration d’une intelligence artificielle repose encore largement sur des humains qui lisent, classent et jugent ses réponses. À mesure que nous confions aux chatbots des problèmes professionnels, familiaux ou intimes, cette frontière devient essentielle : parler seul à une machine ne signifie pas nécessairement que personne d’autre ne pourra jamais voir ce qui lui a été confié.Source : Stack Chronicle
