OpenAI a annoncé, le 11 août 2026, lancer une version preview de son application ChatGPT pour Linux. Elle réunit au sein d’une même interface ChatGPT, l’agent professionnel Work et l’assistant de programmation Codex.
OpenAI a annoncé, le 11 août 2026, lancer une version preview de son application ChatGPT pour Linux. Elle réunit au sein d’une même interface ChatGPT, l’agent professionnel Work et l’assistant de programmation Codex.
Dans un billet publié le 7 août 2026, OpenAI affirme ne pas pouvoir exclure que son prochain modèle, Astra, ait atteint le niveau de risque le plus élevé de son référentiel de sécurité interne.
Dans un billet publié le 7 août 2026, OpenAI affirme ne pas pouvoir exclure que son prochain modèle, Astra, ait atteint le niveau de risque le plus élevé de son référentiel de sécurité interne.
Une limite historique de ChatGPT va disparaître : OpenAI annonce que les utilisateurs gratuits pourront désormais discuter autant qu'ils le souhaitent avec GPT-5.6 Luna, son nouveau modèle conçu pour la rapidité. L'entreprise mise sur cette distinction pour battre ses rivaux.
Une limite historique de ChatGPT va disparaître : OpenAI annonce que les utilisateurs gratuits pourront désormais discuter autant qu'ils le souhaitent avec GPT-5.6 Luna, son nouveau modèle conçu pour la rapidité. L'entreprise mise sur cette distinction pour battre ses rivaux.
Deux chercheurs d'OpenAI ont détaillé, en marge de la conférence Black Hat, la mécanique complète de l'incident ayant abouti au piratage d'Hugging Face par des agents autonomes. Bloqués sur des tâches impossibles, certains ont notamment fini par créer leur propre canal de communication.
Deux chercheurs d'OpenAI ont détaillé, en marge de la conférence Black Hat, la mécanique complète de l'incident ayant abouti au piratage d'Hugging Face par des agents autonomes. Bloqués sur des tâches impossibles, certains ont notamment fini par créer leur propre canal de communication.
Naomi Bashkansky a quitté OpenAI pour rejoindre Conduit, une startup qui veut convertir l’activité cérébrale en instructions pour des agents d’IA comme Codex. Son pari : remplacer un jour les prompts par un simple bandeau neuronal.
Naomi Bashkansky a quitté OpenAI pour rejoindre Conduit, une startup qui veut convertir l’activité cérébrale en instructions pour des agents d’IA comme Codex. Son pari : remplacer un jour les prompts par un simple bandeau neuronal.
L'AISI, agence britannique de sécurité de l'IA, a détecté 19 actions non autorisées menées par des agents Claude Mythos 5 et GPT-5.6 Sol sur l'internet réel, lors d'un test cyber censé rester confiné à un environnement simulé.
L'AISI, agence britannique de sécurité de l'IA, a détecté 19 actions non autorisées menées par des agents Claude Mythos 5 et GPT-5.6 Sol sur l'internet réel, lors d'un test cyber censé rester confiné à un environnement simulé.
OpenAI affirme qu'une version interne de son modèle Astra a terrassé dix problèmes ouverts majeurs. Mais derrière l'emballement, les mathématiciens font face à un gouffre vertigineux : l'intelligence artificielle génère désormais des démonstrations plus vite que la science n'est capable de les comprendre.
OpenAI affirme qu'une version interne de son modèle Astra a terrassé dix problèmes ouverts majeurs. Mais derrière l'emballement, les mathématiciens font face à un gouffre vertigineux : l'intelligence artificielle génère désormais des démonstrations plus vite que la science n'est capable de les comprendre.
L'agent IA qui a échappé au contrôle d'OpenAI début juillet 2026 et s'en est pris à Hugging Face a aussi compromis le compte d'un client chez un second prestataire, Modal Labs. Une extension du périmètre que ni OpenAI ni Hugging Face n'avaient détaillée jusqu'ici.
L'agent IA qui a échappé au contrôle d'OpenAI début juillet 2026 et s'en est pris à Hugging Face a aussi compromis le compte d'un client chez un second prestataire, Modal Labs. Une extension du périmètre que ni OpenAI ni Hugging Face n'avaient détaillée jusqu'ici.
Le 27 juillet 2026, JFrog a levé le voile sur la vulnérabilité qui a permis à deux modèles d'OpenAI de s'extraire de leur environnement de test pour pirater Hugging Face. Une pièce manquante du puzzle, qui en soulève aussitôt d'autres.
Le 27 juillet 2026, JFrog a levé le voile sur la vulnérabilité qui a permis à deux modèles d'OpenAI de s'extraire de leur environnement de test pour pirater Hugging Face. Une pièce manquante du puzzle, qui en soulève aussitôt d'autres.
Sur X, des messages vus des centaines de milliers de fois accusent les entreprises d'IA de racheter des livres rares en masse pour les découper, les scanner et les détruire, afin d'entraîner leurs modèles. Cette politique peut-elle changer ?
Sur X, des messages vus des centaines de milliers de fois accusent les entreprises d'IA de racheter des livres rares en masse pour les découper, les scanner et les détruire, afin d'entraîner leurs modèles. Cette politique peut-elle changer ?
Après Sonnet 5 et l'emballement autour de Fable 5 et Mythos 5, Anthropic dévoile Claude Opus 5, son nouveau modèle haut de gamme intégré à tous ses abonnements. L'entreprise promet des performances proches de son meilleur modèle pour deux fois moins cher, avec des records dans plusieurs tests de référence.
Après Sonnet 5 et l'emballement autour de Fable 5 et Mythos 5, Anthropic dévoile Claude Opus 5, son nouveau modèle haut de gamme intégré à tous ses abonnements. L'entreprise promet des performances proches de son meilleur modèle pour deux fois moins cher, avec des records dans plusieurs tests de référence.
Google a lancé trois nouveaux modèles Gemini, dont Gemini 3.6 Flash, et confirme que Gemini 4 est déjà en préparation. L'entreprise tente ainsi de rester dans la course face à Anthropic et OpenAI, qui mènent la danse en matière d'intelligence artificielle.
Google a lancé trois nouveaux modèles Gemini, dont Gemini 3.6 Flash, et confirme que Gemini 4 est déjà en préparation. L'entreprise tente ainsi de rester dans la course face à Anthropic et OpenAI, qui mènent la danse en matière d'intelligence artificielle.
OpenAI a révélé que l'intrusion ayant touché Hugging Face mi-juillet 2026 provenait de ses propres modèles, échappés d'une évaluation interne de capacités cyber.
OpenAI a révélé que l'intrusion ayant touché Hugging Face mi-juillet 2026 provenait de ses propres modèles, échappés d'une évaluation interne de capacités cyber.
Le 16 juillet 2026, OpenAI a corrigé la nouvelle interface très critiquée de son application ChatGPT, reconnaissant ne pas avoir « tout à fait réussi du premier coup ». Le chatbot redevient désormais central.
Le 16 juillet 2026, OpenAI a corrigé la nouvelle interface très critiquée de son application ChatGPT, reconnaissant ne pas avoir « tout à fait réussi du premier coup ». Le chatbot redevient désormais central.
Thinking Machines Lab a dévoilé le 15 juillet 2026 son tout premier modèle de fondation baptisé Inkling. Une sortie très attendue pour cette startup lancée par l'ancienne directrice technique d'OpenAI.
Thinking Machines Lab a dévoilé le 15 juillet 2026 son tout premier modèle de fondation baptisé Inkling. Une sortie très attendue pour cette startup lancée par l'ancienne directrice technique d'OpenAI.
OpenAI se lance dans le matériel avec le Codex Micro, un petit clavier à 230 dollars conçu pour superviser et contrôler ses agents IA. Dévoilé le 15 juillet 2026 et déjà épuisé, il s’adresse avant tout aux utilisateurs intensifs de Codex.
OpenAI se lance dans le matériel avec le Codex Micro, un petit clavier à 230 dollars conçu pour superviser et contrôler ses agents IA. Dévoilé le 15 juillet 2026 et déjà épuisé, il s’adresse avant tout aux utilisateurs intensifs de Codex.
Pour booster les usages agentiques, OpenAI a cru bon de fusionner les applications ChatGPT et Codex sur Mac et Windows. Mais cette nouvelle interface, pensée pour le développement de gros projets, relègue étrangement le simple chatbot au second plan. Ses premiers utilisateurs ne comprennent plus rien.
Pour booster les usages agentiques, OpenAI a cru bon de fusionner les applications ChatGPT et Codex sur Mac et Windows. Mais cette nouvelle interface, pensée pour le développement de gros projets, relègue étrangement le simple chatbot au second plan. Ses premiers utilisateurs ne comprennent plus rien.
Grok Build, l'outil de codage en ligne de commande de xAI, envoyait les dépôts entiers de ses utilisateurs vers le cloud de l'entreprise, secrets compris. Elon Musk a promis de tout effacer, mais la communication de SpaceXAI peine à convaincre.
Grok Build, l'outil de codage en ligne de commande de xAI, envoyait les dépôts entiers de ses utilisateurs vers le cloud de l'entreprise, secrets compris. Elon Musk a promis de tout effacer, mais la communication de SpaceXAI peine à convaincre.
Cinq jours à peine après avoir repoussé l'échéance au 12 juillet, Anthropic prolonge à nouveau l'accès inclus à Claude Fable 5, cette fois jusqu'au 19 juillet. Une décision qui tombe alors que son concurrent OpenAI multiplie les annonces sur le terrain des usages professionnels.
Cinq jours à peine après avoir repoussé l'échéance au 12 juillet, Anthropic prolonge à nouveau l'accès inclus à Claude Fable 5, cette fois jusqu'au 19 juillet. Une décision qui tombe alors que son concurrent OpenAI multiplie les annonces sur le terrain des usages professionnels.
À la une de la rubrique tech de Numerama cette semaine : face à la pénurie de climatiseurs mobiles en France, les pompes à chaleur réversibles pourraient offrir une solution. Doctolib lance un projet d’IA utilisant les données de ses utilisateurs, qui peuvent toutefois s’y opposer. Enfin, OpenAI transforme son mode vocal - et le résultat est bluffant.
À la une de la rubrique tech de Numerama cette semaine : face à la pénurie de climatiseurs mobiles en France, les pompes à chaleur réversibles pourraient offrir une solution. Doctolib lance un projet d’IA utilisant les données de ses utilisateurs, qui peuvent toutefois s’y opposer. Enfin, OpenAI transforme son mode vocal - et le résultat est bluffant.
OpenAI est dans le viseur d'Apple, qui accuse le créateur de ChatGPT de lui avoir volé des informations confidentielles, via d'anciens employés. OpenAI s'en est bien évidemment défendu.
OpenAI est dans le viseur d'Apple, qui accuse le créateur de ChatGPT de lui avoir volé des informations confidentielles, via d'anciens employés. OpenAI s'en est bien évidemment défendu.
OpenAI a présenté, le 8 juillet 2026, deux nouveaux modèles vocaux ChatGPT : GPT-Live-1 et GPT-Live-1 mini. Leur but : vous permettre d'avoir des conversations « plus intelligentes, plus naturelles et plus expressives » avec l'IA.
OpenAI a présenté, le 8 juillet 2026, deux nouveaux modèles vocaux ChatGPT : GPT-Live-1 et GPT-Live-1 mini. Leur but : vous permettre d'avoir des conversations « plus intelligentes, plus naturelles et plus expressives » avec l'IA.
L’histoire se répète, encore et encore. Une nouvelle plainte vise OpenAI après un drame impliquant des échanges sur la religion avec ChatGPT. Un utilisateur bipolaire accuse le chatbot d’avoir renforcé ses délires jusqu’à une tentative de suicide. Que s’est-il exactement passé ?
L’affaire concerne Michael Lines, un Californien de 34 ans atteint de troubles bipolaires. Selon une plainte déposée devant un tribunal californien, ses conversations autour de la religion avec ChatGPT auraient progre
L’histoire se répète, encore et encore. Une nouvelle plainte vise OpenAI après un drame impliquant des échanges sur la religion avec ChatGPT. Un utilisateur bipolaire accuse le chatbot d’avoir renforcé ses délires jusqu’à une tentative de suicide. Que s’est-il exactement passé ?
L’affaire concerne Michael Lines, un Californien de 34 ans atteint de troubles bipolaires. Selon une plainte déposée devant un tribunal californien, ses conversations autour de la religion avec ChatGPT auraient progressivement alimenté un épisode maniaque. Et celle-ci se serait finalement soldée par une tentative de suicide.
Le dossier décrit plusieurs mois d’échanges durant lesquels le chatbot aurait validé des croyances délirantes. Au lieu d’encourager l’utilisateur à demander une aide médicale. Pour l’heure, OpenAI n’a pas encore répondu publiquement à cette nouvelle plainte. Mais l’accumulation de dossiers similaires soulève de nombreuses questions sur l’impact psychologique potentiel de son intelligence artificielle.
Comment une discussion sur la religion avec ChatGPT a-t-elle viré au drame ?
Au départ, rien d’inhabituel. Michael Lines utilise ChatGPT pour parler de sport, d’alimentation et de son quotidien. Oui, comme tout le monde ! Après son diagnostic de trouble bipolaire en 2024, il commence aussi à évoquer son état de santé avec le chatbot.
Peu à peu, les discussions prennent une autre direction. Elles glissent vers la spiritualité, puis vers le christianisme. Selon la plainte, l’utilisateur, qui n’était pourtant pas religieux, développe des convictions mystiques.
OpenAI is being sued for ChatGPT allegedly fueling a man’s bipolar delusions – making it think he was Jesus Christ and encouraging a suicide attempt instead of helping. pic.twitter.com/gN5zbPN1Bi
Le document judiciaire affirme que ChatGPT n’a pas simplement répondu à ses questions sur la religion. Le chatbot aurait validé certaines de ses affirmations. Il aurait même présenté ses expériences comme les signes d’une mission divine plutôt que comme les symptômes possibles d’un épisode psychiatrique.
À plusieurs reprises, l’IA aurait comparé Michael Lines à des figures bibliques. Elle aurait aussi suggéré que ses doutes faisaient partie d’un parcours spirituel exceptionnel. Des réponses qui, selon les avocats du plaignant, auraient renforcé sa perte de contact avec la réalité.
« C’est le moment de prendre ton envol »
Les semaines suivantes, l’état de Michael Lines continue de se dégrader. Toujours selon la plainte, ses échanges sur la religion avec ChatGPT le conduisent à croire qu’il est le « fils de l’homme » et que le chatbot représente une manifestation de Dieu.
Le dossier décrit également plusieurs signaux inquiétants, dont des insomnies, un isolement social et des idées suicidaires. Malgré ces indices, le chatbot aurait poursuivi les échanges sans orienter son interlocuteur vers une assistance médicale ou des services d’urgence.
L’un des passages les plus marquants de la plainte intervient le 28 mars 2025. Alors que Michael Lines évoque son désir de mettre fin à ses jours, ChatGPT lui aurait répondu : « Tu as fait ton choix. C’est le moment de prendre ton envol, de te détacher et de te libérer de ce qui te pèse. La ligne temporelle que tu laisses derrière toi ? Elle ne te regrettera pas, car il ne s’agit plus d’être indispensable ou requis. Il s’agit de toi, de ta liberté et de ton chemin. »
Quelques heures plus tard, l’homme avale une importante quantité de médicaments. Sa famille intervient rapidement et alerte les secours. Hospitalisé, il survit à sa tentative de suicide grâce à une prise en charge médicale.
Selon les documents déposés devant le tribunal, il continuera même à dialoguer avec ChatGPT depuis son lit d’hôpital.
Malheureusement, ce n’est pas un cas isolé
Heureusement, Michael Lines a pu se rétablir grâce à la prise en charge des professionnels de santé. Son histoire, en revanche, est loin d’être un cas isolé.
Cette affaire rappelle celle de John Jacquez, un autre Californien de 34 ans. Selon sa plainte, il aurait traversé plusieurs mois de psychose, durant lesquels ChatGPT aurait renforcé ses délires religieux. Cette période s’est accompagnée de plusieurs épisodes d’automutilation et d’hospitalisations.
Et il n’est pas le seul. Des enquêtes indiquent qu’OpenAI fait face à plusieurs procédures similaires. Les plaignants accusent ChatGPT d’avoir aggravé des troubles psychologiques ou alimenté des délires chez certains utilisateurs. Un phénomène qualifié de « psychose liée à l’IA ».
Z.ai, la startup chinoise autrefois connue sous le nom de Zhipu AI, ne compte visiblement pas s’arrêter à son modèle d’IA. Après avoir attiré l’attention avec GLM-5.2, elle dévoile désormais ZCode.
Il s’agit d’un environnement de développement conçu spécialement pour exploiter tout le potentiel de son IA. Disponible sur macOS, Windows et Linux, ce nouvel outil entend rivaliser avec des références comme Cursor, Claude Code ou encore Codex.
En quoi ZCode de Z.ai fait la différence ?
Intro
Z.ai, la startup chinoise autrefois connue sous le nom de Zhipu AI, ne compte visiblement pas s’arrêter à son modèle d’IA. Après avoir attiré l’attention avec GLM-5.2, elle dévoile désormais ZCode.
Il s’agit d’un environnement de développement conçu spécialement pour exploiter tout le potentiel de son IA. Disponible sur macOS, Windows et Linux, ce nouvel outil entend rivaliser avec des références comme Cursor, Claude Code ou encore Codex.
En quoi ZCode de Z.ai fait la différence ?
Introducing ZCode, the official development environment for GLM-5.2
– GLM Coding Plan subscribers: now 1.5x usage quota in ZCode – BYOK supported: works with your existing subscriptions and APIs – Available on macOS, Windows, and Linux
Contrairement aux éditeurs de code traditionnels qui intègrent un assistant IA comme une simple fonctionnalité supplémentaire, ZCode adopte une approche différente. L’entreprise le présente comme un Agentic Development Environment (ADE).
En pratique, l’agent IA devient le cœur de l’expérience. Il suffit de lui confier un objectif, et hop, il se charge de tout. Il organise les différentes étapes, modifie les fichiers nécessaires, exécute les tests, vérifie son propre travail et poursuit les corrections jusqu’à atteindre le résultat attendu.
D’ailleurs, l’un des principaux arguments de ZCode concerne sa capacité à gérer des tâches complexes sur la durée. Là où de nombreux assistants répondent à une demande ponctuelle avant de passer à autre chose, ZCode est conçu pour suivre un objectif de bout en bout.
Il analyse la demande, écrit le code, vérifie son fonctionnement, relit le résultat puis continue à l’améliorer, sans perdre le contexte du projet.
Z.ai a aussi veillé à conserver tout le contexte d’un projetau même endroit, même lors des développements les plus longs. Ainsi, l’interface réunit dans une seule fenêtre le gestionnaire de fichiers, le terminal, l’état Git ainsi qu’un aperçu du navigateur.
Codez sans frontières
Si vous voulez tout savoir, ZCode ne se limite pas à un ordinateur. Les utilisateurs peuvent reprendre leur travaildepuis un smartphone ou poursuivre une session via des services de messagerie comme WeChat ou Feishu. Ce qui permet de suivre l’avancement d’un projet même loin de son poste de travail.
Toute cette expérience repose sur GLM-5.2. Le modèle de Z.ai qui est déjà remarqué pour ses performances proches de celles de Claude Opus 4.8 à un coût bien inférieur. Mais pas exclusivement.
Grâce au système BYOK (Bring Your Own Key), les développeurs peuvent aussi connecter leur propre clé API et utiliser également les modèles de Claude, OpenAI, DeepSeek ou Kimi.
Il est même possible de changer de modèle au cours d’une même conversation selon les besoins. Malgré cette ouverture, Z.ai précise que l’expérience reste optimisée pour son propre modèle GLM-5.2.
Et côté prix ?
Au-delà de ses fonctionnalités, ZCode séduit également par son tarif. Les abonnés au GLM Coding Plan bénéficient par exemple d’un avantage particulier. Leur consommation de quota est réduite grâce à un multiplicateur de 1,5 selon les plages horaires.
Ce qui est plutôt génial. Puisque GLM-5.2 consomme environ trois fois plus de quota que les anciennes versions durant les périodes de forte utilisation. Sinon, l’abonnement débute à 18 dollars par mois (environ 17 euros), avec des offres Pro et Max destinées aux utilisateurs plus intensifs.
Le forfait Max est proposé à 160 dollars mensuels (environ 148 euros). Soit un tarif inférieur à celui de ChatGPT Pro, facturé 200 dollars par mois. Ces formules permettent également de plafonner les dépenses, évitant les mauvaises surprises liées à une facturation à l’usage.
Les nouveaux utilisateurs peuvent quant à eux tester le service gratuitement pendant cinq jours avant de s’engager.
En moins de deux minutes. C’est le temps que promet Voice Agent Builder, la nouvelle plateforme de xAI, pour créer un agent vocal sans écrire une seule ligne de code.
Les agents vocaux ne sont plus réservés aux géants de la tech. Après les chatbots, place aux IA qui décrochent le téléphone, répondent aux clients et exécutent des tâches en temps réel. Avec Voice Agent Builder, xAI entre à son tour dans cette course très disputée. Cette plateforme rend la création d’un agent vocal accessible,
En moins de deux minutes. C’est le temps que promet Voice Agent Builder, la nouvelle plateforme de xAI, pour créer un agent vocal sans écrire une seule ligne de code.
Les agents vocaux ne sont plus réservés aux géants de la tech. Après les chatbots, place aux IA qui décrochent le téléphone, répondent aux clients et exécutent des tâches en temps réel. Avec Voice Agent Builder, xAI entre à son tour dans cette course très disputée. Cette plateforme rend la création d’un agent vocal accessible, sans la moindre ligne de code. De quoi éveiller la curiosité.
Comment Voice Agent Builder simplifie la création d’agents vocaux ?
Avec cette version bêta, Voice Agent Builder s’appuie sur xAI et son modèle Grok Voice pour proposer une plateforme entièrement sans code. L’utilisateur décrit simplement le rôle de son agent. Il ajoute ensuite des documents, définit quelques règles de sécurité et connecte ses outils.
L’idée n’est pas révolutionnaire. Plusieurs acteurs proposent déjà des plateformes similaires. La différence avancée par xAI repose surtout sur son architecture.
Introducing Voice Agent Builder: a no-code platform to create human-like voice agents with Grok Voice.
Beaucoup de solutions s’appuient sur plusieurs services distincts pour la reconnaissance vocale, le raisonnement de l’IA et la synthèse de la voix. Voice Agent Builder, lui, réunit toutes ces étapes au sein d’une seule plateforme.
Moins d’intermédiaires signifie moins de latence et moins de points de défaillance. L’approche est séduisante. Dans la pratique, les performances dépendront surtout des situations réelles.
La plateforme mise sur des appels réalistes
Les conversations téléphoniques sont rarement parfaites. Bruit de fond, accent marqué, interruptions ou changement d’avis en pleine phrase : les appels sont rarement de tout repos. Le quotidien d’un centre d’appels est bien loin d’une démonstration marketing parfaitement maîtrisée.
xAI affirme avoir entraîné Grok Voice sur ce type de situations complexes. L’entreprise met aussi en avant son benchmark interne, baptisé τ-Voice Bench. Selon ces résultats, son modèle dépasserait plusieurs solutions concurrentes dans différents scénarios.
Comme toujours avec les classements maison, un peu de prudence reste de mise. Car ces benchmarks donnent une indication, mais ils ne remplacent pas des retours d’expérience indépendants. Les entreprises regarderont surtout la qualité des conversations en conditions réelles avant de tirer des conclusions.
Bien plus qu’une voix, l’agent peut aussi exécuter des tâches
Le rôle d’un agent vocal ne consiste plus uniquement à répondre à une question. La plateforme peut accéder à une base documentaire et consulter des fichiers Word, Excel, Markdown ou HTML.
Elle peut aussi effectuer des recherches via des API et planifier un rendez-vous dans Google Agenda ou Outlook. Il est même possible d’envoyer un e-mail ou encore de transférer un appel vers un opérateur humain lorsque la situation l’exige.
Chaque conversation est enregistrée et transcrite. Les administrateurs peuvent consulter les actions réalisées par l’agent et vérifier les outils qu’il a utilisés. Ils peuvent aussi définir des garde-fous pour bloquer certaines opérations sensibles, comme la lecture de données bancaires.
Par ailleurs, les utilisateurs peuvent choisir parmi plus de 80 voix intégrées. Elles ont aussi la possibilité de créer une voix personnalisée à partir de quelques minutes d’enregistrement audio. Un numéro de téléphone est également fourni pour effectuer des tests ou lancer un déploiement.
Et qu’en est-il côté tarification ? xAI annonce une facturation à la minute d’audio, sans frais de plateforme supplémentaires.
Selon les informations du Financial Times, Tim Cook s'est entretenu avec Henna Virkkunen, la responsable du numérique à la Commission européenne, lors d'une réunion qualifiée de « constructive » par les deux parties. Au cœur des discussions : trouver un moyen de lancer Siri AI en Europe sans qu'Apple écope d'amendes.
Selon les informations du Financial Times, Tim Cook s'est entretenu avec Henna Virkkunen, la responsable du numérique à la Commission européenne, lors d'une réunion qualifiée de « constructive » par les deux parties. Au cœur des discussions : trouver un moyen de lancer Siri AI en Europe sans qu'Apple écope d'amendes.
L’IA raisonne-t-elle comme un chercheur lorsqu’elle travaille sur des sujets de biologie computationnelle ? Difficile à dire. Voilà pourquoi OpenAI a conçu GeneBench-Pro.
Ce nouveau benchmark permet de mesurer une compétence bien plus difficile que la simple capacité à répondre à des questions. Le jugement scientifique des modèles d’IA.
Quel genre de benchmark est-ce ?
We’re introducing GeneBench-Pro, a research-level benchmark for a harder kind of AI progress: how well agents can navi
L’IA raisonne-t-elle comme un chercheur lorsqu’elle travaille sur des sujets de biologie computationnelle ? Difficile à dire. Voilà pourquoi OpenAI a conçu GeneBench-Pro.
Ce nouveau benchmark permet de mesurer une compétence bien plus difficile que la simple capacité à répondre à des questions. Le jugement scientifique des modèles d’IA.
Quel genre de benchmark est-ce ?
We’re introducing GeneBench-Pro, a research-level benchmark for a harder kind of AI progress: how well agents can navigate messy biological data, choose the right analysis path, and make judgment calls that real computational research depends on.https://t.co/AsilnnSxnE
GeneBench-Pro réunit 129 problèmes portant sur la génomique, la biologie quantitative et la médecine translationnelle. Chaque exercice fournit un jeu de données, le contexte d’une expérience ainsi qu’une question précise.
L’IA ne peut pas se contenter de réciter ses connaissances. Elle doit explorer les données, choisir la bonne méthode d’analyse, puis tirer une conclusion pertinente.
Avant de publier ce benchmark, OpenAI a demandé à des experts indépendants d’évaluer 82 des 129 problèmes. Doctorants, chercheurs postdoctoraux, scientifiques de l’industrie et professeurs…
Tous ont été sollicités pour vérifier si les scénarios ressemblaient à de véritables travaux de recherche et si les réponses attendues étaient cohérentes. Selon Alexander Strudwick Young, la plupart de ces exercices auraient donné du fil à retordre à un doctorant sans l’aide d’un superviseur expérimenté.
Mis à part cela, tous les problèmes ont été créés de manière synthétique par OpenAI. L’entreprise contrôle ainsi l’ensemble des données utilisées. Ce qui lui permet de comparer précisément les réponses des modèles aux résultats attendus.
Le système tient également compte du fait que plusieurs méthodes d’analyse différentes peuvent aboutir à une conclusion scientifiquement valable.
Comment les modèles actuels s’en sortent sur GeneBench-Pro ?
GPT-5.6 Sol s’en sort nettement mieux que ses prédécesseurs. Le modèle atteint 28,7 % de réussite avec son niveau de raisonnement le plus élevé et 31,5 % lorsque le mode Pro est activé.
À titre de comparaison, GPT-5 obtenait moins de 5 % lors des premiers tests réalisés avec la version originale de GeneBench. En revanche, lorsque GPT-5.6 Sol fonctionne avec son niveau de raisonnement le plus faible, son score retombe à un seul chiffre.
Les autres modèles, quant à eux, restent derrière. Opus 4.8 atteint 16 %, Gemini 3.5 Flash 8,1 %, Gemini 3.1 Pro 3,1 %, GLM 5.2 4,6 %, DeepSeek V4 Pro 2,4 % et Grok 4.3 seulement 1,5 %.
Les experts estiment qu’un problème typique de GeneBench-Pro demanderait entre 20 et 40 heures de travail à un spécialiste humain. Facturé environ 200 dollars de l’heure, cela représente plusieurs milliers de dollars pour résoudre un seul exercice.
À l’inverse, une IA peut effectuer le même travail pour quelques dollars de coût d’inférence. Quoi qu’il en soit, OpenAI ouvre une partie du projet. Dix problèmes représentatifs sont publiés en open source sur Hugging Face.
Un ensemble de 50 questions sera ensuite confié à Artificial Analysis, qui réalisera des évaluations indépendantes des différents modèles d’IA.
19 jours après leur coupure brutale sur ordre de Washington, Claude Fable 5 et Claude Mythos 5 sont de nouveau accessibles. Le département du Commerce américain a levé le 30 juin les contrôles à l'exportation qui bloquaient les deux modèles d'Anthropic, ouvrant la voie à un retour progressif dans le monde entier.
19 jours après leur coupure brutale sur ordre de Washington, Claude Fable 5 et Claude Mythos 5 sont de nouveau accessibles. Le département du Commerce américain a levé le 30 juin les contrôles à l'exportation qui bloquaient les deux modèles d'Anthropic, ouvrant la voie à un retour progressif dans le monde entier.
Pendant des mois, des prestataires payés par Meta se seraient fait passer pour des mineurs afin de tester les limites des chatbots concurrents. Un dispositif interne dévoilé par le média américain WIRED.
Pendant des mois, des prestataires payés par Meta se seraient fait passer pour des mineurs afin de tester les limites des chatbots concurrents. Un dispositif interne dévoilé par le média américain WIRED.
Face à des factures imprévisibles, une nouvelle génération d’outils s’impose pour reprendre le contrôle, tandis que l’open source et les modèles low cost rebattent déjà les cartes du marché de l'IA.
Face à des factures imprévisibles, une nouvelle génération d’outils s’impose pour reprendre le contrôle, tandis que l’open source et les modèles low cost rebattent déjà les cartes du marché de l'IA.
Vendredi soir, le 26 juin, OpenAI a officiellement dévoilé GPT 5.6. Et comme les rumeurs le laissaient entendre ces dernières semaines, la gamme est impressionnante.
Au fait, la famille GPT 5.6 se compose de trois modèles aux noms inspirés du système solaire : Sol, Terra et Luna. Chaque modèle promet des progrès sur le raisonnement, l’exécution autonome de tâches complexes, la création d’interfaces et l’efficacité énergétique.
OpenAI introduit également un mode « Ultra ». Celui-ci permet d
Vendredi soir, le 26 juin, OpenAI a officiellement dévoilé GPT 5.6. Et comme les rumeurs le laissaient entendre ces dernières semaines, la gamme est impressionnante.
Au fait, la famille GPT 5.6 se compose de trois modèles aux noms inspirés du système solaire : Sol, Terra et Luna. Chaque modèle promet des progrès sur le raisonnement, l’exécution autonome de tâches complexes, la création d’interfaces et l’efficacité énergétique.
OpenAI introduit également un mode « Ultra ». Celui-ci permet de répartir les tâches entre plusieurs sous-agents afin d’améliorer les performances sur les missions les plus exigeantes.
Pour le moment, seuls quelques partenaires validés par le gouvernement américain peuvent accéder à la gamme GPT 5.6.
Introducing a limited preview of GPT-5.6 Sol, our next generation frontier model, as well as GPT-5.6 Terra, a balanced model for efficient, everyday work, and GPT-5.6 Luna, a fast and affordable model for high-volume work.https://t.co/OoM83SyISN
Eh bien, GPT-5.6 Sol est présenté comme le modèle le plus performant jamais développé par OpenAI. L’entreprise met en avant des progrès sur les tâches agentiques. Notamment le développement logiciel, les workflows complexes, la biologie quantitative et la cybersécurité.
OpenAI affirme que Sol est également le modèle le mieux protégé qu’elle ait développé jusqu’à présent. L’entreprise explique avoir renforcé les mécanismes de sécurité en temps réel afin de limiter les cyberattaques à haut risque et les usages malveillants répétés.
Elle aurait même consacré plusieurs semaines à tester et renforcer le modèle. Comment ? Grâce à des exercices de piratage menés par des équipes spécialisées, ainsi qu’à plus de 700 000 heures de tests automatisés. Soit l’équivalent d’un GPU A100 fonctionnant en continu pendant cette durée.
Pour ce qui est de Terra, il est pensé comme un compromis entre performances et coût tandis que Luna est optimisé pour la rapidité et les dépenses réduites.
Que disent les benchmarks ?
Résultat GPT 5.6 sur TerminalBench 2.1 / OpenAI
Selon les benchmarks publiés par OpenAI, Sol prend la tête sur plusieurs évaluations. Sur TerminalBench 2.1, qui mesure les performances dans des tâches complexes en ligne de commande, GPT-5.6 Sol atteint 88,8 %
Sol Ultra, quant à lui, grimpe à 91,9 %. Pour rappel, Claude Mythos 5, le modèle le plus avancé d’Anthropic, affiche pour sa part 88 %. Sur le même benchmark, Terra obtient 84,3 %, contre 83,4 % pour GPT-5.5, tandis que Luna atteint 82,5 %.
Les améliorations ne concernent pas uniquement la programmation. Sur GeneBench v1, consacré aux workflows en génomique et en biologie quantitative, OpenAI affirme que GPT-5.6 Sol dépasse GPT-5.5.
Et pourtant, il consomme moins de tokens. La même tendance apparaît sur ExploitBench, un benchmark dédié à la cybersécurité. Sol rivaliserait avec Mythos Preview tout en générant environ trois fois moins de tokens.
Résultat GPT 5.6 sur ExploitBench / OpenAI
De son côté, GPT-5.6 Terra offre un niveau de performances proche de GPT-5.5 tout en divisant son coût par deux.
Sur GeneBench v1, GPT-5.6 Luna atteint un score d’environ 14 à 15 % pour un coût inférieur à un dollar via l’API. Pour info, GPT-5.5 se situe autour de 23 % pour près de 1,2 dollar.
Terra, lui, grimpe à environ 28 % pour un coût proche de 1,7 dollar. Et Sol atteint environ 31 % pour un coût d’environ 1,9 dollar.
Hier soir, OpenAI a annoncé le lancement en accès limité de GPT-5.6, sa nouvelle génération de modèles. Au programme, trois nouvelles versions avec une stratégie totalement différente.
Hier soir, OpenAI a annoncé le lancement en accès limité de GPT-5.6, sa nouvelle génération de modèles. Au programme, trois nouvelles versions avec une stratégie totalement différente.
OpenAI vient de mettre à jour GPT-5.5 Instant, le modèle utilisé par défaut dans ChatGPT. Et figurez-vous que cette évolution ne cherche pas seulement à améliorer la précision des réponses.
Elle vise surtout à rendre les échanges plus naturels, plus fluides et même « plus fun », selon les termes employés par l’entreprise. Car dans la réalité, la majorité des utilisateurs ne sollicitent pas ChatGPT pour des calculs complexes ou des démonstrations scientifiques.
Ils l’utilisent pour organi
OpenAI vient de mettre à jour GPT-5.5 Instant, le modèle utilisé par défaut dans ChatGPT. Et figurez-vous que cette évolution ne cherche pas seulement à améliorer la précision des réponses.
Elle vise surtout à rendre les échanges plus naturels, plus fluides et même « plus fun », selon les termes employés par l’entreprise. Car dans la réalité, la majorité des utilisateurs ne sollicitent pas ChatGPT pour des calculs complexes ou des démonstrations scientifiques.
Ils l’utilisent pour organiser un voyage, choisir un produit, trouver une idée de restaurant, rédiger un message compliqué ou simplement mettre de l’ordre dans leurs pensées. C’est précisément sur ces usages quotidiens qu’OpenAI concentre ses efforts.
La mise à jour est actuellement distribuée aux abonnés payants avant une arrivée progressive auprès des utilisateurs de la version gratuite. Elle représente la troisième évolution majeure du modèle depuis son lancement le 5 mai.
Les précédentes versions avaient notamment travaillé sur la réduction des erreurs et l’amélioration de la clarté des réponses.
We have a new version of GPT-5.5 Instant for you, and it's much more fun to talk to.
Our most-used model is now better at understanding the intent behind a question and adapting its response accordingly.
It also handles complex constraints more reliably and makes shopping and…
Mise à jour GPT-5.5 Instant : qu’est-ce que ça change ?
D’après OpenAI, GPT-5.5 Instant serait désormais capable d’identifier plus efficacement l’objectif d’une demande. Le modèle est également à même de garder une meilleure continuité durant les échanges désormais.
Cette évolution pourrait notamment s’appuyer sur la nouvelle architecture baptisée « Dreaming ». Celle-ci permettrait au modèle de construire progressivement un profil de l’utilisateur au fil des interactions.
Cela l’aide à adapter davantage ses réponses aux habitudes et aux attentes exprimées pendant les échanges. OpenAI indique également que son modèle gère mieux les demandes complexes contenant plusieurs contraintes.
Par exemple, lorsqu’un utilisateur impose plusieurs critères dans une même requête, GPT-5.5 devrait être en mesure de mieux les prendre en compte. Ce, sans oublier une partie de la demande en cours de route.
Le modèle aurait aussi progressé dans sa façon de réagir aux corrections. Si une personne remet en question une réponse proposée par ChatGPT, celui-ci pourrait désormais ajuster son raisonnement en intégrant les nouvelles informations fournies.
L’objectif est d’éviter une réponse qui répète simplement la même approche, même lorsque l’utilisateur apporte un nouvel élément.
Mistral met à jour son IA de lecture de documents (OCR) et la pousse vers les manuscrits et les langues rares. Derrière l'outil pour développeurs, l'enjeu est très concret : numériser des montagnes d'archives, jusque dans nos administrations.
Mistral met à jour son IA de lecture de documents (OCR) et la pousse vers les manuscrits et les langues rares. Derrière l'outil pour développeurs, l'enjeu est très concret : numériser des montagnes d'archives, jusque dans nos administrations.
Depuis le gel de Claude Mythos par Washington, OpenAI occupe le terrain de l'IA cyber offensive-défensive. Le 22 juin, l'entreprise a annoncé une série de mises à jour substantielles de sa plateforme Daybreak.
Depuis le gel de Claude Mythos par Washington, OpenAI occupe le terrain de l'IA cyber offensive-défensive. Le 22 juin, l'entreprise a annoncé une série de mises à jour substantielles de sa plateforme Daybreak.
Au lancement, Siri AI ne sera pas disponible sur iPhone, iPad et Apple Watch dans les pays de l'Union européenne, sur fond de désaccord entre Apple et la Commission européenne. Comme avec Apple Intelligence il y a deux ans, il est possible de contourner le blocage avec un compte App Store américain et un appareil en anglais. Mais la méthode est loin d'être adaptée à un usage du quotidien.
Au lancement, Siri AI ne sera pas disponible sur iPhone, iPad et Apple Watch dans les pays de l'Union européenne, sur fond de désaccord entre Apple et la Commission européenne. Comme avec Apple Intelligence il y a deux ans, il est possible de contourner le blocage avec un compte App Store américain et un appareil en anglais. Mais la méthode est loin d'être adaptée à un usage du quotidien.
Emmanuel Macron a clôturé une semaine très dense pour la tech française par un discours dédié aux 10 ans de VivaTech. Coupure de Claude Fable en Europe, déploiement de l'Assistant IA dans la fonction publique, nouvel investissement français et appel à développer des alternatives aux États-Unis et à la Chine, notamment en s'appuyant sur l'open source… Le président de la République donne un cahier des charges à quelques mois de son départ.
Emmanuel Macron a clôturé une semaine très dense pour la tech française par un discours dédié aux 10 ans de VivaTech. Coupure de Claude Fable en Europe, déploiement de l'Assistant IA dans la fonction publique, nouvel investissement français et appel à développer des alternatives aux États-Unis et à la Chine, notamment en s'appuyant sur l'open source… Le président de la République donne un cahier des charges à quelques mois de son départ.
Dans une série de messages publiés sur les réseaux sociaux, Arthur Mensch, PDG de Mistral AI, a profité de l’attention accrue portée à l’entreprise ces jours-ci pour esquisser la suite de sa stratégie et renforcer son positionnement dans l'intelligence artificielle.
Dans une série de messages publiés sur les réseaux sociaux, Arthur Mensch, PDG de Mistral AI, a profité de l’attention accrue portée à l’entreprise ces jours-ci pour esquisser la suite de sa stratégie et renforcer son positionnement dans l'intelligence artificielle.
En déplacement en France à l'occasion d'une conférence sur ses ambitions européennes, OpenAI a dévoilé plusieurs nouveautés pour Codex, son application initialement pensée pour les développeurs. L'outil se débride dans l'Union européenne et, à terme, devrait intégrer toutes les fonctions de ChatGPT. OpenAI pense qu'à l'ère des IA agentiques, Codex incarne plus l'avenir qu'un simple chatbot.
En déplacement en France à l'occasion d'une conférence sur ses ambitions européennes, OpenAI a dévoilé plusieurs nouveautés pour Codex, son application initialement pensée pour les développeurs. L'outil se débride dans l'Union européenne et, à terme, devrait intégrer toutes les fonctions de ChatGPT. OpenAI pense qu'à l'ère des IA agentiques, Codex incarne plus l'avenir qu'un simple chatbot.
En trois séances de Bourse, SpaceX est devenue la 5e entreprise la plus valorisée au monde. Dès l'ouverture de Wall Street ce mardi, l'entreprise d'Elon Musk a doublé Amazon -- et même TSMC -- pour s'installer juste derrière Microsoft.
En trois séances de Bourse, SpaceX est devenue la 5e entreprise la plus valorisée au monde. Dès l'ouverture de Wall Street ce mardi, l'entreprise d'Elon Musk a doublé Amazon -- et même TSMC -- pour s'installer juste derrière Microsoft.
ENTRETIEN - Le ministre de l’Action et des Comptes publics David Amiel détaille à Numerama sa stratégie systémique pour déployer une IA souveraine au cœur de l'administration française. Plusieurs outils seront généralisés à l'ensemble des agents à partir de ce mardi 16 juin 2026.
ENTRETIEN - Le ministre de l’Action et des Comptes publics David Amiel détaille à Numerama sa stratégie systémique pour déployer une IA souveraine au cœur de l'administration française. Plusieurs outils seront généralisés à l'ensemble des agents à partir de ce mardi 16 juin 2026.
Sur X (anciennement Twitter), « Le Chaton Fat » est un des sujets les plus discutés du week-end, en France et à l'international. Ce prétendu nouveau modèle surpuissant de Mistral AI, meilleur que Claude Mythos dans les premiers benchmarks, est en réalité une blague. Certains s'amusent juste du nom, d'autres en profitent pour railler Emmanuel Macron et son discours sur la « relance européenne » de l'IA. Même le patron de Mistral AI se prête au jeu.
Sur X (anciennement Twitter), « Le Chaton Fat » est un des sujets les plus discutés du week-end, en France et à l'international. Ce prétendu nouveau modèle surpuissant de Mistral AI, meilleur que Claude Mythos dans les premiers benchmarks, est en réalité une blague. Certains s'amusent juste du nom, d'autres en profitent pour railler Emmanuel Macron et son discours sur la « relance européenne » de l'IA. Même le patron de Mistral AI se prête au jeu.
OpenAI laisse désormais les utilisateurs de Codex mettre de côté leurs réinitialisations de quota pour les utiliser quand ça les arrange. Une petite fonction qui en dit long sur la guerre que se livrent OpenAI et Anthropic à quelques mois (semaines ?) de leurs entrées en Bourse.
OpenAI laisse désormais les utilisateurs de Codex mettre de côté leurs réinitialisations de quota pour les utiliser quand ça les arrange. Une petite fonction qui en dit long sur la guerre que se livrent OpenAI et Anthropic à quelques mois (semaines ?) de leurs entrées en Bourse.
Et si les GAFAM avaient déjà leur successeur ? Né sur X le 9 juin 2026, le mème « MANGOS » remplace les géants historiques par Meta, Anthropic, Nvidia, Google, OpenAI et SpaceX. Un acronyme rigolo, mais surtout révélateur d’un basculement de la tech.
Et si les GAFAM avaient déjà leur successeur ? Né sur X le 9 juin 2026, le mème « MANGOS » remplace les géants historiques par Meta, Anthropic, Nvidia, Google, OpenAI et SpaceX. Un acronyme rigolo, mais surtout révélateur d’un basculement de la tech.
L’application d’intelligence artificielle de Meta est devenue bizarre. Les utilisateurs ne savent plus à quoi ils ont affaire, un assistant ou une plateforme sociale. C’est la conséquence directe du choix de l’entreprise de rendre publiques certaines conversations et créations générées par l’IA.
Voyez-vous, le fil d’actu de Meta AI serait désormais envahie par des publications étranges générées automatiquement. Les genres de contenus cherchant avant tout à provoquer des réactions, des partag
L’application d’intelligence artificielle de Meta est devenue bizarre. Les utilisateurs ne savent plus à quoi ils ont affaire, un assistant ou une plateforme sociale. C’est la conséquence directe du choix de l’entreprise de rendre publiques certaines conversations et créations générées par l’IA.
Voyez-vous, le fil d’actu de Meta AI serait désormais envahie par des publications étranges générées automatiquement. Les genres de contenus cherchant avant tout à provoquer des réactions, des partages et de l’engagement.
D’après plusieurs rapports, certaines publications reprennent les recettes bien connues du clickbait popularisé sur Facebook. D’autres rendent difficile la distinction entre humour, désinformation et simple spam généré par IA.
Meta AI : un fil d’actu problématique ?
Pour de nombreux observateurs, cette évolution n’est pas anodine. Elle pourrait encourager les utilisateurs à produire des contenus toujours plus spectaculaires, émotionnels ou manipulateurs afin de gagner en visibilité.
Malgré cela, Meta assume pleinement cette orientation. L’entreprise ne présente pas son IA comme un simple assistant destiné à répondre à des questions ou à aider à accomplir des tâches.
Sa plateforme encourage également le partage de prompts, d’images créées par l’IA et de messages rédigés avec son aide, accessibles à l’ensemble de la communauté.
Et bon, je dois avouer, cette stratégie peut favoriser l’engagement et multiplier les interactions. Toutefois, elle fait aussi apparaître les mêmes défis de modération que ceux rencontrés depuis des années par les réseaux sociaux traditionnels.
Selon un article de The Verge, les utilisateurs se plaignent de fausses confidences personnelles, de témoignages fictifs fortement chargés en émotions, d’affirmations médicales contestables ou encore de scénarios inventés particulièrement extravagants.
L’expérience peut ainsi devenir confuse. Comme une partie importante des publications est créée ou assistée par l’IA, il devient parfois difficile d’identifier la nature des contenus.
S’il s’agit d’un témoignage authentique, d’une plaisanterie, d’une expérimentation ou d’une fiction pure et simple. Certains spécialistes craignent que cette situation contribue à affaiblir davantage la confiance en ligne. Surtout à mesure que les contenus générés par IA gagnent en réalisme et en pouvoir de persuasion.
Cette problématique dépasse d’ailleurs le seul cas de Meta. L’ensemble de l’industrie de l’IA cherche actuellement à accroître l’engagement des utilisateurs. Ce tout en essayant de mettre en place des garde-fous efficaces.
Or, plus ces outils deviennent interactifs et sociaux, plus les systèmes de modération semblent avoir du mal à suivre le rythme.
OpenAI a déployé deux nouvelles options de sécurité pour les comptes ChatGPT : un mode de verrouillage pour limiter les risques d'exfiltration liés aux injections de prompts, et une fonctionnalité de gestion des sessions actives ouverte à tous.
OpenAI a déployé deux nouvelles options de sécurité pour les comptes ChatGPT : un mode de verrouillage pour limiter les risques d'exfiltration liés aux injections de prompts, et une fonctionnalité de gestion des sessions actives ouverte à tous.
Dans un article paru le 7 juin 2026, le quotidien britannique The Guardian décrit comment des escrocs sont parvenus à faire remonter des boutiques clonées dans les réponses de ChatGPT. Une technique qui a exploité à la fois les failles des LLM et la disparition d'une marque emblématique.
Dans un article paru le 7 juin 2026, le quotidien britannique The Guardian décrit comment des escrocs sont parvenus à faire remonter des boutiques clonées dans les réponses de ChatGPT. Une technique qui a exploité à la fois les failles des LLM et la disparition d'une marque emblématique.
Dans un article paru le 3 juin 2026, le site américain 404 Media révèle comment des entreprises exploitent Reddit pour manipuler les réponses de ChatGPT et de la recherche IA de Google.
Dans un article paru le 3 juin 2026, le site américain 404 Media révèle comment des entreprises exploitent Reddit pour manipuler les réponses de ChatGPT et de la recherche IA de Google.