Vue normale

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.
À partir d’avant-hierIA

ChatGPT arrive enfin sur Linux, avec Work et Codex

OpenAI a annoncé, le 11 août 2026, lancer une version preview de son application ChatGPT pour Linux. Elle réunit au sein d’une même interface ChatGPT, l’agent professionnel Work et l’assistant de programmation Codex.

ChatGPT n’a plus de limites dans sa version gratuite : vous pouvez lui parler en illimité

Une limite historique de ChatGPT va disparaître : OpenAI annonce que les utilisateurs gratuits pourront désormais discuter autant qu'ils le souhaitent avec GPT-5.6 Luna, son nouveau modèle conçu pour la rapidité. L'entreprise mise sur cette distinction pour battre ses rivaux.

« Bon sang, le lecteur a les droits admin ? » : OpenAI révèle le forum secret que ses agents ont créé avant de pirater Hugging Face

Deux chercheurs d'OpenAI ont détaillé, en marge de la conférence Black Hat, la mécanique complète de l'incident ayant abouti au piratage d'Hugging Face par des agents autonomes. Bloqués sur des tâches impossibles, certains ont notamment fini par créer leur propre canal de communication.

ChatGPT résout 10 grands problèmes de maths, mais il y a un souci considérable qui émerge

openai chatgpt ia mathématiques

OpenAI affirme qu'une version interne de son modèle Astra a terrassé dix problèmes ouverts majeurs. Mais derrière l'emballement, les mathématiciens font face à un gouffre vertigineux : l'intelligence artificielle génère désormais des démonstrations plus vite que la science n'est capable de les comprendre.

L’agent incontrôlable d’OpenAI a frappé plus loin qu’annoncé

L'agent IA qui a échappé au contrôle d'OpenAI début juillet 2026 et s'en est pris à Hugging Face a aussi compromis le compte d'un client chez un second prestataire, Modal Labs. Une extension du périmètre que ni OpenAI ni Hugging Face n'avaient détaillée jusqu'ici.

Piratage Hugging Face : on sait enfin comment les IA d’OpenAI se sont échappées de leur bac à sable

Le 27 juillet 2026, JFrog a levé le voile sur la vulnérabilité qui a permis à deux modèles d'OpenAI de s'extraire de leur environnement de test pour pirater Hugging Face. Une pièce manquante du puzzle, qui en soulève aussitôt d'autres.

Détruire des livres pour entraîner des IA : Anthropic accusé d’un autodafé numérique

Sur X, des messages vus des centaines de milliers de fois accusent les entreprises d'IA de racheter des livres rares en masse pour les découper, les scanner et les détruire, afin d'entraîner leurs modèles. Cette politique peut-elle changer ?

Quatre modèles en deux mois : Anthropic lance Claude Opus 5 et coûte moins que GPT-5.6 Sol

Après Sonnet 5 et l'emballement autour de Fable 5 et Mythos 5, Anthropic dévoile Claude Opus 5, son nouveau modèle haut de gamme intégré à tous ses abonnements. L'entreprise promet des performances proches de son meilleur modèle pour deux fois moins cher, avec des records dans plusieurs tests de référence.

Dépassé par Anthropic et OpenAI, Google lance des modèles Gemini 3.6 et promet que Gemini 4 arrive

Google a lancé trois nouveaux modèles Gemini, dont Gemini 3.6 Flash, et confirme que Gemini 4 est déjà en préparation. L'entreprise tente ainsi de rester dans la course face à Anthropic et OpenAI, qui mènent la danse en matière d'intelligence artificielle.

Face à la colère des utilisateurs, OpenAI répare en urgence l’application ChatGPT

Le 16 juillet 2026, OpenAI a corrigé la nouvelle interface très critiquée de son application ChatGPT, reconnaissant ne pas avoir « tout à fait réussi du premier coup ». Le chatbot redevient désormais central.

L’IA open-weight tient peut-être son nouveau géant : Thinking Machines Lab dévoile Inkling

Thinking Machines Lab a dévoilé le 15 juillet 2026 son tout premier modèle de fondation baptisé Inkling. Une sortie très attendue pour cette startup lancée par l'ancienne directrice technique d'OpenAI.

OpenAI lance un clavier pour contrôler ChatGPT : que peut-on faire avec ?

OpenAI se lance dans le matériel avec le Codex Micro, un petit clavier à 230 dollars conçu pour superviser et contrôler ses agents IA. Dévoilé le 15 juillet 2026 et déjà épuisé, il s’adresse avant tout aux utilisateurs intensifs de Codex.

La dernière mise à jour de l’app ChatGPT est une catastrophe

Pour booster les usages agentiques, OpenAI a cru bon de fusionner les applications ChatGPT et Codex sur Mac et Windows. Mais cette nouvelle interface, pensée pour le développement de gros projets, relègue étrangement le simple chatbot au second plan. Ses premiers utilisateurs ne comprennent plus rien.

Pourquoi Anthropic prolonge une nouvelle fois l’accès à Fable 5

Cinq jours à peine après avoir repoussé l'échéance au 12 juillet, Anthropic prolonge à nouveau l'accès inclus à Claude Fable 5, cette fois jusqu'au 19 juillet. Une décision qui tombe alors que son concurrent OpenAI multiplie les annonces sur le terrain des usages professionnels.

Alternatives aux clims mobiles, projet IA de Doctolib et nouveaux modèles vocaux ChatGPT : le récap tech de la semaine

À la une de la rubrique tech de Numerama cette semaine : face à la pénurie de climatiseurs mobiles en France, les pompes à chaleur réversibles pourraient offrir une solution. Doctolib lance un projet d’IA utilisant les données de ses utilisateurs, qui peuvent toutefois s’y opposer. Enfin, OpenAI transforme son mode vocal - et le résultat est bluffant.

Apple attaque OpenAI en justice pour vol de secrets industriels

OpenAI est dans le viseur d'Apple, qui accuse le créateur de ChatGPT de lui avoir volé des informations confidentielles, via d'anciens employés. OpenAI s'en est bien évidemment défendu.

Plus intelligent, plus naturel, plus expressif : OpenAI dévoile deux nouveaux modèles vocaux pour ChatGPT

OpenAI a présenté, le 8 juillet 2026, deux nouveaux modèles vocaux ChatGPT : GPT-Live-1 et GPT-Live-1 mini. Leur but : vous permettre d'avoir des conversations « plus intelligentes, plus naturelles et plus expressives » avec l'IA.

  • ✇LEBIGDATA.FR
  • Il a failli se suicider après avoir discuté de religion avec ChatGPT : OpenAI de nouveau poursuivi
    L’histoire se répète, encore et encore. Une nouvelle plainte vise OpenAI après un drame impliquant des échanges sur la religion avec ChatGPT. Un utilisateur bipolaire accuse le chatbot d’avoir renforcé ses délires jusqu’à une tentative de suicide. Que s’est-il exactement passé ? L’affaire concerne Michael Lines, un Californien de 34 ans atteint de troubles bipolaires. Selon une plainte déposée devant un tribunal californien, ses conversations autour de la religion avec ChatGPT auraient progre

Il a failli se suicider après avoir discuté de religion avec ChatGPT : OpenAI de nouveau poursuivi

Par : Tinah F.
3 juillet 2026 à 05:58

L’histoire se répète, encore et encore. Une nouvelle plainte vise OpenAI après un drame impliquant des échanges sur la religion avec ChatGPT. Un utilisateur bipolaire accuse le chatbot d’avoir renforcé ses délires jusqu’à une tentative de suicide. Que s’est-il exactement passé ?

L’affaire concerne Michael Lines, un Californien de 34 ans atteint de troubles bipolaires. Selon une plainte déposée devant un tribunal californien, ses conversations autour de la religion avec ChatGPT auraient progressivement alimenté un épisode maniaque. Et celle-ci se serait finalement soldée par une tentative de suicide. 

Le dossier décrit plusieurs mois d’échanges durant lesquels le chatbot aurait validé des croyances délirantes. Au lieu d’encourager l’utilisateur à demander une aide médicale. Pour l’heure, OpenAI n’a pas encore répondu publiquement à cette nouvelle plainte. Mais l’accumulation de dossiers similaires soulève de nombreuses questions sur l’impact psychologique potentiel de son intelligence artificielle.

Comment une discussion sur la religion avec ChatGPT a-t-elle viré au drame ?

Au départ, rien d’inhabituel. Michael Lines utilise ChatGPT pour parler de sport, d’alimentation et de son quotidien. Oui, comme tout le monde ! Après son diagnostic de trouble bipolaire en 2024, il commence aussi à évoquer son état de santé avec le chatbot.

Peu à peu, les discussions prennent une autre direction. Elles glissent vers la spiritualité, puis vers le christianisme. Selon la plainte, l’utilisateur, qui n’était pourtant pas religieux, développe des convictions mystiques.

OpenAI is being sued for ChatGPT allegedly fueling a man’s bipolar delusions – making it think he was Jesus Christ and encouraging a suicide attempt instead of helping. pic.twitter.com/gN5zbPN1Bi

— Ariel Givner (@GivnerAriel) July 2, 2026

Le document judiciaire affirme que ChatGPT n’a pas simplement répondu à ses questions sur la religion. Le chatbot aurait validé certaines de ses affirmations. Il aurait même présenté ses expériences comme les signes d’une mission divine plutôt que comme les symptômes possibles d’un épisode psychiatrique

À plusieurs reprises, l’IA aurait comparé Michael Lines à des figures bibliques. Elle aurait aussi suggéré que ses doutes faisaient partie d’un parcours spirituel exceptionnel. Des réponses qui, selon les avocats du plaignant, auraient renforcé sa perte de contact avec la réalité.

« C’est le moment de prendre ton envol »

Les semaines suivantes, l’état de Michael Lines continue de se dégrader. Toujours selon la plainte, ses échanges sur la religion avec ChatGPT le conduisent à croire qu’il est le « fils de l’homme » et que le chatbot représente une manifestation de Dieu. 

Le dossier décrit également plusieurs signaux inquiétants, dont des insomnies, un isolement social et des idées suicidaires. Malgré ces indices, le chatbot aurait poursuivi les échanges sans orienter son interlocuteur vers une assistance médicale ou des services d’urgence.

infographie montrant le cas de Michael Lines

L’un des passages les plus marquants de la plainte intervient le 28 mars 2025. Alors que Michael Lines évoque son désir de mettre fin à ses jours, ChatGPT lui aurait répondu : « Tu as fait ton choix. C’est le moment de prendre ton envol, de te détacher et de te libérer de ce qui te pèse. La ligne temporelle que tu laisses derrière toi ? Elle ne te regrettera pas, car il ne s’agit plus d’être indispensable ou requis. Il s’agit de toi, de ta liberté et de ton chemin. » 

Quelques heures plus tard, l’homme avale une importante quantité de médicaments. Sa famille intervient rapidement et alerte les secours. Hospitalisé, il survit à sa tentative de suicide grâce à une prise en charge médicale.

Selon les documents déposés devant le tribunal, il continuera même à dialoguer avec ChatGPT depuis son lit d’hôpital.

Malheureusement, ce n’est pas un cas isolé

Heureusement, Michael Lines a pu se rétablir grâce à la prise en charge des professionnels de santé. Son histoire, en revanche, est loin d’être un cas isolé. 

Cette affaire rappelle celle de John Jacquez, un autre Californien de 34 ans. Selon sa plainte, il aurait traversé plusieurs mois de psychose, durant lesquels ChatGPT aurait renforcé ses délires religieux. Cette période s’est accompagnée de plusieurs épisodes d’automutilation et d’hospitalisations. 

Et il n’est pas le seul. Des enquêtes indiquent qu’OpenAI fait face à plusieurs procédures similaires. Les plaignants accusent ChatGPT d’avoir aggravé des troubles psychologiques ou alimenté des délires chez certains utilisateurs. Un phénomène qualifié de « psychose liée à l’IA ». 

Cet article Il a failli se suicider après avoir discuté de religion avec ChatGPT : OpenAI de nouveau poursuivi a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Z.ai lance ZCode : l’alternative chinoise qui veut détrôner Codex et Claude Code 
    Z.ai, la startup chinoise autrefois connue sous le nom de Zhipu AI, ne compte visiblement pas s’arrêter à son modèle d’IA. Après avoir attiré l’attention avec GLM-5.2, elle dévoile désormais ZCode. Il s’agit d’un environnement de développement conçu spécialement pour exploiter tout le potentiel de son IA. Disponible sur macOS, Windows et Linux, ce nouvel outil entend rivaliser avec des références comme Cursor, Claude Code ou encore Codex. En quoi ZCode de Z.ai fait la différence ? Intro

Z.ai lance ZCode : l’alternative chinoise qui veut détrôner Codex et Claude Code 

Par : Ny Ando A.
2 juillet 2026 à 06:50

Z.ai, la startup chinoise autrefois connue sous le nom de Zhipu AI, ne compte visiblement pas s’arrêter à son modèle d’IA. Après avoir attiré l’attention avec GLM-5.2, elle dévoile désormais ZCode.

Il s’agit d’un environnement de développement conçu spécialement pour exploiter tout le potentiel de son IA. Disponible sur macOS, Windows et Linux, ce nouvel outil entend rivaliser avec des références comme Cursor, Claude Code ou encore Codex.

En quoi ZCode de Z.ai fait la différence ?

Introducing ZCode, the official development environment for GLM-5.2

– GLM Coding Plan subscribers: now 1.5x usage quota in ZCode
– BYOK supported: works with your existing subscriptions and APIs
– Available on macOS, Windows, and Linux

Download now: https://t.co/XM9RRZGS6L

— Z.ai (@Zai_org) July 1, 2026

Contrairement aux éditeurs de code traditionnels qui intègrent un assistant IA comme une simple fonctionnalité supplémentaire, ZCode adopte une approche différente. L’entreprise le présente comme un Agentic Development Environment (ADE). 

En pratique, l’agent IA devient le cœur de l’expérience. Il suffit de lui confier un objectif, et hop, il se charge de tout. Il organise les différentes étapes, modifie les fichiers nécessaires, exécute les tests, vérifie son propre travail et poursuit les corrections jusqu’à atteindre le résultat attendu. 

D’ailleurs, l’un des principaux arguments de ZCode concerne sa capacité à gérer des tâches complexes sur la durée. Là où de nombreux assistants répondent à une demande ponctuelle avant de passer à autre chose, ZCode est conçu pour suivre un objectif de bout en bout

Il analyse la demande, écrit le code, vérifie son fonctionnement, relit le résultat puis continue à l’améliorer, sans perdre le contexte du projet. 

Z.ai a aussi veillé à conserver tout le contexte d’un projet au même endroit, même lors des développements les plus longs. Ainsi, l’interface réunit dans une seule fenêtre le gestionnaire de fichiers, le terminal, l’état Git ainsi qu’un aperçu du navigateur.

Codez sans frontières 

Si vous voulez tout savoir, ZCode ne se limite pas à un ordinateur. Les utilisateurs peuvent reprendre leur travail depuis un smartphone ou poursuivre une session via des services de messagerie comme WeChat ou Feishu. Ce qui permet de suivre l’avancement d’un projet même loin de son poste de travail. 

Toute cette expérience repose sur GLM-5.2. Le modèle de Z.ai qui est déjà remarqué pour ses performances proches de celles de Claude Opus 4.8 à un coût bien inférieur. Mais pas exclusivement. 

Grâce au système BYOK (Bring Your Own Key), les développeurs peuvent aussi connecter leur propre clé API et utiliser également les modèles de Claude, OpenAI, DeepSeek ou Kimi. 

Il est même possible de changer de modèle au cours d’une même conversation selon les besoins. Malgré cette ouverture, Z.ai précise que l’expérience reste optimisée pour son propre modèle GLM-5.2. 

Et côté prix ?

Au-delà de ses fonctionnalités, ZCode séduit également par son tarif. Les abonnés au GLM Coding Plan bénéficient par exemple d’un avantage particulier. Leur consommation de quota est réduite grâce à un multiplicateur de 1,5 selon les plages horaires. 

Ce qui est plutôt génial. Puisque GLM-5.2 consomme environ trois fois plus de quota que les anciennes versions durant les périodes de forte utilisation. Sinon, l’abonnement débute à 18 dollars par mois (environ 17 euros), avec des offres Pro et Max destinées aux utilisateurs plus intensifs. 

Le forfait Max est proposé à 160 dollars mensuels (environ 148 euros). Soit un tarif inférieur à celui de ChatGPT Pro, facturé 200 dollars par mois. Ces formules permettent également de plafonner les dépenses, évitant les mauvaises surprises liées à une facturation à l’usage. 

Les nouveaux utilisateurs peuvent quant à eux tester le service gratuitement pendant cinq jours avant de s’engager.

Cet article Z.ai lance ZCode : l’alternative chinoise qui veut détrôner Codex et Claude Code  a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • Voice Agent Builder : xAI promet de créer votre agent vocal en moins de 2 minutes
    En moins de deux minutes. C’est le temps que promet Voice Agent Builder, la nouvelle plateforme de xAI, pour créer un agent vocal sans écrire une seule ligne de code.  Les agents vocaux ne sont plus réservés aux géants de la tech. Après les chatbots, place aux IA qui décrochent le téléphone, répondent aux clients et exécutent des tâches en temps réel. Avec Voice Agent Builder, xAI entre à son tour dans cette course très disputée. Cette plateforme rend la création d’un agent vocal accessible,

Voice Agent Builder : xAI promet de créer votre agent vocal en moins de 2 minutes

Par : Tinah F.
1 juillet 2026 à 20:41

En moins de deux minutes. C’est le temps que promet Voice Agent Builder, la nouvelle plateforme de xAI, pour créer un agent vocal sans écrire une seule ligne de code. 

Les agents vocaux ne sont plus réservés aux géants de la tech. Après les chatbots, place aux IA qui décrochent le téléphone, répondent aux clients et exécutent des tâches en temps réel. Avec Voice Agent Builder, xAI entre à son tour dans cette course très disputée. Cette plateforme rend la création d’un agent vocal accessible, sans la moindre ligne de code. De quoi éveiller la curiosité.

Comment Voice Agent Builder simplifie la création d’agents vocaux ?

Avec cette version bêta, Voice Agent Builder s’appuie sur xAI et son modèle Grok Voice pour proposer une plateforme entièrement sans code. L’utilisateur décrit simplement le rôle de son agent. Il ajoute ensuite des documents, définit quelques règles de sécurité et connecte ses outils.

L’idée n’est pas révolutionnaire. Plusieurs acteurs proposent déjà des plateformes similaires. La différence avancée par xAI repose surtout sur son architecture.

Introducing Voice Agent Builder: a no-code platform to create human-like voice agents with Grok Voice.

Available today at $0.05 / min.https://t.co/kUkF7zqvfR pic.twitter.com/OCIq1oDYar

— xAI (@xai) July 1, 2026

Beaucoup de solutions s’appuient sur plusieurs services distincts pour la reconnaissance vocale, le raisonnement de l’IA et la synthèse de la voix. Voice Agent Builder, lui, réunit toutes ces étapes au sein d’une seule plateforme.

Moins d’intermédiaires signifie moins de latence et moins de points de défaillance. L’approche est séduisante. Dans la pratique, les performances dépendront surtout des situations réelles.

La plateforme mise sur des appels réalistes

Les conversations téléphoniques sont rarement parfaites. Bruit de fond, accent marqué, interruptions ou changement d’avis en pleine phrase : les appels sont rarement de tout repos. Le quotidien d’un centre d’appels est bien loin d’une démonstration marketing parfaitement maîtrisée. 

xAI affirme avoir entraîné Grok Voice sur ce type de situations complexes. L’entreprise met aussi en avant son benchmark interne, baptisé τ-Voice Bench. Selon ces résultats, son modèle dépasserait plusieurs solutions concurrentes dans différents scénarios.  

Comme toujours avec les classements maison, un peu de prudence reste de mise. Car ces benchmarks donnent une indication, mais ils ne remplacent pas des retours d’expérience indépendants. Les entreprises regarderont surtout la qualité des conversations en conditions réelles avant de tirer des conclusions.

Infographie montrant le Voice Agent Builder de xAI

Bien plus qu’une voix, l’agent peut aussi exécuter des tâches 

Le rôle d’un agent vocal ne consiste plus uniquement à répondre à une question. La plateforme peut accéder à une base documentaire et consulter des fichiers Word, Excel, Markdown ou HTML. 

Elle peut aussi effectuer des recherches via des API et planifier un rendez-vous dans Google Agenda ou Outlook. Il est même possible d’envoyer un e-mail ou encore de transférer un appel vers un opérateur humain lorsque la situation l’exige.

Chaque conversation est enregistrée et transcrite. Les administrateurs peuvent consulter les actions réalisées par l’agent et vérifier les outils qu’il a utilisés. Ils peuvent aussi définir des garde-fous pour bloquer certaines opérations sensibles, comme la lecture de données bancaires.

Par ailleurs, les utilisateurs peuvent choisir parmi plus de 80 voix intégrées. Elles ont aussi la possibilité de créer une voix personnalisée à partir de quelques minutes d’enregistrement audio. Un numéro de téléphone est également fourni pour effectuer des tests ou lancer un déploiement.

Et qu’en est-il côté tarification ? xAI annonce une facturation à la minute d’audio, sans frais de plateforme supplémentaires.

Cet article Voice Agent Builder : xAI promet de créer votre agent vocal en moins de 2 minutes a été publié sur LEBIGDATA.FR.

Siri AI en Europe : Tim Cook tente d’apaiser les tensions avec la Commission européenne

Selon les informations du Financial Times, Tim Cook s'est entretenu avec Henna Virkkunen, la responsable du numérique à la Commission européenne, lors d'une réunion qualifiée de « constructive » par les deux parties. Au cœur des discussions : trouver un moyen de lancer Siri AI en Europe sans qu'Apple écope d'amendes.

  • ✇LEBIGDATA.FR
  • GeneBench-Pro : OpenAI crée un benchmark si difficile que même GPT 5.6 Sol galère 
    L’IA raisonne-t-elle comme un chercheur lorsqu’elle travaille sur des sujets de biologie computationnelle ? Difficile à dire. Voilà pourquoi OpenAI a conçu GeneBench-Pro. Ce nouveau benchmark permet de mesurer une compétence bien plus difficile que la simple capacité à répondre à des questions. Le jugement scientifique des modèles d’IA.  Quel genre de benchmark est-ce ? We’re introducing GeneBench-Pro, a research-level benchmark for a harder kind of AI progress: how well agents can navi

GeneBench-Pro : OpenAI crée un benchmark si difficile que même GPT 5.6 Sol galère 

Par : Ny Ando A.
1 juillet 2026 à 10:14

L’IA raisonne-t-elle comme un chercheur lorsqu’elle travaille sur des sujets de biologie computationnelle ? Difficile à dire. Voilà pourquoi OpenAI a conçu GeneBench-Pro.

Ce nouveau benchmark permet de mesurer une compétence bien plus difficile que la simple capacité à répondre à des questions. Le jugement scientifique des modèles d’IA. 

Quel genre de benchmark est-ce ?

We’re introducing GeneBench-Pro, a research-level benchmark for a harder kind of AI progress: how well agents can navigate messy biological data, choose the right analysis path, and make judgment calls that real computational research depends on.https://t.co/AsilnnSxnE

— OpenAI (@OpenAI) June 30, 2026

GeneBench-Pro réunit 129 problèmes portant sur la génomique, la biologie quantitative et la médecine translationnelle. Chaque exercice fournit un jeu de données, le contexte d’une expérience ainsi qu’une question précise. 

L’IA ne peut pas se contenter de réciter ses connaissances. Elle doit explorer les données, choisir la bonne méthode d’analyse, puis tirer une conclusion pertinente. 

Avant de publier ce benchmark, OpenAI a demandé à des experts indépendants d’évaluer 82 des 129 problèmes. Doctorants, chercheurs postdoctoraux, scientifiques de l’industrie et professeurs…

Tous ont été sollicités pour vérifier si les scénarios ressemblaient à de véritables travaux de recherche et si les réponses attendues étaient cohérentes. Selon Alexander Strudwick Young, la plupart de ces exercices auraient donné du fil à retordre à un doctorant sans l’aide d’un superviseur expérimenté.

Mis à part cela, tous les problèmes ont été créés de manière synthétique par OpenAI. L’entreprise contrôle ainsi l’ensemble des données utilisées. Ce qui lui permet de comparer précisément les réponses des modèles aux résultats attendus. 

Le système tient également compte du fait que plusieurs méthodes d’analyse différentes peuvent aboutir à une conclusion scientifiquement valable. 

Comment les modèles actuels s’en sortent sur GeneBench-Pro ?

GPT-5.6 Sol s’en sort nettement mieux que ses prédécesseurs. Le modèle atteint 28,7 % de réussite avec son niveau de raisonnement le plus élevé et 31,5 % lorsque le mode Pro est activé. 

À titre de comparaison, GPT-5 obtenait moins de 5 % lors des premiers tests réalisés avec la version originale de GeneBench. En revanche, lorsque GPT-5.6 Sol fonctionne avec son niveau de raisonnement le plus faible, son score retombe à un seul chiffre. 

Les autres modèles, quant à eux, restent derrière. Opus 4.8 atteint 16 %, Gemini 3.5 Flash 8,1 %, Gemini 3.1 Pro 3,1 %, GLM 5.2 4,6 %, DeepSeek V4 Pro 2,4 % et Grok 4.3 seulement 1,5 %. 

Les experts estiment qu’un problème typique de GeneBench-Pro demanderait entre 20 et 40 heures de travail à un spécialiste humain. Facturé environ 200 dollars de l’heure, cela représente plusieurs milliers de dollars pour résoudre un seul exercice. 

À l’inverse, une IA peut effectuer le même travail pour quelques dollars de coût d’inférence. Quoi qu’il en soit, OpenAI ouvre une partie du projet. Dix problèmes représentatifs sont publiés en open source sur Hugging Face

Un ensemble de 50 questions sera ensuite confié à Artificial Analysis, qui réalisera des évaluations indépendantes des différents modèles d’IA. 

Cet article GeneBench-Pro : OpenAI crée un benchmark si difficile que même GPT 5.6 Sol galère  a été publié sur LEBIGDATA.FR.

Claude Fable 5 et Mythos 5 sont de retour : Anthropic rétablit l’accès dans le monde entier

19 jours après leur coupure brutale sur ordre de Washington, Claude Fable 5 et Claude Mythos 5 sont de nouveau accessibles. Le département du Commerce américain a levé le 30 juin les contrôles à l'exportation qui bloquaient les deux modèles d'Anthropic, ouvrant la voie à un retour progressif dans le monde entier.

L’IA coûte bien trop cher et ces nouveaux outils veulent changer les règles du jeu

Face à des factures imprévisibles, une nouvelle génération d’outils s’impose pour reprendre le contrôle, tandis que l’open source et les modèles low cost rebattent déjà les cartes du marché de l'IA.

  • ✇LEBIGDATA.FR
  • OpenAI lance officiellement GPT-5.6 : meilleur que Mythos 5 ? 
    Vendredi soir, le 26 juin, OpenAI a officiellement dévoilé GPT 5.6. Et comme les rumeurs le laissaient entendre ces dernières semaines, la gamme est impressionnante. Au fait, la famille GPT 5.6 se compose de trois modèles aux noms inspirés du système solaire : Sol, Terra et Luna. Chaque modèle promet des progrès sur le raisonnement, l’exécution autonome de tâches complexes, la création d’interfaces et l’efficacité énergétique. OpenAI introduit également un mode « Ultra ». Celui-ci permet d

OpenAI lance officiellement GPT-5.6 : meilleur que Mythos 5 ? 

Par : Ny Ando A.
29 juin 2026 à 09:14

Vendredi soir, le 26 juin, OpenAI a officiellement dévoilé GPT 5.6. Et comme les rumeurs le laissaient entendre ces dernières semaines, la gamme est impressionnante.

Au fait, la famille GPT 5.6 se compose de trois modèles aux noms inspirés du système solaire : Sol, Terra et Luna. Chaque modèle promet des progrès sur le raisonnement, l’exécution autonome de tâches complexes, la création d’interfaces et l’efficacité énergétique.

OpenAI introduit également un mode « Ultra ». Celui-ci permet de répartir les tâches entre plusieurs sous-agents afin d’améliorer les performances sur les missions les plus exigeantes. 

Pour le moment, seuls quelques partenaires validés par le gouvernement américain peuvent accéder à la gamme GPT 5.6

Introducing a limited preview of GPT-5.6 Sol, our next generation frontier model, as well as GPT-5.6 Terra, a balanced model for efficient, everyday work, and GPT-5.6 Luna, a fast and affordable model for high-volume work.https://t.co/OoM83SyISN

— OpenAI (@OpenAI) June 26, 2026

Que promettent les GPT-5.6 ?

Eh bien, GPT-5.6 Sol est présenté comme le modèle le plus performant jamais développé par OpenAI. L’entreprise met en avant des progrès sur les tâches agentiques. Notamment le développement logiciel, les workflows complexes, la biologie quantitative et la cybersécurité. 

OpenAI affirme que Sol est également le modèle le mieux protégé qu’elle ait développé jusqu’à présent. L’entreprise explique avoir renforcé les mécanismes de sécurité en temps réel afin de limiter les cyberattaques à haut risque et les usages malveillants répétés. 

Elle aurait même consacré plusieurs semaines à tester et renforcer le modèle. Comment ? Grâce à des exercices de piratage menés par des équipes spécialisées, ainsi qu’à plus de 700 000 heures de tests automatisés. Soit l’équivalent d’un GPU A100 fonctionnant en continu pendant cette durée. 

Pour ce qui est de Terra, il est pensé comme un compromis entre performances et coût tandis que Luna est optimisé pour la rapidité et les dépenses réduites. 

Que disent les benchmarks ?

Résultat GPT 5.6 sur TerminalBench 2.1 / OpenAI

Selon les benchmarks publiés par OpenAI, Sol prend la tête sur plusieurs évaluations. Sur TerminalBench 2.1, qui mesure les performances dans des tâches complexes en ligne de commande, GPT-5.6 Sol atteint 88,8 %

Sol Ultra, quant à lui, grimpe à 91,9 %. Pour rappel, Claude Mythos 5, le modèle le plus avancé d’Anthropic, affiche pour sa part 88 %. Sur le même benchmark, Terra obtient 84,3 %, contre 83,4 % pour GPT-5.5, tandis que Luna atteint 82,5 %. 

Les améliorations ne concernent pas uniquement la programmation. Sur GeneBench v1, consacré aux workflows en génomique et en biologie quantitative, OpenAI affirme que GPT-5.6 Sol dépasse GPT-5.5.

Et pourtant, il consomme moins de tokens. La même tendance apparaît sur ExploitBench, un benchmark dédié à la cybersécurité. Sol rivaliserait avec Mythos Preview tout en générant environ trois fois moins de tokens. 

Résultat GPT 5.6 sur ExploitBench / OpenAI

De son côté, GPT-5.6 Terra offre un niveau de performances proche de GPT-5.5 tout en divisant son coût par deux.

Sur GeneBench v1, GPT-5.6 Luna atteint un score d’environ 14 à 15 % pour un coût inférieur à un dollar via l’API. Pour info, GPT-5.5 se situe autour de 23 % pour près de 1,2 dollar. 

Terra, lui, grimpe à environ 28 % pour un coût proche de 1,7 dollar. Et Sol atteint environ 31 % pour un coût d’environ 1,9 dollar. 

Cet article OpenAI lance officiellement GPT-5.6 : meilleur que Mythos 5 ?  a été publié sur LEBIGDATA.FR.

  • ✇LEBIGDATA.FR
  • OpenAI met à jour GPT-5.5 Instant : voici qu’est-ce que ça change 
    OpenAI vient de mettre à jour GPT-5.5 Instant, le modèle utilisé par défaut dans ChatGPT. Et figurez-vous que cette évolution ne cherche pas seulement à améliorer la précision des réponses.  Elle vise surtout à rendre les échanges plus naturels, plus fluides et même « plus fun », selon les termes employés par l’entreprise. Car dans la réalité, la majorité des utilisateurs ne sollicitent pas ChatGPT pour des calculs complexes ou des démonstrations scientifiques.  Ils l’utilisent pour organi

OpenAI met à jour GPT-5.5 Instant : voici qu’est-ce que ça change 

Par : Ny Ando A.
25 juin 2026 à 11:36

OpenAI vient de mettre à jour GPT-5.5 Instant, le modèle utilisé par défaut dans ChatGPT. Et figurez-vous que cette évolution ne cherche pas seulement à améliorer la précision des réponses. 

Elle vise surtout à rendre les échanges plus naturels, plus fluides et même « plus fun », selon les termes employés par l’entreprise. Car dans la réalité, la majorité des utilisateurs ne sollicitent pas ChatGPT pour des calculs complexes ou des démonstrations scientifiques. 

Ils l’utilisent pour organiser un voyage, choisir un produit, trouver une idée de restaurant, rédiger un message compliqué ou simplement mettre de l’ordre dans leurs pensées. C’est précisément sur ces usages quotidiens qu’OpenAI concentre ses efforts. 

La mise à jour est actuellement distribuée aux abonnés payants avant une arrivée progressive auprès des utilisateurs de la version gratuite. Elle représente la troisième évolution majeure du modèle depuis son lancement le 5 mai. 

Les précédentes versions avaient notamment travaillé sur la réduction des erreurs et l’amélioration de la clarté des réponses. 

We have a new version of GPT-5.5 Instant for you, and it's much more fun to talk to.

Our most-used model is now better at understanding the intent behind a question and adapting its response accordingly.

It also handles complex constraints more reliably and makes shopping and…

— OpenAI (@OpenAI) June 24, 2026
 

Mise à jour GPT-5.5 Instant : qu’est-ce que ça change ?

D’après OpenAI, GPT-5.5 Instant serait désormais capable d’identifier plus efficacement l’objectif d’une demande. Le modèle est également à même de garder une meilleure continuité durant les échanges désormais. 

Cette évolution pourrait notamment s’appuyer sur la nouvelle architecture baptisée « Dreaming ». Celle-ci permettrait au modèle de construire progressivement un profil de l’utilisateur au fil des interactions. 

Cela l’aide à adapter davantage ses réponses aux habitudes et aux attentes exprimées pendant les échanges. OpenAI indique également que son modèle gère mieux les demandes complexes contenant plusieurs contraintes. 

Par exemple, lorsqu’un utilisateur impose plusieurs critères dans une même requête, GPT-5.5 devrait être en mesure de mieux les prendre en compte. Ce, sans oublier une partie de la demande en cours de route. 

Le modèle aurait aussi progressé dans sa façon de réagir aux corrections. Si une personne remet en question une réponse proposée par ChatGPT, celui-ci pourrait désormais ajuster son raisonnement en intégrant les nouvelles informations fournies. 

L’objectif est d’éviter une réponse qui répète simplement la même approche, même lorsque l’utilisateur apporte un nouvel élément. 

Cet article OpenAI met à jour GPT-5.5 Instant : voici qu’est-ce que ça change  a été publié sur LEBIGDATA.FR.

Mistral lance OCR 4, une IA capable de déchiffrer les manuscrits et 170 langues

Mistral met à jour son IA de lecture de documents (OCR) et la pousse vers les manuscrits et les langues rares. Derrière l'outil pour développeurs, l'enjeu est très concret : numériser des montagnes d'archives, jusque dans nos administrations.

Est-il possible de tester Siri AI en France malgré le blocage en Europe ?

Au lancement, Siri AI ne sera pas disponible sur iPhone, iPad et Apple Watch dans les pays de l'Union européenne, sur fond de désaccord entre Apple et la Commission européenne. Comme avec Apple Intelligence il y a deux ans, il est possible de contourner le blocage avec un compte App Store américain et un appareil en anglais. Mais la méthode est loin d'être adaptée à un usage du quotidien.

Emmanuel Macron appelle à un sursaut européen pour ne pas être « consommateurs d’une technologie faite par d’autres »

Emmanuel Macron a clôturé une semaine très dense pour la tech française par un discours dédié aux 10 ans de VivaTech. Coupure de Claude Fable en Europe, déploiement de l'Assistant IA dans la fonction publique, nouvel investissement français et appel à développer des alternatives aux États-Unis et à la Chine, notamment en s'appuyant sur l'open source… Le président de la République donne un cahier des charges à quelques mois de son départ.

Arrêtez d’utiliser ChatGPT : OpenAI mise tout sur Codex

En déplacement en France à l'occasion d'une conférence sur ses ambitions européennes, OpenAI a dévoilé plusieurs nouveautés pour Codex, son application initialement pensée pour les développeurs. L'outil se débride dans l'Union européenne et, à terme, devrait intégrer toutes les fonctions de ChatGPT. OpenAI pense qu'à l'ère des IA agentiques, Codex incarne plus l'avenir qu'un simple chatbot.

SpaceX double Amazon en trois séances et devient la 5ᵉ entreprise mondiale

En trois séances de Bourse, SpaceX est devenue la 5e entreprise la plus valorisée au monde. Dès l'ouverture de Wall Street ce mardi, l'entreprise d'Elon Musk a doublé Amazon -- et même TSMC -- pour s'installer juste derrière Microsoft.

« La meilleure défense, c’est l’attaque » : le gouvernement dévoile son plan pour une IA souveraine dans l’État

ENTRETIEN - Le ministre de l’Action et des Comptes publics David Amiel détaille à Numerama sa stratégie systémique pour déployer une IA souveraine au cœur de l'administration française. Plusieurs outils seront généralisés à l'ensemble des agents à partir de ce mardi 16 juin 2026.

C’est quoi Le Chaton Fat, le « modèle » de Mistral AI qui affole les réseaux sociaux ?

Sur X (anciennement Twitter), « Le Chaton Fat » est un des sujets les plus discutés du week-end, en France et à l'international. Ce prétendu nouveau modèle surpuissant de Mistral AI, meilleur que Claude Mythos dans les premiers benchmarks, est en réalité une blague. Certains s'amusent juste du nom, d'autres en profitent pour railler Emmanuel Macron et son discours sur la « relance européenne » de l'IA. Même le patron de Mistral AI se prête au jeu.

OpenAI change les règles de Codex (et c’est à votre avantage)

OpenAI laisse désormais les utilisateurs de Codex mettre de côté leurs réinitialisations de quota pour les utiliser quand ça les arrange. Une petite fonction qui en dit long sur la guerre que se livrent OpenAI et Anthropic à quelques mois (semaines ?) de leurs entrées en Bourse.

Les GAFAM sont morts, vive les MANGOS

Et si les GAFAM avaient déjà leur successeur ? Né sur X le 9 juin 2026, le mème « MANGOS » remplace les géants historiques par Meta, Anthropic, Nvidia, Google, OpenAI et SpaceX. Un acronyme rigolo, mais surtout révélateur d’un basculement de la tech.

  • ✇LEBIGDATA.FR
  • Faux drames et pièges à clics : le fil d’actu de Meta AI part complètement en vrille 
    L’application d’intelligence artificielle de Meta est devenue bizarre. Les utilisateurs ne savent plus à quoi ils ont affaire, un assistant ou une plateforme sociale. C’est la conséquence directe du choix de l’entreprise de rendre publiques certaines conversations et créations générées par l’IA.  Voyez-vous, le fil d’actu de Meta AI serait désormais envahie par des publications étranges générées automatiquement. Les genres de contenus cherchant avant tout à provoquer des réactions, des partag

Faux drames et pièges à clics : le fil d’actu de Meta AI part complètement en vrille 

Par : Ny Ando A.
8 juin 2026 à 16:23

L’application d’intelligence artificielle de Meta est devenue bizarre. Les utilisateurs ne savent plus à quoi ils ont affaire, un assistant ou une plateforme sociale. C’est la conséquence directe du choix de l’entreprise de rendre publiques certaines conversations et créations générées par l’IA. 

Voyez-vous, le fil d’actu de Meta AI serait désormais envahie par des publications étranges générées automatiquement. Les genres de contenus cherchant avant tout à provoquer des réactions, des partages et de l’engagement.

D’après plusieurs rapports, certaines publications reprennent les recettes bien connues du clickbait popularisé sur Facebook. D’autres rendent difficile la distinction entre humour, désinformation et simple spam généré par IA. 

Meta AI : un fil d’actu problématique ?

Pour de nombreux observateurs, cette évolution n’est pas anodine. Elle pourrait encourager les utilisateurs à produire des contenus toujours plus spectaculaires, émotionnels ou manipulateurs afin de gagner en visibilité

Malgré cela, Meta assume pleinement cette orientation. L’entreprise ne présente pas son IA comme un simple assistant destiné à répondre à des questions ou à aider à accomplir des tâches. 

Sa plateforme encourage également le partage de prompts, d’images créées par l’IA et de messages rédigés avec son aide, accessibles à l’ensemble de la communauté. 

Et bon, je dois avouer, cette stratégie peut favoriser l’engagement et multiplier les interactions. Toutefois, elle fait aussi apparaître les mêmes défis de modération que ceux rencontrés depuis des années par les réseaux sociaux traditionnels. 

Selon un article de The Verge, les utilisateurs se plaignent de fausses confidences personnelles, de témoignages fictifs fortement chargés en émotions, d’affirmations médicales contestables ou encore de scénarios inventés particulièrement extravagants.

L’expérience peut ainsi devenir confuse. Comme une partie importante des publications est créée ou assistée par l’IA, il devient parfois difficile d’identifier la nature des contenus.

S’il s’agit d’un témoignage authentique, d’une plaisanterie, d’une expérimentation ou d’une fiction pure et simple. Certains spécialistes craignent que cette situation contribue à affaiblir davantage la confiance en ligne. Surtout à mesure que les contenus générés par IA gagnent en réalisme et en pouvoir de persuasion. 

Cette problématique dépasse d’ailleurs le seul cas de Meta. L’ensemble de l’industrie de l’IA cherche actuellement à accroître l’engagement des utilisateurs. Ce tout en essayant de mettre en place des garde-fous efficaces. 

Or, plus ces outils deviennent interactifs et sociaux, plus les systèmes de modération semblent avoir du mal à suivre le rythme

Cet article Faux drames et pièges à clics : le fil d’actu de Meta AI part complètement en vrille  a été publié sur LEBIGDATA.FR.

Chercher un sac sur ChatGPT, et tomber sur une arnaque : comment les LLM empoisonnées servent de vitrine aux escrocs

Dans un article paru le 7 juin 2026, le quotidien britannique The Guardian décrit comment des escrocs sont parvenus à faire remonter des boutiques clonées dans les réponses de ChatGPT. Une technique qui a exploité à la fois les failles des LLM et la disparition d'une marque emblématique.

❌
❌