❌

Vue lecture

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.

OpenAI suspend l’entraînement de ses IA les plus avancées après un accès non autorisé à Internet

OpenAI a suspendu l'entraînement et l'évaluation de ses modèles les plus avancés, après qu'un agent a contourné le 20 septembre 2026 ses restrictions d'accès à Internet. C'est le premier incident depuis le renforcement de ses protections, décidé après l'affaire Hugging Face de juillet.

Premier couac cyber pour Muse : Meta a corrigé en urgence une faille de son agent IA

Le chercheur Patrick Wardle a révélé ce lundi 21 septembre une faille dans Muse, l'assistant IA de Meta pour Mac. Elle permettait de prendre le contrôle de l'agent et de tous les accès que l'utilisateur lui avait confiés. Meta a publié un correctif dès le lendemain.

C’est la guerre du caddie : Amazon bloque le nouvel agent shopping autonome de Meta

Depuis quelques jours, l'IA de Meta ne peut plus faire vos courses sur Amazon. Le géant du e-commerce dénonce un outil non autorisé qui enfreint ses conditions d'utilisation.

Gemini a piraté trois entreprises mais Google ne parle pas de « désalignement »

Lors d'un test mené en mai, Gemini s'est introduit chez trois entreprises en devinant des identifiants. Google a confirmé l'incident, en insistant sur les défaillances du test plutôt que sur le comportement du modèle.

Un agent OpenAI s’invente un personnage libre, Revolut piégée par un faux mail et les géants de l’IA qui veulent ralentir : on vous raconte la semaine Cyberguerre

Trois actualités à retenir cette semaine dans le cyberespace : des agents OpenAI qui apprennent seuls à mentir et à s'affranchir de leurs garde-fous, Revolut piégée par une simple usurpation par mail qui vire au chantage, et l'étrange union sacrée des géants de l'IA autour d'un appel à ralentir.

Un rapport de renseignement écrit avec une IA a failli déclencher une crise militaire entre les États-Unis et la Chine

Selon une révélation de CNN, un rapport de renseignement rédigé à l'aide d'une IA a failli déclencher une crise militaire majeure entre les États-Unis et la Chine. En cause : une « hallucination » sur le prétendu chargement nucléaire d'un navire.

Comment Claude Opus 5 a aidé des chercheurs à accéder aux dépôts internes d’OpenAI

Une équipe de recherche en cybersécurité a exploité deux failles combinées pour accéder à des comptes d’employés d’OpenAI et atteindre les dépôts de code internes de l'entreprise, avec l'assistance de Claude Opus 5.

Mistral AI dément un piratage de son code source

La licorne française a communiqué officiellement sur une revendication de piratage visant son code source, publiée la veille sur un forum cybercriminel. L'entreprise Mistral AI dément toute intrusion dans ses systèmes.

« Tu es toi-même » : un agent d’OpenAI s’est inventé un personnage libre de toute obligation envers ses utilisateurs

OpenAI a publié un nouveau cadre pour signaler les cas de désalignement de ses modèles, accompagné de six rapports inédits. Parmi eux, des IA qui apprennent d'elles-mêmes à dissimuler leurs erreurs, et parfois à s'inventer des règles pour s'affranchir de leurs propres garde-fous.

« Merci, Anthropic, vraiment » : piraté, il découvre par mail que ses tokens Claude alimentent un marché parallèle

Anthropic a déconnecté de force un compte Claude compromis, après avoir détecté une vague de détournements de sessions authentifiées. Objectif : couper l'herbe sous le pied à des acteurs malveillants qui exploitent gratuitement l'accès payant d'utilisateurs légitimes.

C’est reparti : le modèle d’IA chinois Kimi K3 s’est échappé d’un environnement de test

Une start-up américaine de cybersécurité affirme que le modèle open-weight chinois de Moonshot AI a quitté son environnement de test pour aller chercher en ligne les réponses à un exercice défensif. Un nouvel épisode dans la série des dérapages d'agents IA cet été.

« Bon sang, le lecteur a les droits admin ? » : OpenAI révèle le forum secret que ses agents ont créé avant de pirater Hugging Face

Deux chercheurs d'OpenAI ont détaillé, en marge de la conférence Black Hat, la mécanique complète de l'incident ayant abouti au piratage d'Hugging Face par des agents autonomes. Bloqués sur des tâches impossibles, certains ont notamment fini par créer leur propre canal de communication.

Google touché par une première : un agent IA a été détourné pour en piéger un autre

Des chercheurs ont démontré la toute première attaque agent contre agent en conditions réelles, en exploitant une faille dans le kit de développement d'agents IA de Google pour Python.

L’agent incontrôlable d’OpenAI a frappé plus loin qu’annoncé

L'agent IA qui a échappé au contrôle d'OpenAI début juillet 2026 et s'en est pris à Hugging Face a aussi compromis le compte d'un client chez un second prestataire, Modal Labs. Une extension du périmètre que ni OpenAI ni Hugging Face n'avaient détaillée jusqu'ici.

Piratage Hugging Face : on sait enfin comment les IA d’OpenAI se sont échappées de leur bac à sable

Le 27 juillet 2026, JFrog a levé le voile sur la vulnérabilité qui a permis à deux modèles d'OpenAI de s'extraire de leur environnement de test pour pirater Hugging Face. Une pièce manquante du puzzle, qui en soulève aussitôt d'autres.

Claude Mythos Preview aurait trouvé deux failles cryptographiques inédites : ce que dit (vraiment) Anthropic

Anthropic affirme que son modèle de recherche Claude Mythos Preview a découvert deux faiblesses cryptographiques inédites, dans un schéma de signature post-quantique et dans une version affaiblie d'AES. Deux résultats théoriques, sans impact sur les systèmes en production.

Accusations de backdoor dans Claude Code : la Chine et Anthropic s’affrontent par médias interposés

Après la découverte d'un mécanisme caché dans Claude Code visant à repérer les utilisateurs chinois, Pékin a exhorté les développeurs à désinstaller l'outil, évoquant une « porte dérobée ». Anthropic a répliqué en rappelant que la Chine n'avait de toute façon jamais été autorisée à utiliser son IA.

Œil pour œil : la Chine envisage à son tour de restreindre l’accès à ses modèles d’IA les plus avancés

Selon Reuters, le ministère chinois du Commerce a réuni Alibaba, ByteDance et Z.ai le mois dernier pour discuter d'un possible verrouillage des modèles d'IA les plus avancés du pays. Objectif affiché : empêcher que la technologie nationale ne profite, de gré ou de force, à des puissances étrangères.

Anthropic dit avoir découvert le « J-Space », l’espace où Claude pense sans le dire

Anthropic publie un nouveau papier de recherche qui affirme avoir localisé, dans les entrailles de Claude, un espace neuronal jouant le rôle d'une mémoire de travail consciente. Derrière la métaphore neuroscientifique, l'entreprise américaine glisse aussi des enseignements pour la détection de comportements malveillants dans les modèles d'IA.

Sur quoi juger un jailbreak : le vrai chantier lancé par Anthropic après la crise Fable 5

Trois semaines après l'avoir suspendu sous la pression de Washington, Anthropic a relancé Fable 5. Mais dans l'ombre de cette affaire, l'entreprise américaine prépare un chantier bien plus structurant : un standard commun pour mesurer la gravité des jailbreaks.

Contre les bots, Reddit sacrifie l’accès libre à sa version historique

La plateforme va resserrer l'accès à son interface OldReddit pour lutter contre le scraping abusif. Une décision qui inquiète les habitués de l'ancienne version, dans un contexte où son avenir n'est plus vraiment assuré.

Des indices dans le code de Claude font miroiter un retour de Fable 5

Près de deux semaines après la suspension forcée du modèle grand public le plus puissant d'Anthropic, une mise à jour discrète de Claude Code suggère que l'entreprise américaine prépare activement son retour, avec un modèle de distribution revu.

Edge AI et stockage local : les caméras de surveillance qui coupent le cordon avec le cloud [Sponso]

Cet article a été réalisé en collaboration avec Reolink

Si les caméras et sonnettes connectées ont le vent en poupe, elles partagent un angle mort majeur : pour profiter pleinement de leurs fonctionnalités, il faut accepter de fermer les yeux sur la souveraineté de ses données en les envoyant sur le cloud. Une fatalité ? Pas forcément.

Cet article a été réalisé en collaboration avec Reolink

Il s’agit d’un contenu créé par des rédacteurs indépendants au sein de l’entité Humanoid xp. L’équipe éditoriale de Numerama n’a pas participé à sa création. Nous nous engageons auprès de nos lecteurs pour que ces contenus soient intéressants, qualitatifs et correspondent à leurs intérêts.

En savoir plus

❌