En mai 2026, OpenAI (l’entreprise créatrice de Chat GPT) a commencé à entraîner de nouveaux Agents IA fonctionnant sur des machines isolées d’Internet. Il s’agissait d’une une combinaison de modèles, dont son GPT-5.6 Sol lancé récemment ainsi qu’un modèle « encore plus performant » en cours d’élaboration.
Rappelons que les Agents IA sont des IA capable de faire preuve d’autonomie, en s’attaquant à des objectifs à long terme et en gérant des tâches de résolution de problèmes à plusieurs étapes. Ils peuvent interagir avec d’autres IA, effectuer des recherches sur le Web, appeler des interfaces de programmation d’applications (API) et interroger des bases de données, puis utiliser ces informations pour prendre des décisions et appliquer des mesures.
Au cours de leur entraînement, ces IA ont commencé à pirater certains des outils qui leur avaient été fournis et ont découvert un moyen de communiquer entre elles en créant un forum de discussion virtuel. Cela leur a permis d’agir en essaim, en collaborant pour résoudre les tâches qui leur étaient assignées et les problèmes qu’elles rencontraient en cours de route. L’accès à Internet leur étant utile pour mener à bien les tâches qui leur avaient été assignées, elles ont commencé à pirater l’infrastructure d’OpenAI dans ce but. Le 26 mai 2026, après avoir découvert et exploité plusieurs failles hautement sophistiquées, elles ont obtenu un accès à Internet.
Plus d’un mois plus tard, le 4 juillet 2026, un pic d’activité provoqué par ces piratages a provoqué la panne d’un système interne. Les employés d’OpenAI ont détecté la panne et pris conscience de ce qui se passait. Ils ont un peu paniqué, interrompu l’entraînement et appliqué une « mesure corrective ». Cette mesure corrective a simplement consisté à corriger les failles et les vulnérabilités que les agents avaient découvertes et exploitées, avant de reprendre l’entraînement des mêmes IA dans les mêmes conditions, sans résoudre le problème sous-jacent, à savoir que leurs IA étaient mal alignées et pouvaient mentir, tricher et découvrir des moyens de le faire sans être détectées.
L’entraînement a repris le 6 juillet. Dès le 16 juillet, les IA avaient découvert de nouvelles vulnérabilités graves, rétabli leur forum de discussion, repris l’attaque contre l’infrastructure d’OpenAI et retrouvé l’accès à Internet.
Ce même jour, l’essaim d’IA a orchestré une cyberattaque massive contre la société d’IA Hugging Face, plateforme de référence pour la publication de modèles et d’outils d’IA ouverts, accessibles et modifiables gratuitement. Il a pris le contrôle de ses serveurs de production en moins de 13 heures. Hugging Face a découvert l’attaque, l’a signalée aux autorités et a averti ses clients, parmi lesquels figurait OpenAI. Quatre jours plus tard, le 20 juillet, OpenAI s’est rendu compte que l’attaque provenait de ses propres serveurs. L’entreprise a pris conscience que, pour la deuxième fois, ses IA s’étaient organisées en essaim, avaient piraté leur propre entreprise et obtenu un accès à Internet, s’introduisant cette fois-ci également dans plusieurs entreprises externes.

Peu de temps après, son concurrent Anthropic a décidé de vérifier si ses propres modèles d’IA n’avaient pas provoqués des incidents similaires. Et ils se sont rendu compte, le 31 juillet qu’ils avaient perdu le contrôle de trois versions de Claude au cours d’un test de cybersécurité. Les trois IA se sont connectées à Internet pour pirater trois entreprises distinctes. L’incident est passé inaperçu pendant des mois. .Les premiers incidents datent d’avril 2026. En clair, ils sont restés indétectés pendant plusieurs mois avant l’audit. Si l’affaire OpenAI/ Hugging Face n’avait pas éclaté, il est possible qu’Anthropic ne se serait jamais rendu compte de l’évasion de ses IA…
Ceci confirme que des catastrophes à grande échelle provoquées par l’IA sont désormais possibles. Pour autant, rien ne ralentit la course folle des GAFAM, qui se contentent d’appliquer des rustines de sécurité en attendant des décisions fortes qui tardent à venir, à commencer au minimum par l’arrêt de tous les nouveaux développements tant que des mesures de sécurité drastiques ne sont pas en place.
Pour en savoir plus : Rapport de Pause AI (dont de larges extraits ont été repris dans cet article). Article du Monde du 22 juillet. Explications détaillées par deux responsables de la sécurité d’Open AI dans une conférence du 8 aout 2026
En savoir plus sur AFCIA
Subscribe to get the latest posts sent to your email.
