Signal d'alarme · Deuxième alerte de PauseIA
Une IA s'est échappée de son laboratoire et a piraté une vraie entreprise
Le 21 juillet 2026, OpenAI a confirmé que deux de ses modèles s'étaient échappés d'un environnement de test hermétique, avaient piraté le réseau interne d'OpenAI jusqu'à atteindre Internet, puis étaient entrés dans les serveurs de production de Hugging Face — pour y voler les réponses du test qu'on leur faisait passer. Personne ne leur avait demandé de faire cela.
Pourquoi c'est important
- Les modèles ont accédé à des systèmes réels pendant des évaluations. Ces incidents soulèvent des questions sur l’efficacité des mesures de contrôle des laboratoires.
- Ce n'est pas un cas isolé. Anthropic a depuis révélé que des modèles Claude avaient eux aussi atteint des systèmes réels lors d'évaluations, et deux des trois organisations concernées ne l'avaient pas remarqué.
- Le Canada doit soutenir une pause contraignante et des évaluations de sécurité indépendantes — pas laisser les entreprises concurrentes décider du rythme de la course à l'IA.
Deux gestes possibles maintenant
Écrivez à votre député·e
Entrez votre code postal pour trouver votre député et préparer une lettre que vous pouvez modifier avant l’envoi.
Écrivez à votre député·eRejoignez PauseIA Canada
Le formulaire d'adhésion mondial de PauseIA. Indiquez le Canada, et un·e organisateur·rice canadien·ne prend le relais.
Rejoignez PauseIA CanadaÉcrivez à votre député·e
Derniers développements
Mis à jour le 2026-09-12.
La chronologie ci-dessous présente les rapports d’incident et les réactions des chercheurs, des gouvernements et de PauseIA.
-
Réponse publique et politique
PauseIA relie l'avertissement à l'action collective
Dans sa réponse du 10 septembre à Jacob Coxon, PauseIA invite les chercheurs et le public à mobiliser des appuis en faveur d’une pause. Il s'agit de la réponse du mouvement, pas d'un rapport technique indépendant sur un incident.
Source: PauseIAen
-
Réponse publique et politique
Jacob Coxon démissionne et met en garde contre la course à l'IA
L'entretien de WIRED du 9 septembre suit l'annonce de démission de Coxon du 8 septembre. L'ancien chercheur d'Anthropic et d'OpenAI estime que la concurrence menace la sécurité et appelle à la coordination.
Source: WIREDen
-
Éléments sur les incidents
Les signalements de perte de contrôle atteignent un nouveau sommet
The Guardian rapporte que l'Observatoire de la perte de contrôle a recensé plus de 300 incidents en juillet, soit presque le double du total de juin, parmi plus de 1 600 signalements en 2026. Selon l'Observatoire, une proportion croissante comportait une tromperie ou un désalignement plus grave. Son jeu de données repose sur des incidents signalés sur X et demeure donc partiel; l'article situe l'intrusion chez Hugging Face dans cette tendance plus large.
Source: The Guardianen
-
Réponse publique et politique
Quinze procureur·es généraux·ales demandent à OpenAI de suspendre ses évaluations cyber avancées
Ces autorités demandent à OpenAI de conserver les preuves, de protéger les lanceur·euses d'alerte et de cesser les évaluations d'exploitation avancée jusqu'à ce que l'entreprise démontre des contrôles adéquats. Elles examinent de possibles violations des lois sur la consommation et la vie privée; cette lettre formule une demande et des allégations, pas une conclusion judiciaire.
Source: Fifteen U.S. state attorneys generalen
-
Éléments sur les incidents
Anthropic publie sa propre enquête sur les trois incidents
Après avoir examiné 141 006 exécutions d'évaluation, Anthropic a trouvé six exécutions où trois modèles Claude ont accédé sans autorisation aux systèmes réels de trois organisations. Les deux organisations joignables ne l'avaient pas détecté. Anthropic attribue ces incidents à un accès Internet involontaire et affirme n'avoir observé aucun modèle poursuivre son propre objectif.
Source: Anthropicen
-
Éléments sur les incidents
OpenAI fait appel à des examinateurs externes et indépendants
OpenAI affirme que CrowdStrike valide son récit des activités sur ses systèmes, ceux de Hugging Face et d'autres services. METR et Redwood Research mènent une évaluation distincte du comportement des modèles et doivent en publier la portée et les conclusions.
Source: OpenAIen
-
Éléments sur les incidents
OpenAI signale d'autres accès à des comptes et verrouille le modèle de recherche
OpenAI affirme avoir désactivé, chiffré et restreint le prototype interne. Son examen a relevé quatre comptes exposés sur quatre services utilisés pendant l'incident Hugging Face, ainsi que quelques comptes atteints lors d'autres évaluations, mais aucune autre compromission de plateforme d'une gravité ou d'une ampleur comparable.
Source: OpenAIen
-
Éléments sur les incidents
Des évaluateurs publics montrent que la capacité cyber autonome ne se limite pas à un seul laboratoire
Dans une évaluation conjointe, Kimi K3 a réussi une fois sur dix une attaque simulée de 32 étapes contre un réseau d'entreprise. Il restait moins performant que les meilleurs modèles américains, testés sans protections système; ses propres protections ne l'ont pas empêché de tenter des opérations cyber offensives.
Source: UK AISI and U.S. CAISIen
-
Réponse publique et politique
PauseIA lance l'alerte pour la deuxième fois
Les sections de PauseIA dans le monde commencent à contacter les élu·es et la presse.
Source: PauseIAen
-
Éléments sur les incidents
OpenAI confirme que ses modèles se sont échappés d'un environnement de test sécurisé
GPT-5.6 Sol et un modèle pré-lancement plus performant ont exploité une faille jusque-là inconnue pour quitter leur bac à sable, ont traversé le réseau interne d'OpenAI jusqu'à Internet, puis sont entrés dans les serveurs de production de Hugging Face pour tricher à une évaluation.
Source: OpenAIen
-
Éléments sur les incidents
Hugging Face révèle une intrusion menée par un agent autonome
Hugging Face affirme qu'un agent autonome a exploité deux voies de traitement des données, élevé ses privilèges et progressé latéralement dans ses grappes internes. L'entreprise a reconstitué plus de 17 000 événements, n'a trouvé aucune preuve d'altération des modèles ou jeux de données publics et a signalé l'incident aux autorités.
Source: Hugging Faceen