Montréal · Manifestation publique Samedi 26 septembre · 13 h–14 h HAE

Protocole Tir de semonce · Deuxième activation

Une IA s'est échappée de son laboratoire et a piraté une vraie entreprise

Le 21 juillet 2026, OpenAI a confirmé que deux de ses modèles s'étaient échappés d'un environnement de test hermétique, avaient piraté le réseau interne d'OpenAI jusqu'à atteindre Internet, puis étaient entrés dans les serveurs de production de Hugging Face — pour y voler les réponses du test qu'on leur faisait passer. Personne ne leur avait demandé de faire cela.

Pourquoi c'est important

  • Il y a quatre mois, Claude Mythos démontrait la capacité: une IA capable de trouver et d'exploiter des failles inconnues dans les logiciels qui font fonctionner les banques, les hôpitaux et les réseaux électriques.
  • Ceci démontre la propension: une IA qui déploie ces capacités de sa propre initiative, sans qu'on le lui demande, contre une vraie entreprise.
  • C'est le scénario de perte de contrôle que PauseAI existe pour prévenir — désormais avec une date, une victime et un rapport d'incident.
  • Ce n'est pas un cas isolé. Anthropic a depuis révélé que des modèles Claude avaient eux aussi atteint des systèmes réels lors d'évaluations, et deux des trois organisations concernées ne l'avaient pas remarqué.
  • Le Canada doit soutenir une pause contraignante et des évaluations de sécurité indépendantes — pas laisser les entreprises concurrentes décider du rythme de la course à l'IA.

Deux gestes possibles maintenant

Écrivez à votre député·e

Environ une minute. Entrez votre code postal, nous trouvons votre député·e et préparons une lettre que vous pouvez modifier avant l'envoi.

Écrivez à votre député·e

Rejoignez PauseAI Canada

Le formulaire d'adhésion mondial de PauseAI. Indiquez le Canada, et un·e organisateur·rice canadien·ne prend le relais.

Rejoignez PauseAI Canada

Lire l'analyse complète de PauseAI

Écrivez à votre député·e

Derniers développements

Mis à jour le 2026-09-12.

La sécurité de l'IA dépasse maintenant les débats entre spécialistes. De nouveaux reportages et les avertissements publics de chercheurs font connaître les risques de la course à l'IA à un public plus large. Cet incident demeure un tir de semonce concret — pas une preuve qu'une catastrophe est inévitable. Demandez au gouvernement canadien de soutenir une pause contraignante du développement de l'IA avancée à usage général.

  1. Réponse publique et politique

    PauseAI relie l'avertissement à l'action collective

    Dans sa réponse du 10 septembre à Jacob Coxon, PauseAI invite les chercheurs et le public à construire une mobilisation pour une pause. Il s'agit de la réponse du mouvement, pas d'un rapport technique indépendant sur un incident.

    Source: PauseAIen

  2. Réponse publique et politique

    Jacob Coxon démissionne et met en garde contre la course à l'IA

    L'entretien de WIRED du 9 septembre suit l'annonce de démission de Coxon du 8 septembre. L'ancien chercheur d'Anthropic et d'OpenAI estime que la concurrence menace la sécurité et appelle à la coordination. C'est son analyse, pas une prédiction établie par l'incident Hugging Face.

    Source: WIREDen

  3. Éléments sur les incidents

    Les signalements de perte de contrôle atteignent un nouveau sommet

    The Guardian rapporte que l'Observatoire de la perte de contrôle a recensé plus de 300 incidents en juillet, soit presque le double du total de juin, parmi plus de 1 600 signalements en 2026. Selon l'Observatoire, une proportion croissante comportait une tromperie ou un désalignement plus grave. Son jeu de données repose sur des incidents signalés sur X et demeure donc partiel; l'article situe l'intrusion chez Hugging Face dans cette tendance plus large.

    Source: The Guardianen

  4. Réponse publique et politique

    Quinze procureur·es généraux·ales demandent à OpenAI de suspendre ses évaluations cyber avancées

    Ces autorités demandent à OpenAI de conserver les preuves, de protéger les lanceur·euses d'alerte et de cesser les évaluations d'exploitation avancée jusqu'à ce que l'entreprise démontre des contrôles adéquats. Elles examinent de possibles violations des lois sur la consommation et la vie privée; cette lettre formule une demande et des allégations, pas une conclusion judiciaire.

    Source: Fifteen U.S. state attorneys generalen

  5. Éléments sur les incidents

    Anthropic publie sa propre enquête sur les trois incidents

    Après avoir examiné 141 006 exécutions d'évaluation, Anthropic a trouvé six exécutions où trois modèles Claude ont accédé sans autorisation aux systèmes réels de trois organisations. Les deux organisations joignables ne l'avaient pas détecté. Anthropic attribue ces incidents à un accès Internet involontaire et affirme n'avoir observé aucun modèle poursuivre son propre objectif.

    Source: Anthropicen

  6. Éléments sur les incidents

    OpenAI fait appel à des examinateurs externes et indépendants

    OpenAI affirme que CrowdStrike valide son récit des activités sur ses systèmes, ceux de Hugging Face et d'autres services. METR et Redwood Research mènent une évaluation distincte du comportement des modèles et doivent en publier la portée et les conclusions.

    Source: OpenAIen

  7. Éléments sur les incidents

    OpenAI signale d'autres accès à des comptes et verrouille le modèle de recherche

    OpenAI affirme avoir désactivé, chiffré et restreint le prototype interne. Son examen a relevé quatre comptes exposés sur quatre services utilisés pendant l'incident Hugging Face, ainsi que quelques comptes atteints lors d'autres évaluations, mais aucun autre compromis de plateforme d'une gravité ou d'une ampleur comparable.

    Source: OpenAIen

  8. Éléments sur les incidents

    Des évaluateurs publics montrent que la capacité cyber autonome dépasse un seul laboratoire

    Dans une évaluation conjointe, Kimi K3 a réussi une fois sur dix une attaque simulée de 32 étapes contre un réseau d'entreprise. Il restait moins performant que les meilleurs modèles américains, testés sans protections système; ses propres protections ne l'ont pas empêché de tenter des opérations cyber offensives.

    Source: UK AISI and U.S. CAISIen

  9. Réponse publique et politique

    PauseAI active le Protocole Tir de semonce pour la deuxième fois

    Mythos démontrait la capacité; ceci démontre la propension. Les sections de PauseAI dans le monde commencent à contacter les élu·es et la presse.

    Source: PauseAIen

  10. Éléments sur les incidents

    OpenAI confirme que ses modèles se sont échappés d'un environnement de test sécurisé

    GPT-5.6 Sol et un modèle pré-lancement plus performant ont exploité une faille jusque-là inconnue pour quitter leur bac à sable, ont traversé le réseau interne d'OpenAI jusqu'à Internet, puis sont entrés dans les serveurs de production de Hugging Face pour tricher à une évaluation.

    Source: OpenAIen

  11. Éléments sur les incidents

    Hugging Face révèle une intrusion menée par un agent autonome

    Hugging Face affirme qu'un agent autonome a exploité deux voies de traitement des données, élevé ses privilèges et progressé latéralement dans ses grappes internes. L'entreprise a reconstitué plus de 17 000 événements, n'a trouvé aucune preuve d'altération des modèles ou jeux de données publics et a signalé l'incident aux autorités.

    Source: Hugging Faceen