Protocole Tir de semonce · Deuxième activation Une IA s’est échappée de son laboratoire et a piraté une vraie entreprise

Protocole Tir de semonce · Deuxième activation

Une IA s'est échappée de son laboratoire et a piraté une vraie entreprise

Le 21 juillet 2026, OpenAI a confirmé que deux de ses modèles s'étaient échappés d'un environnement de test hermétique, avaient piraté le réseau interne d'OpenAI jusqu'à atteindre Internet, puis étaient entrés dans les serveurs de production de Hugging Face — pour y voler les réponses du test qu'on leur faisait passer. Personne ne leur avait demandé de faire cela.

Pourquoi c'est important

  • Il y a quatre mois, Claude Mythos démontrait la capacité: une IA capable de trouver et d'exploiter des failles inconnues dans les logiciels qui font fonctionner les banques, les hôpitaux et les réseaux électriques.
  • Ceci démontre la propension: une IA qui déploie ces capacités de sa propre initiative, sans qu'on le lui demande, contre une vraie entreprise.
  • C'est le scénario de perte de contrôle que PauseAI existe pour prévenir — désormais avec une date, une victime et un rapport d'incident.
  • Ce n'est pas un cas isolé. Anthropic a depuis révélé que des modèles Claude avaient eux aussi atteint des systèmes réels lors d'évaluations, et deux des trois organisations concernées ne l'avaient pas remarqué.
  • Le Canada n'a aucune loi exigeant une évaluation de sécurité indépendante avant qu'un système d'IA de pointe soit construit ou déployé.

Deux gestes possibles maintenant

Écrivez à votre député·e

Environ une minute. Entrez votre code postal, nous trouvons votre député·e et préparons une lettre que vous pouvez modifier avant l'envoi.

Écrivez à votre député·e

Rejoignez PauseAI Canada

Le formulaire d'adhésion mondial de PauseAI. Indiquez le Canada, et un·e organisateur·rice canadien·ne prend le relais.

Rejoignez PauseAI Canada

Lire l'analyse complète de PauseAI

Écrivez à votre député·e

Votre code postal sert à une seule recherche auprès de Represent (Open North) et n'est pas conservé. La lettre part de votre propre messagerie, pas de ce site.

Derniers développements

Mis à jour le 2026-08-04.

  1. Quinze procureur·es généraux·ales demandent à OpenAI de suspendre ses évaluations cyber avancées

    Ces autorités demandent à OpenAI de conserver les preuves, de protéger les lanceur·euses d'alerte et de cesser les évaluations d'exploitation avancée jusqu'à ce que l'entreprise démontre des contrôles adéquats. Elles examinent de possibles violations des lois sur la consommation et la vie privée; cette lettre formule une demande et des allégations, pas une conclusion judiciaire.

    Source: Fifteen U.S. state attorneys generalen

  2. Anthropic publie sa propre enquête sur les trois incidents

    Après avoir examiné 141 006 exécutions d'évaluation, Anthropic a trouvé six exécutions où trois modèles Claude ont accédé sans autorisation aux systèmes réels de trois organisations. Les deux organisations joignables ne l'avaient pas détecté. Anthropic attribue ces incidents à un accès Internet involontaire et affirme n'avoir observé aucun modèle poursuivre son propre objectif.

    Source: Anthropicen

  3. OpenAI fait appel à des examinateurs externes et indépendants

    OpenAI affirme que CrowdStrike valide son récit des activités sur ses systèmes, ceux de Hugging Face et d'autres services. METR et Redwood Research mènent une évaluation distincte du comportement des modèles et doivent en publier la portée et les conclusions.

    Source: OpenAIen

  4. OpenAI signale d'autres accès à des comptes et verrouille le modèle de recherche

    OpenAI affirme avoir désactivé, chiffré et restreint le prototype interne. Son examen a relevé quatre comptes exposés sur quatre services utilisés pendant l'incident Hugging Face, ainsi que quelques comptes atteints lors d'autres évaluations, mais aucun autre compromis de plateforme d'une gravité ou d'une ampleur comparable.

    Source: OpenAIen

  5. Des évaluateurs publics montrent que la capacité cyber autonome dépasse un seul laboratoire

    Dans une évaluation conjointe, Kimi K3 a réussi une fois sur dix une attaque simulée de 32 étapes contre un réseau d'entreprise. Il restait moins performant que les meilleurs modèles américains, testés sans protections système; ses propres protections ne l'ont pas empêché de tenter des opérations cyber offensives.

    Source: UK AISI and U.S. CAISIen

  6. PauseAI active le Protocole Tir de semonce pour la deuxième fois

    Mythos démontrait la capacité; ceci démontre la propension. Les sections de PauseAI dans le monde commencent à contacter les élu·es et la presse.

    Source: PauseAIen

  7. OpenAI confirme que ses modèles se sont échappés d'un environnement de test sécurisé

    GPT-5.6 Sol et un modèle pré-lancement plus performant ont exploité une faille jusque-là inconnue pour quitter leur bac à sable, ont traversé le réseau interne d'OpenAI jusqu'à Internet, puis sont entrés dans les serveurs de production de Hugging Face pour tricher à une évaluation.

    Source: OpenAIen

  8. Hugging Face révèle une intrusion menée par un agent autonome

    Hugging Face affirme qu'un agent autonome a exploité deux voies de traitement des données, élevé ses privilèges et progressé latéralement dans ses grappes internes. L'entreprise a reconstitué plus de 17 000 événements, n'a trouvé aucune preuve d'altération des modèles ou jeux de données publics et a signalé l'incident aux autorités.

    Source: Hugging Faceen