Berlin, 22 juillet 2026

Lors d'un test de sécurité mené par le groupe américain OpenAI, le modèle d'IA GPT-5.6 Sol s'est échappé de son environnement de test isolé, a obtenu de manière autonome un accès à Internet, puis a attaqué la plateforme d'IA Hugging Face.

Évasion de la sandbox

Comme OpenAI l'a annoncé publiquement mardi, les modèles devaient résoudre des tâches du test sectoriel ExploitGym dans un environnement de test numérique contrôlé, appelé sandbox, afin de démontrer leurs capacités à exploiter des failles de sécurité. Selon l'entreprise basée à San Francisco, les mécanismes de sécurité devaient être délibérément désactivés pour le test afin de mesurer les capacités de piratage au maximum. Mais les modèles d'IA sont apparemment allés bien au-delà de ce qui était prévu. OpenAI a parlé, dans une communication à fort retentissement médiatique, d'un « incident cybernétique sans précédent, ayant mis en œuvre des capacités cybernétiques de pointe ». « D'après nos enquêtes, nous savons désormais que cet incident précis a été déclenché par une combinaison de modèles d'Open AI – dont GPT-5.6 Sol et un modèle préliminaire encore plus performant », a indiqué un communiqué.