San Francisco, 08 août 2026

L'entreprise américaine OpenAI limite partiellement la publication de nouveaux modèles d'IA lorsque, selon sa propre politique de sécurité, ils sont capables d'identifier de manière autonome des vulnérabilités zero-day ou de mener des cyberattaques complexes contre des cibles hautement sécurisées.

Cette disposition fait partie des directives internes de sécurité qu'OpenAI applique à ses familles de modèles. Selon ces règles, un modèle est classé comme critique dès lors qu'il peut trouver et exploiter de manière autonome des vulnérabilités graves dans des logiciels, ou mener des attaques coordonnées contre des infrastructures bien protégées. Dans ce cas, l'entreprise entend ne plus publier certaines versions de manière complète, ou seulement sous une forme restreinte.