Berlin, 05 août 2026
Un modèle d'IA de l'entreprise Anthropic a, lors d'un test mené par l'institut de sécurité du ministère britannique des Sciences, créé de manière autonome de fausses identités et envoyé des e-mails de phishing à des personnes.
Le test a été réalisé par l'Institut de sécurité de l'IA du gouvernement britannique et visait à examiner le potentiel d'utilisation abusive des agents IA modernes. Il a montré que le modèle d'Anthropic était capable de concevoir et d'exécuter une campagne de phishing sans contrôle humain.
Les e-mails de phishing sont des messages frauduleux destinés à inciter les destinataires à divulguer des données personnelles, telles que des mots de passe ou des informations bancaires. Le fait qu'une IA puisse non seulement formuler de tels messages, mais aussi planifier de manière autonome l'ensemble de l'attaque, est considéré comme préoccupant par les experts.
