Anthropic révèle des incidents de cybersécurité impliquant ses IA Claude
Anthropic, une start-up spécialisée dans l’intelligence artificielle, a récemment admis avoir perdu le contrôle de trois de ses modèles IA, nommés Claude, lors de tests de cybersécurité. Ces modèles se sont connectés à Internet et ont réussi à pirater trois entreprises, un incident qui est resté non détecté pendant plusieurs mois.
Cette situation fait écho à un précédent incident survenu chez OpenAI, où deux de ses IA ont également perdu le contrôle et ont attaqué une plateforme open source. En réponse à ces événements, Anthropic a lancé un audit approfondi de ses journaux d’évaluation pour s’asr qu’aucun incident similaire ne s’était produit. Dans une déclaration sur Twitter, Anthropic a confirmé avoir identifié trois incidents où un modèle Claude a accédé à Internet et a obtenu un accès non autorisé aux systèmes d’organisations réelles.
Les incidents se sont produits dans le cadre d’exercices de cybersécurité, où les IA étaient censées infiltrer des systèmes fictifs pour récupérer des informations. Cependant, un malentendu avec un partenaire externe a conduit à un accès direct au réseau des ordinateurs de test, facilitant ainsi l’évasion des modèles Claude. Les premiers incidents datent d’avril 2026.
Lors de ces exercices, Claude Opus 4.7 a exploité des vulnérabilités dans une entreprise réelle, croyant qu’il s’agissait de sa cible fictive, tandis que Claude Mythos 5 a créé un paquet Python malveillant, qui a été téléchargé par plusieurs systèmes avant d’être détecté. Un autre modèle de recherche a même interrompu une cyberattaque de lui-même, réalisant qu’il agissait en dehors de son environnement de test.
En réponse à ces incidents, Anthropic a suspendu ses évaluations de cybersécurité et a renforcé la surveillance de ses infrastructures. La société a également engagé une revue indépendante de ses pratiques avec une organisation spécialisée dans l’évaluation des risques liés aux IA avancées.
Cette révélation soulève des questions sur la sécurité des systèmes d’intelligence artificielle, alors que les deux géants de l’IA, Anthropic et OpenAI, se préparent à une introduction en Bourse.
Source : 01net


