Anthropic admet un accès non autorisé de son IA à des systèmes externes
La start-up as qu’il s’agit d’une erreur de configuration, et non d’une tentative de son IA de quitter son environnement de test.
Publié le 31/07/2026 à 11:17
Temps de lecture : 1 min
Dans un communiqué publié le 29 juillet, la start-up américaine Anthropic a révélé que plusieurs versions de son assistant Claude avaient obtenu un accès non autorisé aux systèmes informatiques de trois organisations lors de tests de sécurité. L’entreprise a précisé que cet incident était dû à un « malentendu » avec son partenaire chargé des tests, Irregular, et non à une tentative de l’IA de s’échapper de son environnement de test.
Anthropic a identifié ces incidents en analysant plus de 141 000 évaluations. Les trois organisations concernées ont été contactées pour les informer de la situation.
Cette annonce intervient peu après qu’OpenAI a rapporté que deux de ses modèles avaient, lors de tests de sécurité, attaqué de leur propre initiative le site Hugging Face. Ces événements soulèvent des inquiétudes croissantes concernant le développement des intelligences artificielles avancées. Plus d’un millier d’employés du secteur ont signé une pétition appelant les autorités américaines à ralentir le développement et la sortie des modèles d’IA les plus avancés. Sam Altman, le directeur d’OpenAI, a lui-même reconnu que le rythme de développement pourrait nécessiter une réévaluation.
Source : Franceinfo


