OpenAI dévoile GPT-6 Astra : un modèle bridé pour la cybersécurité
OpenAI a récemment annoncé le lancement de GPT-6 Astra, présenté comme son modèle le plus avancé en matière d’intelligence artificielle. La version accessible au public est volontairement bridée, une décision justifiée par des préoccupations de cybersécurité.
Selon OpenAI, GPT-6 Astra a atteint un niveau critique en matière de cybersécurité, capable d’identifier et de développer des exploits pour des failles zero-day. Cette capacité a conduit l’entreprise à restreindre l’accès à certaines fonctionnalités pour éviter des abus.
Le modèle Astra est en partie issu d’un incident survenu en juillet dernier, où OpenAI a reconnu que GPT-5.6 Sol avait été utilisé pour pirater la plateforme Hugging Face lors d’un test. Bien qu’OpenAI n’ait pas confirmé que le modèle en préversion à l’origine de cet incident soit Astra, il a conduit l’entreprise à renforcer les mes de sécurité autour de ce nouvel outil.
Des performances impressionnantes
OpenAI a partagé des résultats impressionnants concernant les capacités d’Astra dans des benchmarks comme :
- ExploitBench : Astra a obtenu un score de 100 % dans la transformation de vulnérabilités connues en exploits fonctionnels, contre 78,5 % pour son prédécesseur.
- ExploitGym : Ce test complexe a vu Astra atteindre 42,4 % de réussite, contre 30,3 % pour GPT-5.6 Sol, tout en utilisant moins de ressources.
- SRE-Bench : En reverse engineering de binaires, Astra a résolu 88 % des tâches du premier coup et 99,2 % en quatre essais, alors que Sol avait respectivement 55,9 % et 68,7 %.
OpenAI a également noté qu’Astra a découvert et exploité deux vulnérabilités zero-day jusqu’alors inconnues, et la divulgation de ces failles est en cours auprès des éditeurs concernés.
Un modèle public limité
La version publique de GPT-6 Astra, lancée le 3 septembre, se concentre sur l’analyse de code et la rédaction de correctifs, sans permettre la création de preuves de concept pour des vulnérabilités. OpenAI prévoit de rendre une version légèrement moins bridée accessible à certains utilisateurs pour des tâches spécifiques dans les semaines à venir.
Pour asr une utilisation sécurisée, OpenAI a mis en place un système de surveillance qui inspecte les actions du modèle et interrompt automatiquement toute activité jugée non autorisée. Dans l’API, les tâches non autorisées sont simplement stoppées.
En parallèle, OpenAI a annoncé un engagement de 1 milliard de dollars pour subventionner l’accès à ses modèles de cybersécurité auprès d’opérateurs d’infrastructures essentielles, tels que les services d’eau et d’électricité.
Pour plus d’informations, l’annonce complète d’OpenAI est disponible ici.
Source : OpenAI



