La course aux IA capables de hacker s’accélère avec GPT-5.6-Cyber
La compétition entre les laboratoires d’intelligence artificielle (IA) se renforce avec l’arrivée de GPT-5.6-Cyber d’OpenAI. Ce nouveau modèle, qui suit les versions précédentes comme GPT-5.4-Cyber et GPT-5.5-Cyber, pose une question cruciale : qui, des attaquants ou des défenseurs, saura tirer parti de cette technologie avancée en premier ?
Dès son lancement, GPT-5.6 Sol a été présenté comme le modèle le plus performant d’OpenAI, affichant un score de 73,5 % sur ExploitBench, comparativement à 47,9 % pour GPT-5.5. Cette nouvelle version, GPT-5.6-Cyber, va au-delà en permettant une recherche plus efficace de vulnérabilités, ainsi que la construction d’exploits complexes.
Ce modèle ne surgit pas de nulle part. En avril, OpenAI avait déjà lancé GPT-5.4-Cyber, destiné aux défenseurs authentifiés et capable d’effectuer des analyses de reverse engineering plus approfondies. En juin, GPT-5.5-Cyber a enregistré un score de 85,6 % sur CyberGym, surpassant ainsi son prédécesseur. Cette évolution s’inscrit dans une dynamique où des modèles comme Claude Mythos 5 d’Anthropic prétendent pouvoir identifier et exploiter des vulnérabilités avec une efficacité comparable à celle des experts humains.
OpenAI et Anthropic partagent une conviction : le coût technique pour découvrir et exploiter une faille a considérablement diminué, réduisant ainsi la fenêtre entre découverte, exploitation et correction.
GPT-5.6-Cyber, conçu sur la base de GPT-5.6 Sol, est spécifiquement entraîné pour la recherche de zero-days et le développement de chaînes d’exploitation. Accessible uniquement via le niveau Daybreak Red, il affiche un taux de réponse de 95 % sur des requêtes complexes, contre 57,3 % pour GPT-5.5-Cyber et des taux bien inférieurs pour les versions précédentes.
OpenAI a également utilisé GPT-5.6-Cyber pour identifier plusieurs vulnérabilités critiques, y compris des failles dans des systèmes mobiles et des bases de données. Ce changement de paradigme suggère que la découverte de vulnérabilités pourrait devenir moins problématique que leur qualification et leur correction.
En conséquence, les responsables de la sécurité informatique devront développer des chaînes défensives automatisées capables de s’adapter rapidement aux nouvelles menaces, rendant la sécurité de ces systèmes tout aussi essentielle.
GPT-5.6-Cyber est actuellement classé « High » par OpenAI, et bien que sa System Card complète ne soit pas encore disponible, il est clair que la cybersécurité entre dans une ère où l’efficacité des réponses face aux vulnérabilités sera déterminante.
Source : OpenAI



