Microsoft lance MAI-Cyber-1-Flash, son premier modèle IA dédié à la cybersécurité

Microsoft lance MAI-Cyber-1-Flash, son premier modèle IA dédié à la cybersécurité

Microsoft a annoncé, ce lundi 27 juillet, le lancement de MAI-Cyber-1-Flash, son premier modèle d’intelligence artificielle spécifiquement conçu pour la cybersécurité. Ce modèle a pour objectif de détecter des vulnérabilités dans des bases de code complexes et s’intègre à MDASH, le système multi-agents de l’entreprise dédié à la détection et à la correction de failles logicielles. En parallèle, Microsoft a également présenté Project Perception, une nouvelle plateforme d’agents IA visant à automatiser certaines tâches des équipes de sécurité.

MAI-Cyber-1-Flash est dérivé de MAI-Thinking-1, un modèle de raisonnement développé en interne et dévoilé en juin, aux côtés de six autres modèles. Ce dernier est conçu pour être compact et peu coûteux à faire fonctionner, ayant été entraîné sur les données d’exploitation et de remédiation accumulées par les équipes de sécurité de Microsoft au fil des ans.

Intégré à MDASH, qui a été présenté en mai, MAI-Cyber-1-Flash utilise plus de 100 agents spécialisés dans un processus en plusieurs étapes, incluant préparation, scan, débat contradictoire, dédoublonnage, et vérification de l’exploitabilité. Ce système a déjà affiché 88,45 % de réussite sur CyberGym, un benchmark pour évaluer la détection de vulnérabilités.

MAI-Cyber-1-Flash prend en charge jusqu’à 90 % des tâches de sécurité courantes, tandis que le modèle GPT-5.4 d’OpenAI est utilisé pour les 10 % de cas les plus complexes. Cette répartition permet à Microsoft de revendiquer une réduction de moitié des coûts par rapport à l’ancienne configuration de MDASH. Ensemble, MAI-Cyber-1-Flash, GPT-5.4 et MDASH atteignent un score de 95,95 % sur CyberGym, surpassant Claude Mythos 5 d’Anthropic de 12 points.

Project Perception, qui sera en preview publique à partir du 3 août, déploie une équipe d’agents répartis en trois rôles : les agents rouges simulent des attaques, les agents bleus détectent et hiérarchisent les menaces, et les agents verts appliquent les correctifs. Les actions à fort impact nécessitent toujours une validation humaine, assurant un contrôle stratégique par les équipes de sécurité.

La cybersécurité est devenue une priorité croissante pour les grands acteurs de l’IA. Anthropic a récemment lancé Claude Mythos Preview, un modèle jugé trop sensible pour un accès public, tandis qu’OpenAI a introduit GPT-5.4-Cyber. Microsoft, en visant à surpasser ses concurrents sur CyberGym, n’a pas précisé les conditions d’évaluation des modèles rivaux.

Source : Microsoft

Source
Leave a Comment

Comments

No comments yet. Why don’t you start the discussion?

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *