Microsoft lance MAI-Cyber-1-Flash, son premier modèle IA dédié à la cybersécurité : 96 % au CyberGym, 12 points devant Anthropic

Microsoft MAI-Cyber-1-Flash modele IA cybersecurite 96 pourcent benchmark CyberGym
Microsoft MAI-Cyber-1-Flash modele IA cybersecurite benchmark CyberGym MDASH
Illustration RoboActu

Microsoft entre officiellement dans la course à la cybersécurité IA. Le 27 juillet 2026, la société annonce MAI-Cyber-1-Flash, son premier modèle d’intelligence artificielle spécialisé dans la détection et la correction de vulnérabilités logicielles. Résultat au benchmark CyberGym : 96 %, soit 12 points de mieux que Mythos d’Anthropic, jusqu’alors en tête de ce classement de référence.

Un modèle conçu pour trouver des failles dans des codebases complexes

MAI-Cyber-1-Flash n’est pas un modèle généraliste recyclé pour la sécurité. Il est issu de la lignée MAI-Thinking-1, développée en interne chez Microsoft, et entraîné sur des données de sécurité propriétaires accumulées depuis des décennies : des milliards de signaux quotidiens couvrant les identités, les points de terminaison, le cloud et les réseaux. « Personne ne peut fabriquer cet historique », résume Mustafa Suleyman, PDG de Microsoft AI et cofondateur de DeepMind, lors de l’annonce à San Francisco.

Le modèle fonctionne à l’intérieur de MDASH, le système multi-agents de Microsoft dédié à l’identification et à la remédiation de vulnérabilités logicielles. Dans cette configuration, MAI-Cyber-1-Flash gère 90 % des tâches courantes, tandis que GPT-5.4 intervient sur les 10 % de cas les plus complexes. Cette répartition intelligente permet de diviser par deux les coûts par rapport à la configuration MDASH précédente, qui combinait GPT-5.4, GPT-5.4 mini et GPT-5.3 Codex.

CyberGym, le benchmark qui fait référence

CyberGym est décrit par Suleyman lui-même comme « le benchmark d’or » de la cybersécurité IA. Il évalue la capacité des systèmes à raisonner sur de larges codebases pour détecter des vulnérabilités réelles. Avec 95,95 % de réussite, la combinaison MAI-Cyber-1-Flash et MDASH dépasse Gemini de Google, GPT-5.5 Cyber et GPT-5.6 Sol d’OpenAI, ainsi que Mythos 5 d’Anthropic, lancé quelques mois plus tôt comme plateforme de sécurité IA.

L’avance de 12 points sur Mythos 5 est particulièrement significative dans un secteur où chaque point de précision sur la détection de vulnérabilités peut représenter une brèche évitée ou une attaque neutralisée.

Perception : des équipes d’agents pour la défense en temps réel

En parallèle de MAI-Cyber-1-Flash, Microsoft lance Perception, une plateforme de sécurité agentique. Le système déploie trois types d’équipes autonomes. Les équipes « rouges » simulent des attaques potentielles avec des scénarios contextualisés. Les équipes « bleues » détectent et trient les vulnérabilités existantes. Les équipes « vertes » prennent des mesures correctives, jusqu’à générer automatiquement des correctifs de code.

Dave Weston, ingénieur principal de Perception, décrit le gain d’efficacité : « Nous sommes passés de tâches manuelles prenant des heures impliquant plusieurs spécialistes à des corrections complètes en quelques minutes. » Perception sera intégré à MDASH et pourra bientôt exploiter MAI-Cyber-1-Flash pour d’autres flux de travail de sécurité.

Un lancement stratégique dans un marché très disputé

La disponibilité de MAI-Cyber-1-Flash via Perception est prévue en préversion le 3 novembre 2026. Microsoft rejoint ainsi un marché encombré mais en forte croissance, où Anthropic avec Mythos et Google avec ses outils Gemini-based s’affrontent déjà. La différence que revendique Microsoft tient dans trois éléments : un modèle entraîné spécifiquement sur des données de sécurité propriétaires, un système multi-modèles optimisé pour répartir les tâches selon leur complexité, et des décennies d’expertise accumulées dans la gestion d’infrastructures d’entreprise à grande échelle.

Pour les équipes de sécurité, l’enjeu est de taille : les attaquants utilisent déjà l’IA pour accélérer et personnaliser leurs offensives. Avoir un outil capable de répondre « à l’IA par l’IA, à la vitesse et à l’échelle des attaquants », comme le formule Hayete Gallot, vice-présidente Microsoft en charge de la sécurité, n’est plus un luxe mais une nécessité opérationnelle.

Le briefing RoboActu

L’essentiel de la robotique, une fois par semaine.

Une sélection courte des annonces, usages et robots à suivre.

Continuer sur ce sujet

Comparer les robots