Microsoft Livre MAI-Cyber-1-Flash, Atteint 96 % sur CyberGym
- Ce qui s’est passé
- Microsoft launched MAI-Cyber-1-Flash, its first cybersecurity-specialized AI model, and Project Perception, an agentic security platform with red/blue/green team agents that coordinate to find, triage, and fix vulnerabilities.
- Pourquoi c’est important
- At 96% on CyberGym — 12 points above Mythos 5 and 10 points above GPT-5.5-Cyber at roughly half the cost — this is the first credible third entrant in the AI cybersecurity market from the company with the largest security telemetry footprint.
- Que faire
- Security teams should evaluate Project Perception when the public preview opens August 3. Benchmark MAI-Cyber-1-Flash against current Mythos 5 and Daybreak deployments; the multi-model cost architecture may make continuous AI-powered defense economically viable where single-model approaches aren't.
Microsoft vient de devenir le troisième laboratoire frontalier américain à déployer un modèle d'IA dédié à la cybersécurité — et le premier à le livrer au sein d'une plateforme de sécurité agentique. MAI-Cyber-1-Flash, une variante distillée de la famille MAI de Microsoft, a obtenu 96 % sur le benchmark CyberGym, dépassant Mythos 5 de 12 points et GPT-5.5-Cyber de 10 points, pour un coût d'inférence environ deux fois inférieur à celui de ses concurrents.
Le modèle est lancé aux côtés de Project Perception, une plateforme de sécurité agentique qui déploie des agents red, blue et green team coordonnés. Les agents red team sondent les vulnérabilités ; les agents blue team trient et contiennent ; les agents green team génèrent et valident des correctifs. Tous trois opèrent dans la même boucle agentique, partageant mémoire et contexte — transformant un processus humain de plusieurs jours en un flux automatisé et continu.
Project Perception entre en préversion publique le 3 août 2026, intégré directement dans la pile de sécurité Azure de Microsoft. L'architecture tarifaire utilise MAI-Cyber-1-Flash comme moteur d'inférence principal pour l'analyse à haut volume, avec un routage de repli vers des modèles plus grands (MAI-Cyber-1-Pro et GPT-5.5-Cyber) pour le triage complexe et la génération de correctifs. Microsoft affirme que ce routage multi-modèle réduit le coût total de possession de 40 à 60 % par rapport aux déploiements mono-modèle.
C'est important parce que Microsoft ingère déjà 78 billions de signaux de sécurité quotidiens via ses produits Defender et Sentinel — le plus grand jeu de données de télémétrie de sécurité au monde. Former un modèle spécialisé en cybersécurité sur ces données donne à MAI-Cyber-1-Flash un avantage structurel : il a vu plus de schémas d'attaque réels que le modèle de n'importe quel concurrent n'aurait pu être formé.
Pour les équipes de sécurité, le calcul est simple. L'analyse continue des vulnérabilités par IA est techniquement possible depuis plus d'un an — mais l'économie ne suivait pas. Faire tourner GPT-5.5-Cyber ou Mythos 5 sur chaque actif d'une entreprise de taille moyenne coûte entre 50 000 et 200 000 dollars par mois. À la moitié du coût d'inférence, MAI-Cyber-1-Flash change la donne. Pour la première fois, la défense continue par IA devient économiquement viable à l'échelle de l'entreprise — pas seulement pour les entreprises du Fortune 50 aux budgets de sécurité illimités.
La dynamique concurrentielle mérite également d'être surveillée. C'est la première entrée crédible de Microsoft sur le marché de la cybersécurité IA, et cela met immédiatement sous pression Daybreak (la filiale cybersécurité d'Anthropic) et AIP for Defense de Palantir. L'avantage de distribution de Microsoft — Project Perception est livré dans le portail Azure, où 95 % des équipes de sécurité du Fortune 500 opèrent déjà — signifie que le modèle n'a pas besoin de gagner tous les benchmarks pour gagner le marché. Il doit être assez bon, assez économique, et déjà installé.
Un bémol : CyberGym est un benchmark simulé. La performance en conditions réelles sur des environnements de production sera le véritable test, et ces données n'existeront pas avant que la préversion publique du 3 août ne les génère.
Outils et modèles concernés
Ne ratez plus jamais une mise à jour
Le récap hebdomadaire — uniquement les changements de verdict et les actions urgentes. Sans remplissage.