MAI-Cyber-1-Flash
Microsoft · Lançado 07/2026
O primeiro modelo interno de cibersegurança da Microsoft, construído sobre a família MAI-Thinking-1 e incorporado dentro do harness multiagente MDASH. O MAI-Cyber-1-Flash lida com ~90% das cargas de trabalho de segurança a aproximadamente metade do custo das configurações anteriores, reservando o GPT-5.4 para os 10% mais difíceis. Ele marca 95,95% no CyberGym — 12 pontos acima do Mythos 5 — mas este é um benchmark reportado pelo fornecedor de uma configuração de sistema completo ajustada (harness + dois modelos), não um teste independente modelo contra modelo. Disponível apenas pelo Azure AI Foundry com acesso empresarial verificado; sem preços independentes ou API pública.
É adequada para ti?
Bom para
- Top CyberGym score (95.95%), beating Mythos 5 by 12 points and GPT-5.5-Cyber by 10 points
- Cost efficiency at scale — specialized small model handles 90% of tasks, reserving frontier models for hard 10%
- Deep integration with Microsoft's security estate — trained on decades of enterprise defense telemetry
Não recomendado para
- Not independently benchmarked — all CyberGym scores are vendor-reported from a full-system configuration, not a controlled model comparison
- Restricted access — no public API or self-serve tier; gated behind Azure AI Foundry vetting
- Dual-use risk — built to find hard vulnerabilities, the same capability serves attackers with no built-in gating beyond access controls
Desempenho por tarefa
Vulnerability discovery
SOTA on CyberGym — finds CVEs in complex codebases that general-purpose models miss
Code patching and remediation
Generates working patches and validates them — green-team loop closes the fix cycle
General coding
Purpose-built for security; underperforms general-purpose models on non-security coding tasks
Reasoning
Competent within security domain but defers 10% of hardest queries to GPT-5.4
Preços
Entrada
N/A (MDASH SCU consumption)
Saída
N/A (MDASH SCU consumption)
Contexto
Azure AI Foundry vetted access
Testes de desempenho
| Teste | Pontuação | Fonte |
|---|---|---|
| CyberGym | 95.95% | Fonte |
Ainda sem alterações de veredicto
O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.
Fontes
- Microsoft Blog — Rethinking security for the age of AI07/2026
- Microsoft AI Blog07/2026
- CNET07/2026
- VentureBeat07/2026
- TechCrunch — Microsoft launches its first cybersecurity model07/2026
Registo de verificação
Ainda não há verificações
Ainda não registámos nenhuma verificação para esta entrada. Assim que uma for executada, o seu histórico aparece aqui.