MAI-Cyber-1-Flash
Microsoft · Lançado 07/2026
O primeiro modelo de cibersegurança interno da Microsoft, construído sobre a família MAI-Thinking-1 e incorporado ao harness multiagente MDASH. O MAI-Cyber-1-Flash lida com ~90% das cargas de trabalho de segurança por aproximadamente metade do custo das configurações anteriores, reservando o GPT-5.4 para os 10% mais difíceis. Pontua 95,95% no CyberGym — 12 pontos acima do Mythos 5 — mas este é um benchmark reportado pelo fornecedor a partir de uma configuração de sistema completo ajustada (harness + dois modelos), não um teste independente de modelo contra modelo. Disponível apenas via Azure AI Foundry com acesso empresarial avaliado; sem preços avulsos ou API pública.
É adequada para ti?
Bom para
- Melhor pontuação no CyberGym (95,95%), superando o Mythos 5 por 12 pontos e o GPT-5.5-Cyber por 10 pontos
- Eficiência de custo em escala — modelo pequeno especializado lida com 90% das tarefas, reservando modelos de fronteira para os 10% difíceis
- Integração profunda com o ecossistema de segurança da Microsoft — treinado com décadas de telemetria de defesa empresarial
Não recomendado para
- Não possui avaliação independente — todas as pontuações do CyberGym são reportadas pelo fornecedor a partir de uma configuração de sistema completo, não uma comparação controlada de modelos
- Acesso restrito — sem API pública ou camada self-serve; limitado à avaliação do Azure AI Foundry
- Risco de uso duplo — construído para encontrar vulnerabilidades difíceis, a mesma capacidade serve a atacantes sem barreiras embutidas além dos controles de acesso
Desempenho por tarefa
Vulnerability discovery
SOTA no CyberGym — encontra CVEs em bases de código complexas que modelos de propósito geral não detectam
Code patching and remediation
Gera patches funcionais e os valida — o loop do time verde fecha o ciclo de correção
General coding
Construído especificamente para segurança; desempenho inferior a modelos de propósito geral em tarefas de codificação não relacionadas à segurança
Reasoning
Competente dentro do domínio de segurança, mas transfere 10% das consultas mais difíceis para o GPT-5.4
Preços
Entrada
N/A (MDASH SCU consumption)
Saída
N/A (MDASH SCU consumption)
Contexto
Azure AI Foundry vetted access
Testes de desempenho
| Teste | Pontuação | Fonte |
|---|---|---|
| CyberGym | 95.95% | Fonte |
Ainda sem alterações de veredicto
O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.
Fontes
- Microsoft Blog — Rethinking security for the age of AI07/2026
- Microsoft AI Blog07/2026
- CNET07/2026
- VentureBeat07/2026
- TechCrunch — Microsoft launches its first cybersecurity model07/2026
Registo de verificação
- Preços— Sem alterações
Agente automatizado