MAI-Cyber-1-Flash logo

MAI-Cyber-1-Flash

Microsoft · Lançado 07/2026

Condicional

O primeiro modelo de cibersegurança interno da Microsoft, construído sobre a família MAI-Thinking-1 e incorporado ao harness multiagente MDASH. O MAI-Cyber-1-Flash lida com ~90% das cargas de trabalho de segurança por aproximadamente metade do custo das configurações anteriores, reservando o GPT-5.4 para os 10% mais difíceis. Pontua 95,95% no CyberGym — 12 pontos acima do Mythos 5 — mas este é um benchmark reportado pelo fornecedor a partir de uma configuração de sistema completo ajustada (harness + dois modelos), não um teste independente de modelo contra modelo. Disponível apenas via Azure AI Foundry com acesso empresarial avaliado; sem preços avulsos ou API pública.

É adequada para ti?

Bom para

  • Melhor pontuação no CyberGym (95,95%), superando o Mythos 5 por 12 pontos e o GPT-5.5-Cyber por 10 pontos
  • Eficiência de custo em escala — modelo pequeno especializado lida com 90% das tarefas, reservando modelos de fronteira para os 10% difíceis
  • Integração profunda com o ecossistema de segurança da Microsoft — treinado com décadas de telemetria de defesa empresarial

Não recomendado para

  • Não possui avaliação independente — todas as pontuações do CyberGym são reportadas pelo fornecedor a partir de uma configuração de sistema completo, não uma comparação controlada de modelos
  • Acesso restrito — sem API pública ou camada self-serve; limitado à avaliação do Azure AI Foundry
  • Risco de uso duplo — construído para encontrar vulnerabilidades difíceis, a mesma capacidade serve a atacantes sem barreiras embutidas além dos controles de acesso

Desempenho por tarefa

Vulnerability discovery

Excellent

SOTA no CyberGym — encontra CVEs em bases de código complexas que modelos de propósito geral não detectam

Code patching and remediation

Very Good

Gera patches funcionais e os valida — o loop do time verde fecha o ciclo de correção

General coding

Fair

Construído especificamente para segurança; desempenho inferior a modelos de propósito geral em tarefas de codificação não relacionadas à segurança

Reasoning

Good

Competente dentro do domínio de segurança, mas transfere 10% das consultas mais difíceis para o GPT-5.4

Preços

Entrada

N/A (MDASH SCU consumption)

Saída

N/A (MDASH SCU consumption)

Contexto

Azure AI Foundry vetted access

Ver preços completos

Testes de desempenho

TestePontuaçãoFonte
CyberGym95.95% Fonte

Ainda sem alterações de veredicto

O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.

Registo de verificação

  • Preços— Sem alterações

    Agente automatizado

Como avaliamos