MAI-Code-1-Flash logo

MAI-Code-1-Flash

Microsoft · Sorti juin 2026

Conditionnel

Le premier modèle de codage maison de Microsoft — un MoE sparse petit, rapide et agressivement optimisé en coût à $0,75/$4,50 par 1M tokens. Il offre une avance de 16 points sur Claude Haiku 4.5 sur SWE-Bench Pro tout en utilisant jusqu'à 60% de tokens en moins. Il est conçu spécifiquement pour les workflows Copilot à haut volume — auto-complétions, refactorisations, échafaudages — ce n'est pas un modèle frontière. Meilleur au sein de l'écosystème Copilot ; l'accès API en dehors est encore en déploiement.

Est-ce fait pour vous ?

Recommandé pour

  • Workflows de codage agentique rapides et itératifs dans VS Code / GitHub Copilot où la latence et le coût en tokens importent plus que le raisonnement frontière
  • Complétions de code à haut volume, refactorisations, génération d'échafaudages de tests et boilerplate — la charge Copilot « quotidienne »
  • Déploiements d'entreprise sensibles aux coûts : à $0,75/$4,50 par 1M tokens, sous-cote Claude Haiku 4.5 et GPT-5.5 de 2-6x
  • Développeurs sur les plans Copilot Free/Pro/Pro+/Max qui veulent optimiser leurs crédits mensuels

Déconseillé pour

  • Changements architecturaux multi-fichiers complexes ou conception d'algorithmes nouveaux nécessitant un raisonnement de niveau frontière
  • Tâches généralistes non liées au codage — c'est un modèle de codage spécialisé, pas un assistant général
  • Agents CI/CD de production en dehors de Copilot — l'accès API tiers via Fireworks/Baseten/OpenRouter est encore en montée en puissance

Performances par tâche

Complétion de code et autocomplétion

Excellent

Excellent — faible latence, longueur de réponse adaptative, conçu pour la boucle interactive de Copilot

Refactorisation de code

Very Good

Solide — gère bien le refactoring routinier ; 60% de tokens en moins que les concurrents sur SWE-Bench Verified

Suivi d'instructions (codage)

Excellent

Meilleur de sa catégorie pour le niveau léger — +28,9 points sur IF Bench vs Haiku 4.5 ; 85,8% en raisonnement adversarial

Utilisation d'outils agentiques (Copilot)

Very Good

Solide — entraîné avec le harnais de production Copilot ; bat Haiku 4.5 sur τ¹-Bench

Corrections de bugs réels (SWE-Bench Pro)

Good

Solide pour sa taille — 51,2% de taux de réussite ; 16 points d'avance sur Haiku 4.5 mais bien en dessous des modèles frontière

Architecture multi-fichiers / conception nouvelle

Fair

Faible — 5B paramètres actifs limitent la profondeur de raisonnement ; utilisez un modèle flagship pour le travail complexe

Raisonnement mathématique et scientifique

Very Good

Bon — 92,5% AIME 2026, 84,6% GPQA Diamond ; solide pour un modèle léger

Chat généraliste / non-codage

Poor

Pas conçu pour cela — un modèle de codage spécialisé ; utilisez GPT-5.5 ou Claude pour les tâches générales

Tarifs

Entrée

$0.75 / 1M tokens

Sortie

$4.50 / 1M tokens

Contexte

256K context

Voir tous les tarifs

Tests de performance

TestScoreSource
SWE-Bench Pro51.2% (vs Haiku 4.5: 35.2%) Source
SWE-Bench VerifiedBeats Haiku 4.5 with up to 60% fewer tokens Source
AIME 202692.5% (vs Haiku 4.5: 83.3%) Source
GPQA Diamond84.6% (vs Haiku 4.5: 73.2%) Source
IF Bench75.0 (vs Haiku 4.5: 46.1) Source
Adversarial reasoning85.8% adjusted accuracy Source
Frontier Math (Tier 1-3)6.3% (vs Haiku 4.5: 2.8%) Source
Frontier Science58.2% (vs Haiku 4.5: 42.3%) Source
HLE18.0% (vs Haiku 4.5: 9.5%) Source

Historique des verdicts

15 juil. 2026
copy edit to brevity standard — detail preserved in existing structured children

Journal de vérification

  • Tarifs— Aucun changement

    Agent automatisé

  • Tarifs— Aucun changement

    Agent automatisé

  • Tarifs— Aucun changement

    Agent automatisé

  • Tarifs— Aucun changement

    Agent automatisé

    Pricing unchanged: $0.75/$4.50 per 1M tokens, 256K context. Confirmed live on GitHub Copilot pricing page.

  • Profil— Aucun changement

    Importé au lancement

  • Tarifs— Aucun changement

    Importé au lancement

Comment nous évaluons