Muse Spark 1.1 logo

Muse Spark 1.1

Meta · Sorti juil. 2026

Conditionnel

Le premier modèle d'IA payant de Meta et sa première offensive sur le marché du codage commercial — 1,25 $ / 4,25 $ par million de tokens avec 1M de contexte, orchestration native de sous-agents, support MCP / outils et capacité computer-use à environ 4x en dessous des tarifs Anthropic/OpenAI. En tête sur les benchmarks d'utilisation d'outils, mais en retrait de 7 points sur Opus 4.8 en codage pur sur SWE-Bench Pro. Poids fermés, aperçu public limité aux États-Unis. Idéal pour les équipes qui privilégient l'orchestration d'outils à bas coût.

Est-ce fait pour vous ?

Recommandé pour

  • Utilisation d'outils à grande échelle et orchestration MCP — en tête sur MCP Atlas (88,1) et JobBench (54,7), devant Opus 4.8 et GPT-5.5
  • Charges agentiques sensibles aux coûts — tarification $1,25/$4,25 sous-cote les flagships Anthropic/OpenAI d'environ 4x
  • Pipelines multi-agents — orchestration native agent principal/sous-agents avec exécution parallèle
  • Raisonnement multimodal — gère images, vidéo, documents avec le code ; contexte de 1M géré activement

Déconseillé pour

  • Précision de codage frontière — 7 pts derrière Opus 4.8 sur SWE-Bench Pro, troisième sur DeepSWE 1.1
  • Développeurs basés dans l'UE ou hors US — l'API est en preview publique US uniquement ; pas d'accès UE
  • Exigences open-weight ou d'auto-hébergement — propriétaire et à poids fermés (contrairement à Llama)

Performances par tâche

Génération de code

Good

7 pts derrière Opus 4.8 sur SWE-Bench Pro ; troisième sur DeepSWE 1.1 derrière GPT-5.5 et Opus 4.8

Codage agentique

Very Good

Meilleure utilisation d'outils de sa catégorie (MCP Atlas 88,1, JobBench 54,7) ; orchestration native de sous-agents avec exécution parallèle

Utilisation d'ordinateur

Very Good

OSWorld-Verified 80,8 derrière Opus 4.8 (83,4) ; peut piloter un vrai poste de travail avec une approche hybride script/clic

Compréhension multimodale

Good

Gère images, vidéo, documents ; à égalité avec Opus 4.8 sur plusieurs benchmarks de vision selon les graphiques du fournisseur

Raisonnement

Good

SOTA sur Humanity's Last Exam et FinanceBench ; en retrait sur les benchmarks de raisonnement en codage pur

Tarifs

Entrée

$1.25 / 1M tokens

Sortie

$4.25 / 1M tokens

Contexte

1M tokens

Voir tous les tarifs

Tests de performance

TestScoreSource
MCP Atlas (scaled tool use)88.1 Source
JobBench (professional tool use)54.7 Source
Terminal-Bench 2.180.0 Source
OSWorld-Verified80.8 Source
Humanity's Last ExamSOTA Source

Historique des verdicts

15 juil. 2026
copy edit to brevity standard — detail preserved in existing structured children

Journal de vérification

  • Tarifs— Aucun changement

    Agent automatisé

  • Tarifs— Aucun changement

    Agent automatisé

  • Profil— Aucun changement

    Importé au lancement

  • Tarifs— Aucun changement

    Importé au lancement

Comment nous évaluons