Muse Spark 1.1 logo

Muse Spark 1.1

Meta · Veröffentlicht Juli 2026

Bedingt

Metas erstes kostenpflichtiges KI-Modell und die erste Salve im kommerziellen Coding-Markt -- $1,25/$4,25 pro 1M Token mit 1M Kontext, nativer Subagent-Orchestrierung, MCP-/Tool-Unterstuetzung und Computer-Use-Faehigkeit zu etwa einem Viertel der Preise von Anthropic/OpenAI. Fuehrt bei Tool-Use-Benchmarks, liegt aber 7 Punkte hinter Opus 4.8 im SWE-Bench Pro bei reinem Coding. Closed-Weight, US-only Public Preview. Am besten fuer Teams, die Tool-Use-Orchestrierung zu niedrigen Kosten priorisieren.

Ist es das Richtige für dich?

Gut für

  • Skalierter Tool-Use und MCP-Orchestrierung — führt MCP Atlas (88,1) und JobBench (54,7) an, vor Opus 4.8 und GPT-5.5
  • Kostensensitive agentische Workloads — $1,25/$4,25-Preise unterbieten Anthropic/OpenAI-Flaggschiffe um ~4x
  • Multi-Agent-Pipelines — native Primary-Agent/Subagent-Orchestrierung mit paralleler Ausführung
  • Multimodales Reasoning — verarbeitet Bilder, Video, Dokumente zusammen mit Code; 1M Kontext aktiv verwaltet

Nicht geeignet für

  • Frontier-Coding-Genauigkeit — liegt 7 Punkte hinter Opus 4.8 auf SWE-Bench Pro, Dritter auf DeepSWE 1.1
  • EU-basierte oder nicht-US-Entwickler — API ist US-only Public Preview; noch kein EU-Zugriff
  • Open-Weight- oder Selbst-Hosting-Anforderungen — proprietär und Closed-Weight (anders als Llama)

Leistung nach Aufgabe

Codegenerierung

Good

Liegt 7 Punkte hinter Opus 4.8 auf SWE-Bench Pro; Dritter auf DeepSWE 1.1 hinter GPT-5.5 und Opus 4.8

Agentisches Coding

Very Good

Klassenbester Tool-Use (MCP Atlas 88,1, JobBench 54,7); native Subagent-Orchestrierung mit paralleler Ausführung

Computer Use

Very Good

OSWorld-Verified 80,8 liegt hinter Opus 4.8 (83,4); kann einen echten Desktop mit hybridem Scripting/Clicking-Ansatz steuern

Multimodales Verständnis

Good

Verarbeitet Bilder, Video, Dokumente; laut Hersteller-Charts gleichauf mit Opus 4.8 bei mehreren Vision-Benchmarks

Reasoning

Good

SOTA bei Humanity's Last Exam und FinanceBench; hinkt bei reinen Coding-Reasoning-Benchmarks hinterher

Preise

Eingabe

$1.25 / 1M tokens

Ausgabe

$4.25 / 1M tokens

Kontext

1M tokens

Alle Preise ansehen

Benchmarks

BenchmarkWertQuelle
MCP Atlas (scaled tool use)88.1 Quelle
JobBench (professional tool use)54.7 Quelle
Terminal-Bench 2.180.0 Quelle
OSWorld-Verified80.8 Quelle
Humanity's Last ExamSOTA Quelle

Urteilsverlauf

15. Juli 2026
copy edit to brevity standard — detail preserved in existing structured children

Prüfprotokoll

  • Preise— Keine Änderungen

    Automatisierter Agent

  • Preise— Keine Änderungen

    Automatisierter Agent

  • Profil— Keine Änderungen

    Beim Start importiert

  • Preise— Keine Änderungen

    Beim Start importiert

Wie wir bewerten