Muse Spark 1.1 logo

Muse Spark 1.1

Meta · Lançado 07/2026

Condicional

O primeiro modelo de IA pago da Meta e sua primeira investida no mercado comercial de codificação — $1,25/$4,25 por 1M de tokens com 1M de contexto, orquestração nativa de subagentes, suporte a MCP/ferramentas e capacidade de uso de computador por cerca de 4× abaixo do preço da Anthropic/OpenAI. Lidera em benchmarks de uso de ferramentas, mas fica 7 pontos atrás do Opus 4.8 em codificação pura no SWE-Bench Pro. Pesos fechados, prévia pública apenas nos EUA. Ideal para equipes que priorizam orquestração de uso de ferramentas com baixo custo.

É adequada para ti?

Bom para

  • Uso de ferramentas em escala e orquestração MCP — lidera MCP Atlas (88,1) e JobBench (54,7), à frente do Opus 4.8 e GPT-5.5
  • Cargas de trabalho agênticas sensíveis ao custo — preço de $1,25/$4,25 reduz os carros-chefe da Anthropic/OpenAI em ~4x
  • Pipelines multi-agente — orquestração nativa de agente principal/subagente com execução paralela
  • Raciocínio multimodal — lida com imagens, vídeo, documentos juntamente com código; contexto de 1M gerido ativamente

Não recomendado para

  • Precisão de codificação de fronteira — fica atrás do Opus 4.8 em 7 pontos no SWE-Bench Pro, terceiro no DeepSWE 1.1
  • Programadores sediados na UE ou não-EUA — a API é pré-visualização pública apenas nos EUA; sem acesso à UE ainda
  • Requisitos de pesos abertos ou self-hosting — proprietário e de peso fechado (ao contrário do Llama)

Desempenho por tarefa

Geração de código

Good

Fica atrás do Opus 4.8 em 7 pontos no SWE-Bench Pro; terceiro no DeepSWE 1.1 atrás do GPT-5.5 e Opus 4.8

Codificação agêntica

Very Good

Melhor da classe em uso de ferramentas (MCP Atlas 88,1, JobBench 54,7); orquestração nativa de subagentes com execução paralela

Computer use

Very Good

OSWorld-Verified 80,8 fica atrás do Opus 4.8 (83,4); pode controlar um desktop real usando abordagem híbrida de scripting/clique

Compreensão multimodal

Good

Lida com imagens, vídeo, documentos; empata com Opus 4.8 em vários benchmarks de visão segundo os gráficos do fornecedor

Raciocínio

Good

SOTA no Humanity's Last Exam e FinanceBench; fica atrás nos benchmarks de raciocínio puro de código

Preços

Entrada

$1.25 / 1M tokens

Saída

$4.25 / 1M tokens

Contexto

1M tokens

Ver preços completos

Testes de desempenho

TestePontuaçãoFonte
MCP Atlas (scaled tool use)88.1 Fonte
JobBench (professional tool use)54.7 Fonte
Terminal-Bench 2.180.0 Fonte
OSWorld-Verified80.8 Fonte
Humanity's Last ExamSOTA Fonte

Histórico de veredictos

15/07/2026
copy edit to brevity standard — detail preserved in existing structured children

Registo de verificação

  • Preços— Sem alterações

    Agente automatizado

  • Preços— Sem alterações

    Agente automatizado

  • Perfil— Sem alterações

    Importado no lançamento

  • Preços— Sem alterações

    Importado no lançamento

Como avaliamos