Muse Spark 1.1 logo

Muse Spark 1.1

Meta · Lanzado jul 2026

Condicional

El primer modelo de IA de pago de Meta y su primera ofensiva en el mercado de programación comercial: $1.25/$4.25 por 1M tokens con 1M de contexto, orquestación nativa de subagentes, soporte para MCP/herramientas y capacidad de uso de ordenador a aproximadamente 4× por debajo del precio de Anthropic/OpenAI. Lidera en benchmarks de uso de herramientas pero va 7 puntos por detrás de Opus 4.8 en programación pura en SWE-Bench Pro. Pesos cerrados, vista previa pública solo en EE. UU. Ideal para equipos que priorizan la orquestación de herramientas a bajo coste.

¿Es adecuada para ti?

Bueno para

  • Uso de herramientas a escala y orquestación MCP — lidera en MCP Atlas (88.1) y JobBench (54.7), por delante de Opus 4.8 y GPT-5.5
  • Cargas de trabajo agentivas sensibles al coste — los precios de $1.25/$4.25 rebajan ~4x a los modelos insignia de Anthropic y OpenAI
  • Pipelines multiagente — orquestación nativa de agente principal/subagentes con ejecución en paralelo
  • Razonamiento multimodal — procesa imágenes, vídeo y documentos junto con código; 1M de contexto gestionado activamente

No recomendado para

  • Precisión de codificación de frontera — 7 puntos por detrás de Opus 4.8 en SWE-Bench Pro y tercero en DeepSWE 1.1
  • Desarrolladores en la UE o fuera de EE.UU. — la API solo está disponible en vista previa pública para EE.UU.; sin acceso en la UE aún
  • Requisitos de código abierto o self-hosting — propietario y de peso cerrado (a diferencia de Llama)

Rendimiento por tarea

Generación de código

Good

7 puntos por detrás de Opus 4.8 en SWE-Bench Pro; tercero en DeepSWE 1.1 tras GPT-5.5 y Opus 4.8

Codificación agentiva

Very Good

El mejor en uso de herramientas (MCP Atlas 88.1, JobBench 54.7); orquestación nativa de subagentes con ejecución paralela

Uso de ordenador

Very Good

OSWorld-Verified 80.8, por detrás de Opus 4.8 (83.4); puede controlar un escritorio real mediante un enfoque híbrido de scripting y clics

Comprensión multimodal

Good

Procesa imágenes, vídeo y documentos; iguala a Opus 4.8 en varios benchmarks de visión según los gráficos del proveedor

Razonamiento

Good

SOTA en Humanity's Last Exam y FinanceBench; se queda atrás en benchmarks de razonamiento de código puro

Precios

Entrada

$1.25 / 1M tokens

Salida

$4.25 / 1M tokens

Contexto

1M tokens

Ver precios completos

Pruebas de rendimiento

PruebaPuntuaciónFuente
MCP Atlas (scaled tool use)88.1 Fuente
JobBench (professional tool use)54.7 Fuente
Terminal-Bench 2.180.0 Fuente
OSWorld-Verified80.8 Fuente
Humanity's Last ExamSOTA Fuente

Historial de veredictos

15 jul 2026
copy edit to brevity standard — detail preserved in existing structured children

Registro de verificación

  • Precios— Sin cambios

    Agente automatizado

  • Precios— Sin cambios

    Agente automatizado

  • Perfil— Sin cambios

    Importado en el lanzamiento

  • Precios— Sin cambios

    Importado en el lanzamiento

Cómo evaluamos