Claude Opus 5 llega a $5/$25 — Inteligencia Cercana a Fable 5

Anthropic logoAnthropicImportante25 de julio de 2026Modelos
Qué pasó
Anthropic released Claude Opus 5 on July 24 — near-Fable 5 intelligence at $5/$25 per 1M tokens, same price as Opus 4.8, half of Fable 5.
Por qué importa
It's the new default on Claude Max and the strongest on Claude Pro. SOTA on Frontier-Bench and CursorBench with 85% fewer safety interruptions than Fable 5 — the frontier tier stops being a luxury.
Qué hacer
Start evaluating Opus 5 if you build on Claude. At half Fable 5's price with near-parity on coding benchmarks, it's the new cost-performance standard for everyday AI work.

Claude Opus 5 es el nuevo caballo de batalla frontier predeterminado — y la mejor relación calidad-precio de su categoría. Anthropic lo lanzó el 24 de julio de 2026 a $5 por millón de tokens de entrada y $25 por millón de salida, el mismo precio que Opus 4.8 y exactamente la mitad que Fable 5. Establece un nuevo estado del arte en Frontier-Bench v0.1, iguala a Fable 5 con una diferencia de 0.5% en CursorBench 3.2 a mitad de costo, y activa los clasificadores de seguridad un 85% menos que Fable 5. Nuestro veredicto pasa de pending a Recommended — Opus 5 es el modelo más potente en Claude Pro y el nuevo predeterminado en Claude Max.

Qué pasó

Anthropic lanzó Claude Opus 5 el 24 de julio — su cuarto modelo en menos de dos meses (Mythos 5, Fable 5, Sonnet 5, ahora Opus 5). Pero Opus 5 es el que redefine la ecuación diaria para la mayoría de los desarrolladores.

Rendimiento. Opus 5 obtiene 1,861 en GDPval-AA — por delante de Fable 5 (1,747) y GPT-5.6 Sol (1,736) — y establece SOTA en Frontier-Bench v0.1. En CursorBench 3.2 con esfuerzo máximo, está a 0.5% del pico de Fable 5 a mitad de costo. ARC-AGI 3: 30.2%, el triple que cualquier otro modelo. Zapier AutomationBench: el único modelo en completar un flujo de trabajo completo de prevención de abandono de principio a fin, con una tasa de éxito 1.5x superior al siguiente mejor modelo.

Estabilidad de precios. Opus 5 cuesta exactamente lo mismo que Opus 4.8 — $5/$25 por 1M tokens. Sin aumento de precio. Anthropic añadió controles de esfuerzo bajo/medio/alto para que los equipos puedan intercambiar costo por capacidad en cada solicitud. El modo rápido funciona aproximadamente a 2.5x de velocidad por 2x el precio base.

Seguridad. Los clasificadores de seguridad de Opus 5 intervienen un 85% menos que los de Fable 5. El modelo no fue entrenado intencionadamente en tareas de explotación cibernética, y en la auditoría interna de comportamiento de Anthropic, obtuvo la tasa más baja de comportamiento desalineado de cualquier modelo Claude reciente (2.3). También es el menos susceptible a ser manipulado para usos indebidos.

Ciencia. Opus 5 es el modelo más potente de Anthropic disponible para investigación científica — 10.2 puntos porcentuales más alto en tareas de química orgánica y 7.7 puntos más alto en predicción de función de proteínas frente a Opus 4.8 en todas las evaluaciones de ciencias de la vida.

Plataforma. Junto con el modelo, se lanzaron dos funcionalidades beta: cambio de herramientas a mitad de conversación (intercambiar herramientas sin invalidar la caché de prompts) y fallbacks automáticos de API (las solicitudes marcadas se redirigen a un modelo de respaldo en lugar de ser bloqueadas). ID del modelo: claude-opus-5, disponible en todas las plataformas — Claude API, Claude Code, claude.ai, Amazon Bedrock, Google Cloud y Microsoft Foundry.

Por qué importa

Esto no es un lanzamiento de modelo más. Anthropic ha puesto precio a la frontera para el uso diario.

Durante la mayor parte de 2026, el nivel frontier ha sido algo que los equipos racionaban — un modelo al que recurres para el 5% más difícil de las tareas mientras un caballo de batalla más barato maneja el volumen. Fable 5 a $10/$50 por 1M tokens y con una política obligatoria de retención de datos de 30 días era una herramienta potente pero cara que muchos equipos no podían adoptar para cargas reguladas. Opus 5 elimina ese compromiso: el modelo que gana los benchmarks es también el que cuesta la mitad, no tiene requisito de retención y dispara muchas menos interrupciones de seguridad.

Los equipos de acceso anticipado ya reportan resultados contundentes. Niko Grupen de Harvey comprobó que Opus 5 igualaba a Opus 4.8 en razonamiento máximo generando un 26% menos de tokens. Wade Foster de Zapier informó que fue el primer modelo en completar un flujo de prevención de abandono de principio a fin. Una firma de trading construyó un feed completo de datos de mercado en una sola sesión — algo que modelos anteriores no lograban ni con planes detallados. En tareas agénticas de horizonte largo, el comportamiento de autoverificación de Opus 5 — construir sus propios harnesses de prueba, ejecutar su propia validación — es la diferencia entre un asistente que supervisas paso a paso y uno al que puedes delegar una tarea de varias horas.

La señal direccional en cada lanzamiento frontier de este año es la misma: el eje competitivo se ha desplazado de la inteligencia nominal al costo por tarea completada. Cuando Anthropic — el proveedor con el modelo más potente del mercado — sostiene que su modelo más barato es el predeterminado correcto, la era de racionar la frontera está terminando.

Qué cambia para ti

Si hoy usas Opus 4.8. Migra a Opus 5. Mismo precio, más del doble de puntuación en Frontier-Bench, +15 puntos en OSWorld 2.0, y un resultado ARC-AGI-3 del 30.2% frente al 1.5% de su predecesor. No hay argumento de costo para quedarse.

Si estás pagando por Fable 5. Prueba el cambio en cargas de ingeniería y operaciones. Opus 5 gana en la mayoría de las filas de evaluación y empata en los benchmarks de programación a la mitad de precio, además de eliminar el requisito de retención de 30 días. Mantén Fable 5 para dominios especializados — sigue liderando en DeepSWE v1.1, el Legal Agent Benchmark y tareas de recall puro.

Si estás construyendo agentes. El comportamiento de autoverificación de Opus 5 — revisar su propio trabajo, construir harnesses de prueba, detectar casos límite — hace que las ejecuciones autónomas de varias horas sean económicamente viables como no lo eran antes. Reevalúa tu límite de duración de sesión.

Si te han bloqueado los clasificadores de seguridad de Fable 5. La reducción del 85% en intervenciones del clasificador de Opus 5 es un cambio material en calidad de vida. Las solicitudes de biología que Fable 5 rechazaba ahora se dirigen a Opus 5 en lugar de a Opus 4.8.

Tu modelo actualAcción
Opus 4.8Migrar a Opus 5 — mismo precio, salto generacional de rendimiento
Fable 5 (ingeniería/ops)Probar Opus 5 — casi paridad a mitad de costo, sin requisito de retención
Fable 5 (legal/especializado)Quedarse en Fable 5 por ahora — sigue liderando en dominios profesionales específicos
Sonnet 5 o inferiorEvaluar Opus 5 para tus cargas más exigentes — es el modelo más potente en Pro

FAQ

¿Es Opus 5 mejor que Fable 5? Mejor en la mayoría de las dimensiones a mitad de precio — SOTA en Frontier-Bench, GDPval-AA, ARC-AGI-3, OSWorld 2.0 y AutomationBench. Pero Fable 5 aún tiene ventaja en DeepSWE v1.1, el Legal Agent Benchmark y Humanity's Last Exam sin herramientas. Para el trabajo diario de ingeniería, la brecha se ha reducido hasta el punto en que pagar el doble ya no tiene sentido.

¿Tiene Opus 5 la misma retención de datos que Fable 5? No. A diferencia de los modelos de clase Mythos (Fable 5, Mythos 5), Opus 5 no impone requisitos de retención de datos para acceso general — la misma postura que Opus 4.8. Esto abre la puerta a cargas de trabajo reguladas que no podían adoptar Fable 5.

¿Cuándo debería seguir usando Fable 5? Para dominios legales, clínicos y profesionales especializados donde mantiene ventaja, y para tareas donde el recall puro importa más que el razonamiento aumentado por herramientas. También para equipos ya aprobados bajo el Programa de Verificación Cibernética de Fable 5 que necesitan menos restricciones de las que permiten los clasificadores de Opus 5.

pendingelección anterior
recommendednueva elección

Official launch July 24 with confirmed $5/$25 pricing, SOTA benchmarks on Frontier-Bench and CursorBench, 85% fewer safety interruptions than Fable 5, and availability on all platforms — primary source confirmed via Anthropic newsroom.

Qué hacer

  1. 1 Evaluate Opus 5 on your own workloads — run your prompts through it and compare cost-per-task, not cost-per-token
  2. 2 If on Opus 4.8: migrate your default model to Opus 5 — identical pricing, generational performance gain
  3. 3 If on Fable 5 for engineering/ops: test the swap — near-parity at half the cost with no retention requirement
  4. 4 Re-test your agentic session-length ceiling — Opus 5's self-verification behavior makes longer autonomous runs viable

Herramientas y modelos afectados

No vuelvas a tener que ponerte al día

El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.

Al suscribirte aceptas nuestra Política de privacidad. Cancela cuando quieras.