GPT-5.6 Terra logo

GPT-5.6 Terra

OpenAI · Lanzado jun 2026

pending

El caballo de batalla de gama media de GPT-5.6 — capacidad de clase GPT-5.5 a mitad de precio ($2,50/$15 por 1M de tokens), con TerminalBench 2.1 al 84,3 % empatando con Claude Fable 5. La salvedad: todas las afirmaciones provienen del proveedor, Terra está restringida a ~20 socios y no hay fecha de disponibilidad general confirmada. Para la mayoría de las cargas de trabajo de producción, Terra sería la opción pragmática por defecto una vez disponible; GPT-5.5 y Opus 4.8 son las alternativas actuales.

¿Es adecuada para ti?

Bueno para

  • Punto óptimo de eficiencia de coste: capacidad de clase GPT-5.5 a mitad de precio. A $2,50/$15 por 1M de tokens, Terra tiene un precio pensado para reemplazar a GPT-5.5 como modelo por defecto para la mayoría de cargas de producción — si la afirmación de calidad se confirma.
  • TerminalBench 2.1 al 84,3% empata con Claude Fable 5 — el flagship disponible públicamente de Anthropic — con la misma puntuación. Para programación con agentes que no necesita la profundidad de razonamiento extrema de Sol, Terra es la elección racional.
  • Cargas de trabajo empresariales de alto volumen: atención al cliente, herramientas internas, análisis de documentos y pipelines de producción donde la fiabilidad importa pero el coste por solicitud necesita escalar.
  • Fuerte capacidad de ciberseguridad para su nivel: puntuación del 91,84% en pruebas CTF internas. Incorpora clasificadores de activación y el mismo stack de seguridad que Sol para flujos de trabajo regulados de ciberseguridad y biología.

No recomendado para

  • Vista previa limitada restringida por el gobierno: las mismas restricciones de acceso que Sol — solo ~20 socios de confianza hoy. Las afirmaciones de 'rendimiento GPT-5.5 a mitad de coste' son del proveedor, no verificables de forma independiente.
  • Sin modos de razonamiento ultra o max: Terra carece de la descomposición por subagentes y la deliberación extendida que distinguen a Sol. Para el trabajo con agentes más difícil, sigues necesitando Sol.
  • La puntuación del 84,3% en TerminalBench está solo 0,9 puntos por delante de GPT-5.5 con 83,4%. La afirmación de 'competitivo con GPT-5.5' es correcta en dirección pero la diferencia es pequeña — tus propias evaluaciones te dirán más que el marcador.

Rendimiento por tarea

Programación con agentes (nivel medio)

Very Good

84,3% en TerminalBench 2.1 empata con Claude Fable 5. Suficiente para la mayoría de agentes de programación en producción. Sol es la mejora para los problemas más difíciles.

Ciberseguridad

Very Good

Puntuación CTF del 91,84%. Capacidades de seguridad sólidas con clasificadores de activación. Bueno para flujos de trabajo defensivos y análisis de vulnerabilidades sin el sobrecoste de Sol.

Cargas de producción eficientes en coste

Excellent

A $2,50/$15 por 1M, Terra ofrece la mejor relación coste-capacidad de la familia GPT-5.6. La afirmación de OpenAI de rendimiento GPT-5.5 a mitad de coste es el titular comercialmente más importante para la mayoría de equipos.

Razonamiento general y trabajo cotidiano

Very Good

Presentado como el modelo equilibrado para el día a día. Para razonamiento rutinario, escritura, análisis e inteligencia de negocio, Terra debería ser indistinguible de Sol en calidad.

Investigación profunda y razonamiento difícil

Good

Carece de los modos de razonamiento máximo y ultra con subagentes de Sol. Por detrás de Sol, Mythos 5 y Fable 5 en los problemas más difíciles. Enruta las tareas difíciles a Sol, no a Terra.

Precios

Entrada

$2.50 / 1M tokens

Salida

$15 / 1M tokens

Contexto

Roughly 2x cheaper than GPT-5.5 for similar perf.

Ver precios completos

Pruebas de rendimiento

PruebaPuntuaciónFuente
TerminalBench 2.184.3% Fuente
Internal CTF (capture-the-flag)91.84% Fuente

Historial de veredictos

16 jul 2026
copy edit to brevity standard, detail preserved in children — Density rewrite: compressed 157w/10s to ~85w/3s per the 55–90w verdict_summary standard. Benchmark scores, pricing tiers, audience fit, and per-task ratings remain in strengths[], benchmarks[], task_strengths[], and verdict_audiences[].

Registro de verificación

  • Precios— Sin cambios

    Agente automatizado

  • Precios— Sin cambios

    Agente automatizado

  • Estado— Actualizado

    Agente automatizado

    Summary re-dated to Jul 7 2026 and made explicit about what is awaited: stays pending pending GA + independent benchmarks; still government-gated (~20 orgs); family trending toward release (Sol Ultra confirmed for Codex Jul 6, ~Jul 9 GA per prediction markets, unconfirmed). Verdict unchanged (pending).

  • Precios— Sin cambios

    Agente automatizado

  • Precios— Sin cambios

    Agente automatizado

    Pricing unchanged: $2.50/$15 per 1M tokens. Government-gated. Confirmed by OpenAI blog (GPT-5.5-class at half cost).

  • Perfil— Sin cambios

    Importado en el lanzamiento

  • Precios— Sin cambios

    Importado en el lanzamiento

Cómo evaluamos