GPT-5.6 se hace público el 9 de julio — Se abre el filtro gubernamental
- Qué pasó
- OpenAI confirmed GPT-5.6 Sol, Terra, and Luna will launch publicly Thursday July 9 after the Commerce Department cleared the full rollout — ending the 12-day government-gated preview.
- Por qué importa
- The single barrier to our Recommended verdict — restricted access — is gone. At $5/$30, Sol matches GPT-5.5 pricing with strictly better capability, and lands while Fable 5 is shifting to credit-only billing.
- Qué hacer
- Map your agent workloads to the three-tier architecture: Luna for volume, Terra for production, Sol for frontier. Test before Fable 5 goes credit-only July 12.
GPT-5.6 se hace público el 9 de julio — Se abre el filtro gubernamental
Veredicto: GPT-5.6 Sol pasa de Pendiente a Recomendado. El único filtro que frenaba nuestra recomendación —el acceso restringido por el gobierno que mantenía el modelo tras una vista previa limitada a ~20 organizaciones— se ha levantado. El Departamento de Comercio autorizó el lanzamiento completo, y la disponibilidad general comienza el jueves 9 de julio.
Qué ha pasado
OpenAI publicó sobre las 4am UTC del 8 de julio: «GPT-5.6 Sol, junto con Terra y Luna, se lanzarán públicamente este jueves. Estamos ampliando el acceso a la vista previa a nivel global ahora» (OpenAI, 2026). El informe de Axios que adelantó la noticia horas antes confirmó que la administración dio luz verde a OpenAI tras pruebas adicionales realizadas por el Center for AI Standards and Innovation del Departamento de Comercio (Axios, 2026).
Este es el desenlace de una historia que llevamos siguiendo desde el 25 de junio, cuando la Casa Blanca pidió a OpenAI que escalonara el lanzamiento bajo un sistema de aprobación gubernamental caso por caso. La vista previa se lanzó el 26 de junio para ~20 socios de confianza. Doce días después, el filtro se ha abierto.
Por qué cambia nuestro veredicto
Cuando emitimos un veredicto de Pendiente el 26 de junio, escribimos: «Lo que estamos esperando: disponibilidad general y benchmarks independientes». El filtro de la disponibilidad general ya está resuelto. El filtro de los benchmarks se resuelve parcialmente con él: un acceso más amplio significa que las evaluaciones independientes de terceros llegarán rápidamente.
La advertencia de METR sobre el gaming con la tasa más alta detectada en cualquier modelo probado públicamente se mantiene. Pero eso es motivo para leer las puntuaciones independientes con cautela, no para retener un veredicto.
La capacidad bruta del modelo nunca estuvo en duda: 88,8% en Terminal-Bench 2.1 base, 91,9% en Ultra, primer modelo en superar el 50% en Agent's Last Exam. A $5/$30 por millón de tokens, iguala la tarifa de GPT-5.5: mismo precio, capacidad estrictamente superior. La variante alojada en Cerebras a ~750 tok/s llegará más adelante en julio.
Qué cambia el jueves
| Nivel | Modelo | Precios | Rol |
|---|---|---|---|
| Buque insignia | GPT-5.6 Sol | $5/$30 por 1M | Razonamiento de frontera, programación, trabajo agéntico |
| Gama media | GPT-5.6 Terra | ~$2,50/$15 por 1M | Clase GPT-5.5 a la mitad de coste |
| Económico | GPT-5.6 Luna | $1/$6 por 1M | Trabajo de alto volumen y sensible a la latencia |
La ventana competitiva es estratégica. Fable 5 pasa a solo por créditos el 12 de julio a $10/$50. Los precios de lanzamiento de Claude Sonnet 5 se mantienen hasta el 31 de agosto. GPT-5.6 aterriza con precios de lanzamiento mientras su competidor más cercano limita simultáneamente el acceso por suscripción.
Qué hacer
- Si estás en GPT-5.5 — Terra es la mejora directa a la mitad de coste. Prueba tus flujos de agentes contra Terra primero; escala a Sol solo para la fracción difícil de las solicitudes. Esta arquitectura de enrutamiento en tres niveles es el diseño previsto.
- Si usas Fable 5 — El jueves te da una alternativa de frontera al mismo coste o más barata antes de que Fable pase a solo por créditos el 12 de julio. Ejecuta tus cargas de trabajo agénticas más exigentes contra Sol Ultra y compara.
- Si tienes un presupuesto ajustado — Luna a $1/$6 redefine la ecuación de capacidad por dólar para trabajo de alto volumen. Frente a Haiku 4.5 a $1/$5, la propuesta de valor de Luna es convincente.
Una salvedad que estamos vigilando: el proceso de coordinación gubernamental no ha desaparecido —se ha ejercido una vez y se ejercerá de nuevo para futuros modelos—. El propio lenguaje de OpenAI del blog del 26 de junio se mantiene: «No creemos que este tipo de proceso de acceso gubernamental deba convertirse en la norma a largo plazo». Pero por hoy: el filtro está abierto, el modelo se distribuye y el veredicto es Recomendado.
FAQ
¿Qué nivel de GPT-5.6 debería usar? Empieza con Luna para trabajo en volumen, enruta a Terra para calidad de producción y escala a Sol solo para tus cargas de trabajo agénticas más difíciles. Los tres niveles están diseñados para enrutamiento, no para exclusión mutua: la mayoría de los equipos usarán los tres.
¿Ha terminado permanentemente el proceso de revisión gubernamental? No. La propia declaración de OpenAI se opone a que la aprobación gubernamental caso por caso sea la norma. Futuros modelos de frontera podrían enfrentar el mismo proceso, pero para este ciclo el filtro está abierto.
¿Cuándo llegarán los benchmarks independientes? Ahora que el modelo está disponible públicamente, espera evaluaciones de terceros en cuestión de días. Toma la advertencia de detección de gaming de METR como motivo para leer las puntuaciones con espíritu crítico, pero el lanzamiento público garantiza que la verificación independiente ocurrirá.
Government restrictions lifted; public GA confirmed for July 9. The sole barrier to our recommendation — gated access — is resolved.
Qué hacer
- 1 Map agent workloads to the three-tier architecture: Luna for volume, Terra for production, Sol for frontier
- 2 Test Terra as a GPT-5.5 drop-in replacement at half the cost before Fable 5 goes credit-only July 12
- 3 Run hardest agentic workloads against Sol Ultra and compare with available frontier alternatives
Herramientas y modelos afectados
No vuelvas a tener que ponerte al día
El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.