GPT-5.6 Luna logo

GPT-5.6 Luna

OpenAI · Lanzado jun 2026

pending

El nivel económico de GPT-5.6 de OpenAI — TerminalBench 2.1 con 82,5 % por $1/$6 por 1M de tokens, superando a Claude Haiku 4.5 y Gemini Flash en capacidad por dólar. La advertencia: Luna está restringida a ~20 socios de confianza, sin verificación independiente ni fecha de disponibilidad general. Ideal para equipos que construyen arquitecturas de enrutamiento de modelos que pueden escalar fallos baratos a Terra o Sol.

¿Es adecuada para ti?

Bueno para

  • Mejor relación capacidad-precio de la familia GPT-5.6: TerminalBench 2.1 al 82,5% está solo 0,9 puntos por detrás de GPT-5.5 (83,4%) a 1/5 del coste de Sol. Para flujos de trabajo con agentes de alto volumen, Luna es el ganador económico.
  • Velocidad y rendimiento: posicionado como el modelo GPT-5.6 más rápido, optimizado para productos sensibles a la latencia, enjambres de agentes, atención al cliente y pipelines de clasificación en tiempo real.
  • Automatización y extracción de rutina: clasificación, resumen, formateo, enrutamiento, generación de borradores y automatización de fondo donde el coste por solicitud y el rendimiento dominan sobre la profundidad de razonamiento.
  • Arquitecturas de enrutamiento de modelos: el nivel inferior de una escalera de escalado Sol > Terra > Luna. Usa Luna por defecto, escala a Terra o Sol cuando la puntuación de eval de Luna caiga por debajo del umbral en una tarea específica.

No recomendado para

  • Restringido por el gobierno sin acceso público: la misma restricción de vista previa limitada. La propuesta de valor de Luna es clara sobre el papel, pero no existe verificación independiente.
  • La puntuación CTF del 85,19% es la más baja de la familia — sólida pero no dominante. Para flujos de trabajo críticos de seguridad, Terra o Sol son el nivel adecuado.
  • Carece de la profundidad de seguridad de Sol y Terra: sin clasificadores de activación en Luna (según la system card). Para flujos de trabajo regulados de ciberseguridad y biología, usa Terra o Sol con el stack completo de monitorización.
  • A $1/$6, Luna es competitivo pero no el modelo más barato del mercado — GLM-5.2 ($1,40/$4,40) y DeepSeek V4 Pro ($0,44/$0,87) ofrecen precios de salida más bajos para niveles de capacidad similares.

Rendimiento por tarea

Programación con agentes de alto volumen (económico)

Very Good

82,5% en TerminalBench 2.1 está solo 0,9 por detrás de GPT-5.5. Notable para un nivel económico. Enruta tareas de programación rutinarias a Luna, escala las complejas.

Clasificación y extracción

Excellent

El modelo ideal para tareas baratas de alto rendimiento. Clasificación, extracción de entidades, análisis de sentimiento, enrutamiento y formateo a $1/$6 es la victoria económica de la familia GPT-5.6.

Resumen y redacción de borradores

Very Good

Rápido y asequible para resumen de documentos, redacción de correos, generación de informes y flujos de contenido donde la velocidad importa más que la precisión extrema.

Ciberseguridad

Good

CTF 85,19% es sólido para un modelo económico pero por detrás de Terra (91,84%) y Sol (96,7%). Sin clasificadores de activación. No es el nivel adecuado para trabajo crítico de seguridad.

Razonamiento difícil e investigación profunda

Fair

Nivel económico sin modos de razonamiento max o ultra. Para problemas difíciles, enruta a Sol. Para razonamiento cotidiano, Terra. Luna es para volumen, no para profundidad.

Precios

Entrada

$1 / 1M tokens

Salida

$6 / 1M tokens

Contexto

Fastest and most cost-efficient GPT-5.6 tier.

Ver precios completos

Pruebas de rendimiento

PruebaPuntuaciónFuente
TerminalBench 2.182.5% Fuente
Internal CTF (capture-the-flag)85.19% Fuente

Historial de veredictos

16 jul 2026
copy edit to brevity standard, detail preserved in children — Density rewrite: compressed 176w/9s to ~70w/3s per the 55–90w verdict_summary standard. Benchmark scores, pricing detail, audience fit, and per-task ratings remain in strengths[], benchmarks[], task_strengths[], and verdict_audiences[].

Registro de verificación

  • Precios— Sin cambios

    Agente automatizado

  • Precios— Sin cambios

    Agente automatizado

  • Estado— Actualizado

    Agente automatizado

    Summary re-dated to Jul 7 2026 and made explicit about what is awaited: stays pending pending GA + independent benchmarks; still government-gated (~20 orgs); family trending toward release (~Jul 9 GA per prediction markets, unconfirmed). Verdict unchanged (pending).

  • Precios— Sin cambios

    Agente automatizado

  • Precios— Sin cambios

    Agente automatizado

    Pricing unchanged: $1/$6 per 1M tokens. Government-gated. Confirmed by OpenAI blog.

  • Perfil— Sin cambios

    Importado en el lanzamiento

  • Precios— Sin cambios

    Importado en el lanzamiento

Cómo evaluamos