GPT-5.6 Luna
OpenAI · Lançado 06/2026
O nível de orçamento do GPT-5.6 da OpenAI — TerminalBench 2.1 com 82,5% por $1/$6 por 1M de tokens, superando Claude Haiku 4.5 e Gemini Flash em capacidade por dólar. A ressalva: a Luna está restrita a ~20 parceiros confiáveis, sem verificação independente ou data de GA. Melhor para equipes que constroem arquiteturas de roteamento de modelos que podem escalar falhas baratas para Terra ou Sol.
É adequada para ti?
Bom para
- Melhor capacidade por dólar na família GPT-5.6: TerminalBench 2.1 com 82,5% está apenas 0,9 pontos atrás do GPT-5.5 (83,4%) a 1/5 do custo do Sol. Para fluxos de trabalho agênticos de alto volume, a Luna é a vencedora económica.
- Velocidade e débito: posicionado como o modelo GPT-5.6 mais rápido, otimizado para produtos sensíveis à latência, enxames de agentes, suporte ao cliente e pipelines de classificação em tempo real.
- Automação de rotina e extração: classificação, sumarização, formatação, roteamento, geração de rascunhos e automação em segundo plano onde o custo-por-pedido e o débito dominam sobre a profundidade de raciocínio bruta.
- Arquiteturas de roteamento de modelos: o nível inferior de uma escada de escalonamento Sol > Terra > Luna. Use a Luna por padrão, escale para Terra ou Sol quando a pontuação de avaliação da Luna cair abaixo do limiar numa tarefa específica.
Não recomendado para
- Restrita pelo governo sem acesso público: mesma restrição de pré-visualização limitada. A proposta de valor da Luna é clara no papel, mas não existe verificação independente.
- Pontuação CTF de 85,19% é a mais baixa da família — sólida mas não dominante. Para fluxos de trabalho de segurança crítica, Terra ou Sol são o nível apropriado.
- Falta a profundidade de segurança de Sol e Terra: sem classificadores de ativação na Luna (conforme o system card). Para fluxos de trabalho cibernéticos e biológicos regulados, use Terra ou Sol com a stack de monitorização completa.
- A $1/$6, a Luna é competitiva mas não o modelo mais barato do mercado — GLM-5.2 ($1,40/$4,40) e DeepSeek V4 Pro ($0,44/$0,87) oferecem preços de saída mais baixos para níveis de capacidade semelhantes.
Desempenho por tarefa
Codificação agêntica de alto volume (orçamento)
82,5% no TerminalBench 2.1 está apenas 0,9 atrás do GPT-5.5. Notável para um nível de orçamento. Encaminhe tarefas de código de rotina para Luna, escale as complexas.
Classificação e extração
O modelo ideal para tarefas baratas de alto débito. Classificação, extração de entidades, sentimento, roteamento e formatação a $1/$6 é a vitória económica da família GPT-5.6.
Sumarização e redação
Rápido e acessível para sumarização de documentos, redação de emails, geração de relatórios e fluxos de conteúdo onde a velocidade importa mais que a precisão extrema.
Cibersegurança
CTF 85,19% é sólido para um modelo de orçamento mas fica atrás de Terra (91,84%) e Sol (96,7%). Sem classificadores de ativação. Não é o nível certo para trabalho de segurança crítica.
Raciocínio complexo e investigação profunda
Nível de orçamento sem modos de raciocínio máximo ou ultra. Para problemas difíceis, encaminhe para Sol. Para raciocínio do dia a dia, Terra. Luna é para volume, não profundidade.
Preços
Entrada
$1 / 1M tokens
Saída
$6 / 1M tokens
Contexto
Fastest and most cost-efficient GPT-5.6 tier.
Testes de desempenho
Histórico de veredictos
Fontes
Registo de verificação
- Preços— Sem alterações
Agente automatizado
- Preços— Sem alterações
Agente automatizado
- Estado— Atualizado
Agente automatizado
Summary re-dated to Jul 7 2026 and made explicit about what is awaited: stays pending pending GA + independent benchmarks; still government-gated (~20 orgs); family trending toward release (~Jul 9 GA per prediction markets, unconfirmed). Verdict unchanged (pending).
- Preços— Sem alterações
Agente automatizado
- Preços— Sem alterações
Agente automatizado
Pricing unchanged: $1/$6 per 1M tokens. Government-gated. Confirmed by OpenAI blog.
- Perfil— Sem alterações
Importado no lançamento
- Preços— Sem alterações
Importado no lançamento