GPT-5.6 Luna logo

GPT-5.6 Luna

OpenAI · Lançado 06/2026

pending

O nível de orçamento do GPT-5.6 da OpenAI — TerminalBench 2.1 com 82,5% por $1/$6 por 1M de tokens, superando Claude Haiku 4.5 e Gemini Flash em capacidade por dólar. A ressalva: a Luna está restrita a ~20 parceiros confiáveis, sem verificação independente ou data de GA. Melhor para equipes que constroem arquiteturas de roteamento de modelos que podem escalar falhas baratas para Terra ou Sol.

É adequada para ti?

Bom para

  • Melhor capacidade por dólar na família GPT-5.6: TerminalBench 2.1 com 82,5% está apenas 0,9 pontos atrás do GPT-5.5 (83,4%) a 1/5 do custo do Sol. Para fluxos de trabalho agênticos de alto volume, a Luna é a vencedora económica.
  • Velocidade e débito: posicionado como o modelo GPT-5.6 mais rápido, otimizado para produtos sensíveis à latência, enxames de agentes, suporte ao cliente e pipelines de classificação em tempo real.
  • Automação de rotina e extração: classificação, sumarização, formatação, roteamento, geração de rascunhos e automação em segundo plano onde o custo-por-pedido e o débito dominam sobre a profundidade de raciocínio bruta.
  • Arquiteturas de roteamento de modelos: o nível inferior de uma escada de escalonamento Sol > Terra > Luna. Use a Luna por padrão, escale para Terra ou Sol quando a pontuação de avaliação da Luna cair abaixo do limiar numa tarefa específica.

Não recomendado para

  • Restrita pelo governo sem acesso público: mesma restrição de pré-visualização limitada. A proposta de valor da Luna é clara no papel, mas não existe verificação independente.
  • Pontuação CTF de 85,19% é a mais baixa da família — sólida mas não dominante. Para fluxos de trabalho de segurança crítica, Terra ou Sol são o nível apropriado.
  • Falta a profundidade de segurança de Sol e Terra: sem classificadores de ativação na Luna (conforme o system card). Para fluxos de trabalho cibernéticos e biológicos regulados, use Terra ou Sol com a stack de monitorização completa.
  • A $1/$6, a Luna é competitiva mas não o modelo mais barato do mercado — GLM-5.2 ($1,40/$4,40) e DeepSeek V4 Pro ($0,44/$0,87) oferecem preços de saída mais baixos para níveis de capacidade semelhantes.

Desempenho por tarefa

Codificação agêntica de alto volume (orçamento)

Very Good

82,5% no TerminalBench 2.1 está apenas 0,9 atrás do GPT-5.5. Notável para um nível de orçamento. Encaminhe tarefas de código de rotina para Luna, escale as complexas.

Classificação e extração

Excellent

O modelo ideal para tarefas baratas de alto débito. Classificação, extração de entidades, sentimento, roteamento e formatação a $1/$6 é a vitória económica da família GPT-5.6.

Sumarização e redação

Very Good

Rápido e acessível para sumarização de documentos, redação de emails, geração de relatórios e fluxos de conteúdo onde a velocidade importa mais que a precisão extrema.

Cibersegurança

Good

CTF 85,19% é sólido para um modelo de orçamento mas fica atrás de Terra (91,84%) e Sol (96,7%). Sem classificadores de ativação. Não é o nível certo para trabalho de segurança crítica.

Raciocínio complexo e investigação profunda

Fair

Nível de orçamento sem modos de raciocínio máximo ou ultra. Para problemas difíceis, encaminhe para Sol. Para raciocínio do dia a dia, Terra. Luna é para volume, não profundidade.

Preços

Entrada

$1 / 1M tokens

Saída

$6 / 1M tokens

Contexto

Fastest and most cost-efficient GPT-5.6 tier.

Ver preços completos

Testes de desempenho

TestePontuaçãoFonte
TerminalBench 2.182.5% Fonte
Internal CTF (capture-the-flag)85.19% Fonte

Histórico de veredictos

16/07/2026
copy edit to brevity standard, detail preserved in children — Density rewrite: compressed 176w/9s to ~70w/3s per the 55–90w verdict_summary standard. Benchmark scores, pricing detail, audience fit, and per-task ratings remain in strengths[], benchmarks[], task_strengths[], and verdict_audiences[].

Registo de verificação

  • Preços— Sem alterações

    Agente automatizado

  • Preços— Sem alterações

    Agente automatizado

  • Estado— Atualizado

    Agente automatizado

    Summary re-dated to Jul 7 2026 and made explicit about what is awaited: stays pending pending GA + independent benchmarks; still government-gated (~20 orgs); family trending toward release (~Jul 9 GA per prediction markets, unconfirmed). Verdict unchanged (pending).

  • Preços— Sem alterações

    Agente automatizado

  • Preços— Sem alterações

    Agente automatizado

    Pricing unchanged: $1/$6 per 1M tokens. Government-gated. Confirmed by OpenAI blog.

  • Perfil— Sem alterações

    Importado no lançamento

  • Preços— Sem alterações

    Importado no lançamento

Como avaliamos