GPT-5.6 Terra logo

GPT-5.6 Terra

OpenAI · Lançado 06/2026

pending

O cavalo de batalha de nível médio do GPT-5.6 — capacidade de classe GPT-5.5 pela metade do preço ($2,50/$15 por 1M de tokens), com TerminalBench 2.1 em 84,3% empatando com Claude Fable 5. A ressalva: todas as alegações são fornecidas pelo fornecedor, a Terra está restrita a ~20 parceiros e não há data de GA confirmada. Para a maioria das cargas de trabalho em produção, a Terra seria a opção pragmática padrão quando disponível; GPT-5.5 e Opus 4.8 são as alternativas atuais.

É adequada para ti?

Bom para

  • Ponto ideal de custo-eficiência: capacidade de classe GPT-5.5 a metade do preço. A $2,50/$15 por 1M tokens, a Terra está posicionada para substituir o GPT-5.5 como modelo padrão para a maioria das cargas de produção — se a alegação de qualidade se confirmar.
  • TerminalBench 2.1 com 84,3% empata com Claude Fable 5 — o carro-chefe publicamente disponível da Anthropic — na mesma pontuação. Para codificação agêntica que não precisa da profundidade extrema de raciocínio do Sol, a Terra é a escolha racional.
  • Cargas de trabalho empresariais de alto volume: suporte ao cliente, ferramentas internas, análise de documentos e pipelines de produção onde a fiabilidade importa mas o custo por pedido precisa de escalar.
  • Forte capacidade de cibersegurança para o seu nível: obteve 91,84% nos testes CTF internos. Possui classificadores de ativação e a mesma stack de segurança do Sol para fluxos de trabalho cibernéticos e biológicos regulados.

Não recomendado para

  • Pré-visualização limitada com restrição governamental: mesmas restrições de acesso que o Sol — apenas ~20 parceiros confiáveis hoje. As alegações de 'desempenho GPT-5.5 a metade do custo' são fornecidas pelo fornecedor, não verificáveis independentemente.
  • Sem modos de raciocínio ultra ou máximo: a Terra carece da decomposição por subagentes e deliberação prolongada que distinguem o Sol. Para o trabalho agêntico mais difícil, ainda precisa do Sol.
  • A pontuação de 84,3% no TerminalBench está apenas 0,9 pontos à frente do GPT-5.5 com 83,4%. A alegação 'competitiva com GPT-5.5' está direcionalmente certa mas a diferença é pequena — as suas próprias avaliações dir-lhe-ão mais do que o placar.

Desempenho por tarefa

Codificação agêntica (nível médio)

Very Good

84,3% no TerminalBench 2.1 empata com Claude Fable 5. Suficientemente forte para a maioria dos agentes de codificação em produção. Sol é a atualização para os problemas mais difíceis.

Cibersegurança

Very Good

Pontuação CTF de 91,84%. Capacidades de segurança robustas com classificadores de ativação. Bom para fluxos de trabalho defensivos e análise de vulnerabilidades sem o premium do Sol.

Cargas de produção custo-eficientes

Excellent

A $2,50/$15 por 1M, a Terra tem a melhor relação custo-capacidade na família GPT-5.6. A alegação da OpenAI de desempenho GPT-5.5 a metade do custo é o título comercialmente mais importante para a maioria das equipas.

Raciocínio geral e trabalho diário

Very Good

Posicionado como o modelo equilibrado do dia a dia. Para raciocínio de rotina, escrita, análise e business intelligence, a Terra deve ser indistinguível do Sol em qualidade.

Investigação profunda e raciocínio complexo

Good

Carece dos modos de raciocínio máximo e ultra com subagentes do Sol. Fica atrás do Sol, Mythos 5 e Fable 5 nos problemas mais difíceis. Encaminhe tarefas difíceis para Sol, não para Terra.

Preços

Entrada

$2.50 / 1M tokens

Saída

$15 / 1M tokens

Contexto

Roughly 2x cheaper than GPT-5.5 for similar perf.

Ver preços completos

Testes de desempenho

TestePontuaçãoFonte
TerminalBench 2.184.3% Fonte
Internal CTF (capture-the-flag)91.84% Fonte

Histórico de veredictos

16/07/2026
copy edit to brevity standard, detail preserved in children — Density rewrite: compressed 157w/10s to ~85w/3s per the 55–90w verdict_summary standard. Benchmark scores, pricing tiers, audience fit, and per-task ratings remain in strengths[], benchmarks[], task_strengths[], and verdict_audiences[].

Registo de verificação

  • Preços— Sem alterações

    Agente automatizado

  • Preços— Sem alterações

    Agente automatizado

  • Estado— Atualizado

    Agente automatizado

    Summary re-dated to Jul 7 2026 and made explicit about what is awaited: stays pending pending GA + independent benchmarks; still government-gated (~20 orgs); family trending toward release (Sol Ultra confirmed for Codex Jul 6, ~Jul 9 GA per prediction markets, unconfirmed). Verdict unchanged (pending).

  • Preços— Sem alterações

    Agente automatizado

  • Preços— Sem alterações

    Agente automatizado

    Pricing unchanged: $2.50/$15 per 1M tokens. Government-gated. Confirmed by OpenAI blog (GPT-5.5-class at half cost).

  • Perfil— Sem alterações

    Importado no lançamento

  • Preços— Sem alterações

    Importado no lançamento

Como avaliamos