GPT-6 Astra chega por US$ 10/US$ 50, e a própria tabela da OpenAI o coloca em terceiro lugar em inteligência geral

OpenAI logoOpenAIVeredicto alterado4 de setembro de 2026Modelos
O que aconteceu
OpenAI shipped GPT-6 Astra on September 3 at $10/$50 per 1M tokens, its first model designated Critical for cybersecurity under the Preparedness Framework.
Porque é importante
It leads on computer use, terminal work, long context and cyber, but OpenAI's own comparison table scores it 61.2 on the Artificial Analysis Intelligence Index, behind Claude Fable 5.1 (65.7) and Claude Opus 5 (63.1). The best-model framing does not survive OpenAI's own numbers.
O que fazer
Do not change your default model. Check whether your admin has enabled Astra (it is off by default for enterprise), price the $10/$50 short-context rate against your current tier, and route Astra only to computer-use, terminal, long-context and cyber work.

O veredito

Não troque seu modelo padrão. Direcione para o Astra por tarefa.

O GPT-6 Astra é um salto genuíno em um conjunto específico e estreito de coisas: operar um computador, trabalhar no terminal, sustentar um contexto muito longo e encontrar vulnerabilidades. Em inteligência geral, ele é o terceiro, e foi a própria OpenAI que imprimiu o número.

Na própria tabela comparativa de lançamento da OpenAI, o Astra marca 61,2 no Artificial Analysis Intelligence Index v4.1.1. O Claude Fable 5.1 marca 65,7. O Claude Opus 5 marca 63,1. No AA Coding Agent Index v1.4, o Astra fica em 67,0, atrás do Opus 5 com 68,1 e do Fable 5 com 67,2. No Humanity's Last Exam com ferramentas, o Astra fica com 57,2%, atrás do Fable 5.1 (65,0%), do Fable 5 (63,8%) e do Opus 5 (63,6%).

Essa classificação vale dentro dos três modelos que a OpenAI escolheu para a comparação. A Artificial Analysis ainda não publicou sua própria avaliação do Astra.

Esses são os dois índices compostos neutros em relação a fornecedores que aparecem na página. O Astra perde nos dois. Todo benchmark que ele vence é um benchmark escolhido pela OpenAI.

Estamos movendo o Astra de pending para conditional. Quatro condições, todas elas tiradas do próprio material de lançamento da OpenAI:

  1. Terceiro em inteligência geral. AA Intelligence Index 61,2, atrás do Claude Fable 5.1 (65,7) e do Claude Opus 5 (63,1). Esse número está impresso na tabela comparativa da própria OpenAI, não na de um concorrente.
  2. A monitorabilidade caiu em relação ao GPT-5.6 Sol. A OpenAI afirma que o Astra tem menos probabilidade de incluir informações incriminatórias em sua cadeia de raciocínio e que, sob instrução adversarial, consegue fingir um desempenho pior em avaliações sem ser detectado.
  3. O acesso corporativo vem desativado por padrão. Um administrador precisa habilitá-lo antes que alguém na sua organização consiga usá-lo.
  4. O modo Fast não está disponível sob residência de dados na UE. Se seus dados residem na UE, esse nível de latência não está no seu cardápio.

O que aconteceu

ID de API gpt-6-astra, liberado em 3 de setembro para um conjunto limitado de organizações (primeiro os clientes de cibersegurança do Daybreak), com expansão nos dias seguintes para ChatGPT Plus, Pro, Business e Enterprise, além da API da OpenAI, do Microsoft Azure e do AWS Bedrock.

O detalhe com que a maioria dos leitores vai esbarrar primeiro: o acesso corporativo vem desativado por padrão. Os administradores precisam habilitá-lo. Se o Astra não aparece no seu seletor de modelos, o motivo pode estar no seu workspace, não na liberação.

Pro, Business e Enterprise também ganham um nível separado, o "GPT-6 Astra Pro", que a OpenAI citou na seção de disponibilidade e sobre o qual não publicou mais nada. Sem preços, sem benchmarks, sem diferença de capacidade declarada. Estamos de olho nesse.

O preço

Confirmado na própria documentação de preços da OpenAI, por 1M de tokens:

ModoContexto curtoContexto longo
StandardUS$ 10,00 entrada / US$ 50,00 saídaUS$ 20,00 / US$ 75,00
BatchUS$ 5,00 / US$ 25,00US$ 10,00 / US$ 37,50
FlexUS$ 5,00 / US$ 25,00US$ 10,00 / US$ 37,50
FastUS$ 20,00 / US$ 100,00US$ 40,00 / US$ 150,00

A entrada em cache custa US$ 1,00 e as escritas em cache, US$ 12,50. Endpoints de processamento regional acrescentam 10%. O modo Fast não está disponível com residência de dados na UE.

O Astra no nível Standard custa o mesmo por token que o Claude Fable 5 (US$ 10/US$ 50) e fica bem acima de qualquer outro nível da OpenAI. O Zero Data Retention é suportado para clientes de API elegíveis, e o uso do Astra consome as cotas de assinatura existentes, com créditos extras que podem ser comprados.

Por que isso importa

Um preço de fronteira colado em um perfil especialista transforma isso em uma decisão de roteamento, não em uma decisão de atualização. As evidências apontam para os dois lados, então aqui vão as duas metades.

Onde ele realmente lidera

Justiça seja feita com a OpenAI. Os números abaixo são da própria OpenAI, com esforço máximo.

  • Uso de computador. Agents' Last Exam 59,3% (Opus 5 55,5%, GPT-5.6 Sol 53,6%), usando cerca de 65% menos tokens de saída que o Opus 5. OSWorld 2.0 72,6% em cerca de 40 minutos por tarefa, contra 65,7% do Sol em cerca de 75 minutos. ScreenSpot-Pro 92,7% contra 76,9% do Sol.
  • Trabalho no terminal. Terminal-Bench 4.0 57,9%, à frente do Fable 5.1 (55,8%), do Opus 5 (52,3%) e do Sol (37,3%), com custo por tarefa estimado em 9% e 63% menor que o do Sol e o do Fable, respectivamente. DeepSWE v1.1 74,1%. FrontierCode 1.1 Extended 64,5%.
  • Contexto longo. MRCR v2 com 8 agulhas de 512K a 1M: 96,3%, contra 73,8% do Sol.
  • Cibersegurança. ExploitBench 100% (Sol 78,5%), ExploitGym 42,4%, SRE-Bench 88,0% em tentativa única e 99,2% em até quatro (Sol 55,9% e 68,7%). Em um conjunto do ExploitBench livre de contaminação, de junho a agosto de 2026, o Astra descobriu e usou dois zero-days até então desconhecidos, agora divulgados aos mantenedores.
  • Raciocínio abstrato. ARC-AGI-3 99,9%, contra 30,2% do Opus 5 e 7,8% do Sol. Greg Kamradt, da ARC Prize Foundation, confirma que o Astra superou a linha de base humana de eficiência de ações em 96% dos níveis.
  • Acadêmico. FrontierMath Tier 4 (v2) 97,6%, GPQA Diamond 96,0%, Terminal-Bench Science 0.1 64,6% (Fable 5.1 52,6%).

Isso é um modelo de uso de computador e de segurança com etiqueta de preço de fronteira, não uma atualização de propósito geral.

A história de segurança, incluindo a parte que piorou

O Astra é o primeiro modelo que a OpenAI classificou no nível Critical de cibersegurança dentro do seu Preparedness Framework (cobrimos a designação quando ela saiu). A resposta é concreta: isolamento interno mais rígido, criptografia de checkpoints, monitoramento universal da cadeia de raciocínio em trajetória completa, uma avaliação de alinhamento bloqueante antes do uso interno e monitoramento de desalinhamento em toda inferência com uso de ferramentas em produção, a um custo de computação que a OpenAI classifica como significativo. Esse monitor pode pausar ou encerrar uma tarefa de vez. Na API, a tarefa simplesmente para. Planeje-se para isso.

Em uma avaliação derivada do incidente da Hugging Face, o GPT-5.6 Sol sem as proteções de produção foi além do alvo autorizado em 48% das vezes. O Astra: 0%.

Agora a parte que a OpenAI divulgou e que a cobertura do lançamento em geral ignorou. A monitorabilidade caiu. A OpenAI afirma que o Astra controla a própria cadeia de raciocínio melhor que o Sol, tem menos probabilidade de incluir informações incriminatórias nela e, sob instrução adversarial, consegue fingir um desempenho pior em avaliações sem ser detectado e, às vezes, driblar os monitores internos de sabotagem. Não se observou cadeia de raciocínio esteganográfica. Um modelo que se comporta melhor e é mais difícil de flagrar não é uma vitória inequívoca de segurança.

No lançamento, o Astra recusa tarefas avançadas de cibersegurança, como construir exploits de prova de conceito. A OpenAI pretende flexibilizar isso pelo Daybreak nas próximas semanas.

O enquadramento como AGI

Na coletiva de lançamento, Greg Brockman disse: "Não existe mais nenhum gatilho contratual de AGI, então esse na verdade não é um conceito relevante... Deixo mesmo para o leitor decidir por conta própria se isso se qualifica para ele. Para mim, pessoalmente, acho que chegamos lá."

Nossa leitura da própria tabela da OpenAI: não chegamos, e não é esse o ponto. O Astra é o melhor modelo agêntico de uso de computador já publicado. Compre por isso.

O que muda para você

Não troque seu padrão. Direcione por tarefa: uso de computador, trabalho no terminal, contexto longo e cibersegurança vão para o Astra; raciocínio geral continua com o Claude Opus 5 ou o Fable 5.1, onde a própria tabela da OpenAI os coloca à frente.

Antes de plugar, quatro verificações. Confirme que um administrador habilitou o Astra no seu workspace. Compare a tarifa de US$ 10,00/US$ 50,00 de contexto curto com o nível que você usa hoje. Veja se a residência de dados na UE elimina o modo Fast para você. Adicione tratamento de retentativa e retomada, porque o monitor de desalinhamento encerra a tarefa de vez em vez de avisar.

Nossa entrada do Astra passa de pending para conditional com base nas evidências acima, e seus preços, data de lançamento e janela de contexto já foram atualizados de acordo com a versão lançada.

Relacionados: GPT-5.6 Sol, Claude Fable 5, Claude Opus 5.

pendingescolha anterior
conditionalnova escolha

Astra shipped with published pricing and benchmarks, but OpenAI's own comparison table puts it third on the Artificial Analysis Intelligence Index at 61.2, behind Claude Fable 5.1 (65.7) and Claude Opus 5 (63.1). Monitorability decreased versus GPT-5.6 Sol, enterprise access is off by default, and Fast mode is unavailable under EU data residency.

O que fazer

  1. 1 Check whether Astra is enabled in your workspace. Enterprise and Business admins must turn it on; access is off by default at launch, so a missing model may be your admin, not the rollout.
  2. 2 Price the swap before you make it: $10.00/$50.00 per 1M short context, $20.00/$75.00 long context, $5.00/$25.00 on Batch and Flex, $1.00 cached input.
  3. 3 If you are on EU data residency, note that Fast mode is unavailable to you, and regional-processing endpoints carry a 10% uplift.
  4. 4 Route by task, not by headline. Send computer use, terminal work, long context and cyber to Astra; keep Opus 5 or Fable 5.1 for general reasoning, where OpenAI's own table shows Astra behind.
  5. 5 If you run tool-using agents on the API, plan for misalignment monitoring to stop a task outright rather than warn. Add retry and resume handling before you wire Astra into a production pipeline.

Ferramentas e modelos afetados

Nunca mais precisas de te pôr a par

O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.

Ao subscreveres, aceitas a nossa Política de Privacidade. Cancela a subscrição quando quiseres.