Correção: não conseguimos apontar a fonte dos números do Intelligence Index no nosso veredito sobre o Astra, por isso vamos removê-los
- O que aconteceu
- We cannot source the three Artificial Analysis Intelligence Index figures our Astra verdict quoted (61.2 for Astra, 65.7 for Fable 5.1, 63.1 for Opus 5), so we are removing them and the third-place ranking built on them.
- Porque é importante
- That ranking was the lead condition on a buying recommendation, and an unsourceable benchmark inside a published verdict is a fabrication risk.
- O que fazer
- Re-run any Astra decision that rested on the third-place ranking. The verdict stays conditional on two constraints: EU data residency blocks Fast mode, and OpenAI disclosed decreased monitorability versus GPT-5.6 Sol.
O Astra mantém-se condicional. A avaliação não muda. O que muda é a evidência que a sustenta: três números de benchmark que publicámos vão sair, porque não conseguimos apontar a sua fonte.
O que aconteceu
A 4 de setembro publicámos a nossa cobertura do lançamento do GPT-6 Astra e movemos o Astra de pendente para condicional. A condição principal era «terceiro em inteligência geral» e assentava em três números que atribuímos à própria tabela comparativa de lançamento da OpenAI: um Artificial Analysis Intelligence Index de 61,2 para o Astra, 65,7 para o Claude Fable 5.1 e 63,1 para o Claude Opus 5.
Fomos à procura dessa tabela a 9 de setembro e voltámos a obter todas as páginas envolvidas. Não está onde dissemos que estava.
- A Artificial Analysis publica números diferentes e com outro formato. O seu próprio artigo sobre o Fable 5.1 atribui-lhe 66 em esforço máximo, o que descreve como a pontuação mais alta que já mediu, e dá 63 ao Opus 5 em esforço máximo. O GPT-5.6 Sol fica em 61. Números inteiros, esforço máximo. O Astra não aparece de todo nesse artigo.
- A página do modelo GPT-6 Astra da OpenAI traz as especificações e a tabela de tarifas, e nenhuma comparação de benchmark de qualquer tipo. Nenhum valor de índice, nenhuma coluna de rivais.
- O changelog da API da OpenAI descreve o Astra como «o nosso modelo mais capaz, construído para o trabalho ponta a ponta mais difícil» e não publica nenhuma tabela de benchmarks.
- O artigo de lançamento no blogue da OpenAI devolve HTTP 403 ao nosso fetcher. É bem possível que exista uma tabela comparativa nessa página. Não a conseguimos ler, por isso não a vamos citar. A nossa lista de fontes, mais abaixo, ainda descreve essa página como tendo tabelas de benchmarks, uma descrição que vem do nosso primeiro registo; também já não podemos responder por ela.
As duas do meio são as fontes primárias que a nossa própria entrada do Astra cita. Nenhuma delas contém a tabela a que atribuímos os números.
Por isso os três números saem, e a classificação de «terceiro em inteligência geral» construída sobre eles sai com eles. Não vamos colocar os números da Artificial Analysis acima como substituto: são pontuações em esforço máximo de dois modelos rivais, e não existe nenhuma pontuação publicada do Astra para as comparar.
Porque isto importa
Uma classificação de benchmark sem fonte possível dentro de um veredito publicado é exatamente a falha que existimos para evitar, e esta era estrutural. «Terceiro em inteligência geral» era a primeira condição de uma recomendação de compra. É a linha que dizia aos leitores para desviarem do Astra o raciocínio geral.
Um veredito com um motivo a menos vale mais do que um veredito com um motivo inventado. Os números aparecem também no nosso artigo de 4 de setembro e no respetivo resumo. Este aviso retira-os também aí.
O que muda para si
O Astra mantém-se condicional. Duas condições sustentam-no aí, e somos explícitos sobre a solidez de cada uma hoje.
| Condição | Estado da evidência |
|---|---|
| O modo Fast está indisponível sob residência de dados na UE | Reverificado hoje. A documentação de preços da OpenAI afirma-o nesses termos e encaminha os pedidos com residência na UE para processamento Standard |
| A monitorabilidade diminuiu face ao GPT-5.6 Sol | Transposto do registo anterior, não reverificado. Vem da visão geral de segurança do Astra da OpenAI, que lemos a 4 de setembro; hoje essa página devolve 403 ao nosso fetcher |
Reverificado hoje na documentação da própria OpenAI e sem alterações: US$ 10 de entrada e US$ 50 de saída por 1 milhão de tokens em contexto curto, US$ 20/US$ 75 em contexto longo, modo Fast a US$ 20/US$ 100 e US$ 40/US$ 150. Janela de contexto de 1.050.000 tokens, saída máxima de 128.000.
Se excluiu o Astra porque o classificámos em terceiro, esse motivo desapareceu. Refaça a decisão com o que sobra: um especialista em uso de computador, terminal e contexto longo, a preço de fronteira, sem qualquer pontuação de inteligência geral independente do fornecedor publicada a seu respeito.
Perguntas frequentes
O veredito mudou? Não. O Astra era condicional antes desta correção e continua condicional depois dela. O que muda é a evidência: o resumo do veredito em vigor perde os valores do índice e a classificação em terceiro lugar, e mantém as duas condições acima.
Porque não publicar simplesmente os números da Artificial Analysis? Porque não respondem à pergunta que fizemos. A Artificial Analysis não publicou nenhuma pontuação do Astra, por isso os seus 66 e 63 comparam o Fable 5.1 e o Opus 5 entre si, não com o Astra. Substituir um conjunto de números por outro repetiria o erro original com fontes mais arrumadas.
Então de onde vieram 61,2, 65,7 e 63,1? Não sabemos, e é esse o problema. A nossa própria cobertura atribuiu-os à tabela comparativa de lançamento da OpenAI. Essa página é ilegível para nós, e nenhuma das páginas da OpenAI ou da Artificial Analysis que conseguimos ler os contém. Enquanto ninguém apontar uma fonte acessível, tratamos os três como não fundamentados.
Devo continuar a evitar o Astra para raciocínio geral? Isso passa a ser uma questão de critério, e não algo que os nossos dados resolvam. O Claude Opus 5 e o Claude Fable 5.1 detêm as duas pontuações mais altas da Artificial Analysis que conseguimos verificar. O Astra não tem nenhuma. A ausência de uma pontuação não é prova de uma pontuação baixa.
The Artificial Analysis Intelligence Index figures (61.2 / 65.7 / 63.1) and the third-place general-intelligence ranking could not be sourced against Artificial Analysis or either OpenAI primary cited on the entity, and are removed from the standing verdict. The rating holds at conditional on two constraints: Fast mode is unavailable under EU data residency (re-verified 2026-09-09), and OpenAI disclosed decreased monitorability versus GPT-5.6 Sol (read 2026-09-04, page unreadable today).
O que fazer
- 1 If you ruled Astra out on the strength of a third-place intelligence ranking, re-run that decision. The ranking is withdrawn and we have no replacement figure to offer.
- 2 If you quoted our 61.2 / 65.7 / 63.1 figures in an internal model-selection doc, strike them.
- 3 If you operate under EU data residency, treat Fast mode as unavailable on Astra and budget the Standard tier at $10/$50 per 1M tokens short context.
- 4 Budget long-context Astra work at $20/$75 per 1M tokens, double the short-context rate.
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.