AISI do Reino Unido Confirma: GPT-5.6 Sol e Fable 5 Compartilham Risco Cibernético Idêntico
- O que aconteceu
- The UK's AI Security Institute confirmed GPT-5.6 Sol has the same cyber vulnerabilities as Fable 5 — and found a universal jailbreak potentially more serious than the one that triggered Fable 5's 19-day ban.
- Porque é importante
- The US banned Fable 5 for 19 days over the same risk profile. GPT-5.6 Sol launched globally with no restrictions. The government-gating asymmetry now has an official safety evaluation as evidence — published in OpenAI's own System Card.
- O que fazer
- Re-evaluate any procurement or policy decisions that assume one frontier model is inherently safer than another. Test models directly — don't rely on government gating as a safety proxy.
O Instituto de Segurança de IA do Reino Unido confirmou em 9 de julho — em descobertas publicadas no próprio System Card do GPT-5.6(abre num novo separador) da OpenAI — que o GPT-5.6 Sol carrega as mesmas vulnerabilidades cibernéticas que o Fable 5 da Anthropic. O jailbreak descoberto pelo AISI pode ser ainda pior: os pesquisadores o descreveram como "universal" e disseram que ele permite exploits autônomos, não apenas identificação de vulnerabilidades. A descoberta expõe uma assimetria regulatória que não pode mais ser justificada pelo risco: o Fable 5 foi banido do acesso internacional por 19 dias pelo mesmo perfil de vulnerabilidade, enquanto o GPT-5.6 Sol foi lançado globalmente sem restrição alguma.
O que aconteceu — Descobertas do jailbreak do GPT-5.6 Sol pelo AISI
Pesquisadores do governo britânico no Instituto de Segurança de IA do Reino Unido (AISI) identificaram o que chamaram de "jailbreaks universais no domínio cibernético" no GPT-5.6 Sol, incluindo jailbreaks que "permitiram a conclusão de tarefas agênticas de longa duração em domínios como descoberta de vulnerabilidades e desenvolvimento de exploits" (System Card do GPT-5.6(abre num novo separador), 9 de julho de 2026). Em termos simples: eles fizeram jailbreak do modelo e o fizeram encontrar vulnerabilidades de software e hackear sistemas de forma autônoma.
O jailbreak é descrito como "de propósito geral" — ele permite exploits autônomos, não apenas identificação de vulnerabilidades. O AISI observou que isso é potencialmente mais grave do que o jailbreak encontrado no Fable 5, que a equipe de descoberta da Amazon descreveu como capaz apenas de encontrar vulnerabilidades, sem exploração autônoma (Fortune(abre num novo separador), 10 de julho de 2026). Esse jailbreak do Fable 5 provocou uma proibição de 19 dias pelo governo dos EUA em junho.
A OpenAI reconheceu as descobertas, mas minimizou sua gravidade para usuários comuns. A empresa observou que os pesquisadores do AISI tinham "acesso privilegiado aos mecanismos internos do sistema, o que lhes permitiu acelerar o processo de hacking". No entanto, Xander Davies, que lidera a equipe de red team do AISI, postou no X que acreditava que os jailbreaks descobertos por sua equipe "ainda são encontráveis sem esse acesso, apenas mais lentamente" (Fortune(abre num novo separador), 2026).
A OpenAI fez referência ao seu blog de lançamento do GPT-5.6, que afirma que "a segurança perfeita não existe" e que a empresa adota uma abordagem "multicamadas", incluindo monitoramento contínuo e correção rápida. Margaret Cunningham, VP de segurança na DarkTrace e colaboradora especialista do NIST, ofereceu a avaliação mais sensata: "Minha preocupação é menos que um modelo tenha sofrido jailbreak e mais que a descoberta ofensiva está acelerando enquanto a defesa ainda depende de processos muito humanos" (Fortune(abre num novo separador), 2026).
Stanislav Fort, cientista-chefe da startup de cibersegurança de IA AISLE e ex-pesquisador tanto na Anthropic quanto no Google DeepMind, resumiu a realidade desconfortável: "Todo modelo implantado neste momento quase certamente tem jailbreaks não descobertos, então isso é tristemente verdadeiro para tudo, não apenas para o GPT-5.6" (Fortune(abre num novo separador), 2026).
Por que isso importa
O argumento da contenção por restrição — a ideia de que podemos tornar o mundo mais seguro bloqueando modelos específicos — foi agora invalidado empiricamente pelo próprio instituto de segurança projetado para validá-lo. Os números contam a história:
| Modelo | Perfil de vulnerabilidade | Ação do governo | Acesso atual |
|---|---|---|---|
| Fable 5 | Capacidade de exploit cibernético | Banido por 19 dias (12 jun–1 jul) | Apenas créditos, $10/$50 por 1M tokens |
| GPT-5.6 Sol | Mesmas vulnerabilidades (confirmado pelo AISI) | Sem restrições | Incluso na assinatura, $5/$30 por 1M tokens |
Ambos os modelos representam risco cibernético equivalente. Apenas um foi bloqueado. O outro foi lançado globalmente com acesso incluso na assinatura a um preço mais baixo.
Essa assimetria importa porque expõe o marco de controle de exportações do governo como reativo e inconsistente, e não calibrado por risco. Quando o governo dos EUA afirma restringir modelos com base no risco à segurança nacional, os dados do AISI — publicados no próprio System Card da OpenAI — agora mostram o mesmo perfil de risco recebendo tratamento oposto. Ou o padrão é equivalência de vulnerabilidade — caso em que ambos deveriam ter sido restringidos — ou a proibição do Fable 5 foi um erro. O governo não fez nenhuma das duas coisas.
Lennart Heim, pesquisador de políticas de IA, capturou o absurdo com um post no X: "ainda bem que a Amazon não reportou este para a Casa Branca" — uma referência a como o governo Trump soube do jailbreak do Fable 5 pela equipe de descoberta da Amazon. Um ex-assessor de políticas de IA disse à Fortune: "O que estamos vendo recentemente cria uma incerteza que é prejudicial na melhor das hipóteses e potencialmente levanta a questão de saber se, intencional ou não, os EUA estão aplicando um padrão inconsistente a diferentes laboratórios de IA" (Fortune(abre num novo separador), 2026).
Para organizações que dependem da aprovação governamental como sinal de segurança, essa descoberta deve desencadear uma reavaliação imediata. Se dois modelos com perfis de vulnerabilidade idênticos recebem tratamento regulatório diferente, o próprio tratamento regulatório não é um indicador confiável de segurança.
O que muda para você
Reavalie as decisões de aquisição. Não presuma que um modelo que passou pela revisão do governo é inerentemente mais seguro do que um que não passou. Os dados do AISI mostram que eles são equivalentemente vulneráveis — apenas o tratamento regulatório difere.
Teste diretamente. Se sua organização usa modelos de IA para trabalho sensível à segurança, teste ambos os modelos contra seu próprio modelo de ameaças, em vez de depender da aprovação governamental como indicador de segurança. A observação de Stanislav Fort — de que todo modelo implantado quase certamente tem jailbreaks não descobertos — deve ser sua premissa de base.
Observe a resposta política. Dois modelos igualmente vulneráveis recebendo tratamento regulatório oposto cria uma tensão política que não pode se sustentar. Ou as restrições se endurecem para todos os modelos de fronteira, ou o marco regulatório desmorona sob sua própria inconsistência. Ambos os cenários mudam o cálculo de aquisição.
FAQ
Isso significa que o GPT-5.6 Sol é inseguro? Não de forma única — esse é o ponto. A descoberta do AISI confirma que a equivalência de vulnerabilidade é o piso para modelos de fronteira. O GPT-5.6 Sol não é nem mais nem menos perigoso que o Fable 5 em termos de cibersegurança. Todo modelo neste patamar carrega jailbreaks não detectados.
O que minha equipe de segurança deve fazer? Trate todos os modelos de fronteira como igualmente arriscados para cargas de trabalho sensíveis à cibersegurança. Incorpore seus próprios testes nos fluxos de trabalho de aquisição, em vez de terceirizar julgamentos de segurança para decisões de controle governamental.
UK AISI confirms GPT-5.6 Sol carries equivalent cyber vulnerabilities to Fable 5 — every frontier model shares this risk, which does not diminish Sol's coding and cost advantages. Vulnerability equivalence is now table stakes for frontier models; the verdict moves from Pending to Recommended.
O que fazer
- 1 Re-evaluate any procurement or policy decisions that assume one frontier model is inherently safer than another
- 2 If your organization uses AI models for security-sensitive work, test both — don't rely on government gating as a safety proxy
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.