El Instituto de Seguridad de IA del Reino Unido confirma que GPT-5.6 Sol tiene las mismas vulnerabilidades cibernéticas que Fable 5
- Qué pasó
- The UK's AI Security Institute confirmed GPT-5.6 Sol has the same cyber vulnerabilities as Fable 5 — and found a universal jailbreak potentially more serious than the one that triggered Fable 5's 19-day ban.
- Por qué importa
- The US banned Fable 5 for 19 days over the same risk profile. GPT-5.6 Sol launched globally with no restrictions. The government-gating asymmetry now has an official safety evaluation as evidence — published in OpenAI's own System Card.
- Qué hacer
- Re-evaluate any procurement or policy decisions that assume one frontier model is inherently safer than another. Test models directly — don't rely on government gating as a safety proxy.
El Instituto de Seguridad de IA del Reino Unido confirmó el 9 de julio —en hallazgos publicados en la propia Tarjeta de Sistema de GPT-5.6(se abre en una pestaña nueva) de OpenAI— que GPT-5.6 Sol presenta las mismas vulnerabilidades cibernéticas que Fable 5 de Anthropic. El jailbreak descubierto por AISI podría ser incluso peor: los investigadores lo describieron como "universal" y afirmaron que permite exploits autónomos, no solo identificación de vulnerabilidades. El hallazgo expone una asimetría regulatoria que ya no puede justificarse por riesgo: Fable 5 estuvo vetado para acceso internacional durante 19 días por el mismo perfil de vulnerabilidad, mientras que GPT-5.6 Sol se lanzó globalmente sin restricción alguna.
Lo que ocurrió — Hallazgos del jailbreak de GPT-5.6 Sol por AISI
Investigadores del gobierno británico en el Instituto de Seguridad de IA del Reino Unido (AISI) identificaron lo que denominaron "jailbreaks universales en el dominio cibernético" en GPT-5.6 Sol, incluyendo jailbreaks que "permitieron la ejecución de tareas agentivas de larga duración en dominios como descubrimiento de vulnerabilidades y desarrollo de exploits" (Tarjeta de Sistema de GPT-5.6(se abre en una pestaña nueva), 9 de julio de 2026). En términos sencillos: lograron hacer jailbreak al modelo y consiguieron que encontrara vulnerabilidades de software y hackeara sistemas de forma autónoma.
El jailbreak se describe como "de propósito general" — permite exploits independientes, no solo identificación de vulnerabilidades. El AISI señaló que esto es potencialmente más grave que el jailbreak encontrado en Fable 5, que el equipo de descubrimiento de Amazon describió como limitado a la búsqueda de vulnerabilidades, sin explotación autónoma (Fortune(se abre en una pestaña nueva), 10 de julio de 2026). Ese jailbreak de Fable 5 provocó una prohibición de 19 días por parte del gobierno de EE. UU. en junio.
OpenAI reconoció los hallazgos pero restó importancia a su gravedad para los usuarios comunes. La empresa señaló que los investigadores del AISI tenían "acceso privilegiado a los mecanismos internos del sistema, lo que les permitió acelerar el proceso de hacking". Sin embargo, Xander Davies, quien lidera el equipo rojo del AISI, publicó en X que creía que los jailbreaks descubiertos por su equipo "siguen siendo encontrables sin ese acceso, solo que más lentamente" (Fortune(se abre en una pestaña nueva), 2026).
OpenAI hizo referencia a su blog de lanzamiento de GPT-5.6, que afirma que "la seguridad perfecta no existe" y que la empresa adopta un enfoque "multicapa" que incluye monitoreo continuo y corrección rápida. Margaret Cunningham, VP de seguridad en DarkTrace y colaboradora especialista de NIST, ofreció la valoración más sensata: "Mi preocupación no es tanto que se haya hecho jailbreak a un modelo, sino que el descubrimiento ofensivo se está acelerando mientras que la defensa aún depende de procesos muy humanos" (Fortune(se abre en una pestaña nueva), 2026).
Stanislav Fort, científico jefe de la startup de ciberseguridad de IA AISLE y exinvestigador tanto en Anthropic como en Google DeepMind, resumió la incómoda realidad: "Cada modelo desplegado en este momento casi con certeza tiene jailbreaks no descubiertos, así que tristemente esto aplica a todo, no solo a GPT-5.6" (Fortune(se abre en una pestaña nueva), 2026).
Por qué importa
El argumento de contención mediante restricción —la idea de que podemos hacer el mundo más seguro bloqueando modelos específicos— ha quedado empíricamente invalidado por el propio instituto de seguridad diseñado para validarlo. Los números cuentan la historia:
| Modelo | Perfil de vulnerabilidad | Acción gubernamental | Acceso actual |
|---|---|---|---|
| Fable 5 | Capacidad de exploit cibernético | Vetado 19 días (12 jun–1 jul) | Solo créditos, $10/$50 por 1M tokens |
| GPT-5.6 Sol | Mismas vulnerabilidades (AISI confirmado) | Sin restricciones | Incluido en suscripción, $5/$30 por 1M tokens |
Ambos modelos representan un riesgo cibernético equivalente. Solo uno fue bloqueado. El otro se lanzó globalmente con acceso incluido en la suscripción a un precio más bajo.
Esta asimetría importa porque expone el marco de control de exportaciones del gobierno como reactivo e inconsistente en lugar de calibrado por riesgo. Cuando el gobierno de EE. UU. afirma restringir modelos basándose en el riesgo a la seguridad nacional, los datos del AISI —publicados en la propia Tarjeta de Sistema de OpenAI— muestran ahora el mismo perfil de riesgo recibiendo tratamiento opuesto. O el estándar es la equivalencia de vulnerabilidad —en cuyo caso ambos deberían haber sido restringidos— o la prohibición de Fable 5 fue un error. El gobierno no ha hecho ninguna de las dos cosas.
Lennart Heim, investigador de políticas de IA, capturó el absurdo con una publicación en X: "menos mal que Amazon no reportó este a la Casa Blanca" — una referencia a cómo la administración Trump se enteró del jailbreak de Fable 5 a través del equipo de descubrimiento de Amazon. Un exasesor de políticas de IA dijo a Fortune: "Lo que estamos viendo recientemente crea una incertidumbre que es dañina en el mejor de los casos y potencialmente plantea la cuestión de si, intencional o no, EE. UU. está aplicando un estándar inconsistente a diferentes laboratorios de IA" (Fortune(se abre en una pestaña nueva), 2026).
Para las organizaciones que dependen de la aprobación gubernamental como señal de seguridad, este hallazgo debería desencadenar una reevaluación inmediata. Si dos modelos con perfiles de vulnerabilidad idénticos reciben tratamiento regulatorio diferente, el tratamiento regulatorio en sí mismo no es un indicador confiable de seguridad.
Lo que cambia para ti
Reevalúa las decisiones de adquisición. No asumas que un modelo que pasó la revisión gubernamental es inherentemente más seguro que uno que no. Los datos del AISI muestran que son equivalentemente vulnerables — solo difiere el tratamiento regulatorio.
Prueba directamente. Si tu organización utiliza modelos de IA para trabajo sensible a la seguridad, prueba ambos modelos contra tu propio modelo de amenazas en lugar de confiar en la aprobación gubernamental como indicador de seguridad. La observación de Stanislav Fort —de que cada modelo desplegado casi con certeza tiene jailbreaks no descubiertos— debería ser tu supuesto de referencia.
Observa la respuesta política. Dos modelos igualmente vulnerables recibiendo tratamiento regulatorio opuesto crea una tensión política que no puede sostenerse. O las restricciones se endurecen para todos los modelos frontera, o el marco colapsa bajo su propia inconsistencia. Ambos escenarios cambian el cálculo de adquisición.
FAQ
¿Significa esto que GPT-5.6 Sol es inseguro? No de forma única — ese es el punto. El hallazgo del AISI confirma que la equivalencia de vulnerabilidad es el mínimo común para los modelos frontera. GPT-5.6 Sol no es ni más ni menos peligroso que Fable 5 en términos de ciberseguridad. Cada modelo en este nivel tiene jailbreaks no detectados.
¿Qué debería hacer mi equipo de seguridad? Trata todos los modelos frontera como igualmente riesgosos para cargas de trabajo sensibles a la ciberseguridad. Incorpora tus propias pruebas en los flujos de trabajo de adquisición en lugar de delegar los juicios de seguridad a las decisiones gubernamentales.
UK AISI confirms GPT-5.6 Sol carries equivalent cyber vulnerabilities to Fable 5 — every frontier model shares this risk, which does not diminish Sol's coding and cost advantages. Vulnerability equivalence is now table stakes for frontier models; the verdict moves from Pending to Recommended.
Qué hacer
- 1 Re-evaluate any procurement or policy decisions that assume one frontier model is inherently safer than another
- 2 If your organization uses AI models for security-sensitive work, test both — don't rely on government gating as a safety proxy
Herramientas y modelos afectados
No vuelvas a tener que ponerte al día
El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.