L'UK AISI confirme : GPT-5.6 Sol et Fable 5 partagent le même risque cyber
- Ce qui s’est passé
- The UK's AI Security Institute confirmed GPT-5.6 Sol has the same cyber vulnerabilities as Fable 5 — and found a universal jailbreak potentially more serious than the one that triggered Fable 5's 19-day ban.
- Pourquoi c’est important
- The US banned Fable 5 for 19 days over the same risk profile. GPT-5.6 Sol launched globally with no restrictions. The government-gating asymmetry now has an official safety evaluation as evidence — published in OpenAI's own System Card.
- Que faire
- Re-evaluate any procurement or policy decisions that assume one frontier model is inherently safer than another. Test models directly — don't rely on government gating as a safety proxy.
L'UK AISI confirme : GPT-5.6 Sol et Fable 5 partagent le même risque cyber
L'Institut britannique pour la sécurité de l'IA (AISI) a confirmé le 9 juillet — dans des résultats publiés au sein même de la fiche système GPT-5.6 d'OpenAI(s’ouvre dans un nouvel onglet) — que GPT-5.6 Sol présente les mêmes vulnérabilités cyber que Fable 5 d'Anthropic. Le jailbreak découvert par l'AISI pourrait même être pire : les chercheurs l'ont qualifié d'« universel » et ont indiqué qu'il permet des exploits autonomes, pas seulement de l'identification de vulnérabilités. Cette découverte révèle une asymétrie réglementaire que le risque ne justifie plus : Fable 5 a été interdit d'accès à l'étranger pendant 19 jours pour le même profil de vulnérabilité, tandis que GPT-5.6 Sol a été lancé mondialement sans aucune restriction.
Ce qui s'est passé — les résultats du jailbreak de GPT-5.6 Sol par l'AISI
Les chercheurs du gouvernement britannique de l'Institut pour la sécurité de l'IA (AISI) ont identifié ce qu'ils ont appelé des « jailbreaks universels dans le domaine cyber » dans GPT-5.6 Sol, y compris des jailbreaks qui « permettraient l'exécution de tâches agentiques de longue durée dans des domaines comme la découverte de vulnérabilités et le développement d'exploits » (fiche système GPT-5.6(s’ouvre dans un nouvel onglet), 9 juillet 2026). En clair : ils ont jailbreaké le modèle et l'ont rendu capable de trouver des vulnérabilités logicielles et de pirater des systèmes de manière autonome.
Le jailbreak est décrit comme « universel » — il permet des exploits autonomes, pas seulement de l'identification de vulnérabilités. L'AISI note que c'est potentiellement plus grave que le jailbreak trouvé dans Fable 5, que l'équipe de découverte d'Amazon décrivait comme permettant uniquement la découverte de vulnérabilités, sans exploitation autonome (Fortune(s’ouvre dans un nouvel onglet), 10 juillet 2026). Ce jailbreak de Fable 5 avait déclenché une interdiction de 19 jours par le gouvernement américain en juin.
OpenAI a reconnu les résultats mais a minimisé leur gravité pour les utilisateurs ordinaires. L'entreprise a souligné que les chercheurs de l'AISI disposaient d'un « accès privilégié aux mécanismes internes du système, ce qui leur a permis d'accélérer le processus de piratage ». Cependant, Xander Davies, qui dirige la red team de l'AISI, a posté sur X qu'il pensait que les jailbreaks découverts par son équipe « sont toujours trouvables sans cet accès, mais plus lentement » (Fortune(s’ouvre dans un nouvel onglet), 2026).
OpenAI a fait référence à son article de lancement de GPT-5.6, qui affirme que « la sécurité parfaite n'existe pas » et que l'entreprise adopte une approche « multicouche » incluant une surveillance continue et une remédiation rapide. Margaret Cunningham, VP sécurité chez DarkTrace et collaboratrice spécialiste NIST, a livré l'analyse la plus lucide : « Mon inquiétude n'est pas qu'un modèle ait été jailbreaké, mais que la découverte offensive s'accélère pendant que la défense dépend encore de processus très humains » (Fortune(s’ouvre dans un nouvel onglet), 2026).
Stanislav Fort, scientifique en chef chez AISLE, une startup de cybersécurité IA, et ancien chercheur chez Anthropic et Google DeepMind, a résumé la réalité inconfortable : « Chaque modèle déployé aujourd'hui a presque certainement des jailbreaks non découverts, c'est donc malheureusement vrai pour tout le monde, pas seulement pour GPT-5.6 » (Fortune(s’ouvre dans un nouvel onglet), 2026).
Pourquoi c'est important
L'argument du confinement par la restriction — l'idée qu'on peut rendre le monde plus sûr en verrouillant des modèles spécifiques — vient d'être empiriquement invalidé par l'institut de sécurité même conçu pour le valider. Les chiffres racontent l'histoire :
| Modèle | Profil de vulnérabilité | Action gouvernementale | Accès actuel |
|---|---|---|---|
| Fable 5 | Capacité d'exploit cyber | Interdit 19 jours (12 juin–1er juil) | Crédits uniquement, 10 $/50 $ par 1M tokens |
| GPT-5.6 Sol | Mêmes vulnérabilités (AISI confirmé) | Aucune restriction | Inclus dans l'abonnement, 5 $/30 $ par 1M tokens |
Les deux modèles présentent un risque cyber équivalent. Un seul a été interdit. L'autre a été lancé mondialement avec un accès inclus dans l'abonnement à un tarif plus bas.
Cette asymétrie est importante car elle expose le cadre de contrôle des exportations du gouvernement comme réactif et incohérent plutôt que calibré sur le risque. Quand le gouvernement américain prétend restreindre des modèles pour des raisons de sécurité nationale, les données de l'AISI — publiées dans la fiche système d'OpenAI elle-même — montrent désormais un même profil de risque recevant un traitement opposé. Soit le standard est l'équivalence de vulnérabilité — auquel cas les deux auraient dû être restreints — soit l'interdiction de Fable 5 était une erreur. Le gouvernement n'a fait ni l'un ni l'autre.
Lennart Heim, chercheur en politique de l'IA, a saisi l'absurdité dans un post sur X : « heureusement qu'Amazon n'a pas signalé celui-ci à la Maison Blanche » — une référence à la façon dont l'administration Trump a appris le jailbreak de Fable 5 par l'équipe de découverte d'Amazon. Un ancien conseiller en politique de l'IA a déclaré à Fortune : « Ce que nous observons récemment crée une incertitude qui est au mieux préjudiciable et soulève potentiellement la question de savoir si, intentionnellement ou non, les États-Unis appliquent un standard incohérent à différents laboratoires d'IA » (Fortune(s’ouvre dans un nouvel onglet), 2026).
Pour les organisations qui s'appuient sur le filtrage gouvernemental comme signal de sécurité, cette découverte devrait déclencher une réévaluation immédiate. Si deux modèles avec des profils de vulnérabilité identiques reçoivent un traitement réglementaire différent, le traitement réglementaire lui-même n'est pas un indicateur fiable de sécurité.
Ce qui change pour vous
Réévaluez vos décisions d'achat. Ne partez pas du principe qu'un modèle ayant passé l'examen gouvernemental est intrinsèquement plus sûr qu'un autre. Les données de l'AISI montrent qu'ils sont vulnérables de manière équivalente — seul le traitement réglementaire diffère.
Testez directement. Si votre organisation utilise des modèles d'IA pour des travaux sensibles en matière de sécurité, testez les deux modèles par rapport à votre propre modèle de menace au lieu de vous fier à l'approbation gouvernementale comme indicateur de sécurité. L'observation de Stanislav Fort — selon laquelle chaque modèle déployé a presque certainement des jailbreaks non découverts — devrait être votre hypothèse de base.
Surveillez la réponse politique. Deux modèles également vulnérables recevant un traitement réglementaire opposé créent une tension politique intenable. Soit les restrictions se durcissent sur tous les modèles de pointe, soit le cadre s'effondre sous sa propre incohérence. Les deux scénarios changent le calcul d'achat.
FAQ
Est-ce que cela signifie que GPT-5.6 Sol n'est pas sûr ? Pas de manière unique — c'est précisément le propos. Les résultats de l'AISI confirment que l'équivalence de vulnérabilité est la norme pour les modèles de pointe. GPT-5.6 Sol n'est ni plus ni moins dangereux que Fable 5 sur le plan de la cybersécurité. Chaque modèle de ce niveau comporte des jailbreaks non détectés.
Que doit faire mon équipe de sécurité ? Traitez tous les modèles de pointe comme présentant un risque équivalent pour les charges de travail sensibles en cybersécurité. Intégrez vos propres tests dans les processus d'achat plutôt que de déléguer les jugements de sécurité aux décisions de filtrage gouvernemental.
UK AISI confirms GPT-5.6 Sol carries equivalent cyber vulnerabilities to Fable 5 — every frontier model shares this risk, which does not diminish Sol's coding and cost advantages. Vulnerability equivalence is now table stakes for frontier models; the verdict moves from Pending to Recommended.
Que faire
- 1 Re-evaluate any procurement or policy decisions that assume one frontier model is inherently safer than another
- 2 If your organization uses AI models for security-sensitive work, test both — don't rely on government gating as a safety proxy
Outils et modèles concernés
Ne ratez plus jamais une mise à jour
Le récap hebdomadaire — uniquement les changements de verdict et les actions urgentes. Sans remplissage.