UK AISI: GPT-5.6 Sol und Fable 5 teilen identisches Cyber-Risiko
- Was ist passiert
- The UK's AI Security Institute confirmed GPT-5.6 Sol has the same cyber vulnerabilities as Fable 5 — and found a universal jailbreak potentially more serious than the one that triggered Fable 5's 19-day ban.
- Warum es wichtig ist
- The US banned Fable 5 for 19 days over the same risk profile. GPT-5.6 Sol launched globally with no restrictions. The government-gating asymmetry now has an official safety evaluation as evidence — published in OpenAI's own System Card.
- Was zu tun ist
- Re-evaluate any procurement or policy decisions that assume one frontier model is inherently safer than another. Test models directly — don't rely on government gating as a safety proxy.
UK AISI: GPT-5.6 Sol und Fable 5 teilen identisches Cyber-Risiko
Das britische AI Security Institute bestätigte am 9. Juli — in Erkenntnissen, die in OpenAIs eigener GPT-5.6 System Card(wird in einem neuen Tab geöffnet) veröffentlicht wurden — dass GPT-5.6 Sol dieselben Cyber-Schwachstellen aufweist wie Anthropics Fable 5. Der von AISI entdeckte Jailbreak ist möglicherweise sogar schlimmer: Die Forscher bezeichneten ihn als "universal" und erklärten, er ermögliche autonome Exploits, nicht nur die Identifikation von Schwachstellen. Die Erkenntnis offenbart eine regulatorische Asymmetrie, die sich nicht länger durch Risiko rechtfertigen lässt: Fable 5 wurde 19 Tage lang wegen desselben Schwachstellenprofils vom ausländischen Zugriff ausgeschlossen, während GPT-5.6 Sol weltweit und ohne jede Einschränkung startete.
Was passiert ist — AISIs GPT-5.6 Sol Jailbreak-Erkenntnisse
Britische Regierungsforscher des UK AI Security Institute (AISI) identifizierten, was sie "universelle Jailbreaks im Cyber-Bereich" in GPT-5.6 Sol nannten, darunter Jailbreaks, die "die autonome Erledigung langwieriger agentischer Aufgaben in Bereichen wie Schwachstellenerkennung und Exploit-Entwicklung ermöglichten" (GPT-5.6 System Card(wird in einem neuen Tab geöffnet), 9. Juli 2026). In einfachen Worten: Sie jailbreakten das Modell und brachten es dazu, selbstständig Software-Schwachstellen zu finden und Systeme zu hacken.
Der Jailbreak wird als "universell einsetzbar" beschrieben — er ermöglicht eigenständige Exploits, nicht nur die Identifikation von Schwachstellen. Das AISI merkte an, dass dies potenziell schwerwiegender ist als der in Fable 5 gefundene Jailbreak, den das Amazon-Entdeckungsteam als auf Schwachstellenerkennung beschränkt — nicht auf autonome Ausbeutung — beschrieb (Fortune(wird in einem neuen Tab geöffnet), 10. Juli 2026). Jener Fable-5-Jailbreak löste im Juni ein 19-tägiges Verbot durch die US-Regierung aus.
OpenAI räumte die Erkenntnisse ein, wies aber deren Schwere für normale Nutzer zurück. Das Unternehmen merkte an, die AISI-Forscher hätten "privilegierten Zugang zu den internen Mechanismen des Systems gehabt, was ihnen erlaubte, den Hacking-Prozess zu beschleunigen." Xander Davies, Leiter des AISI-Red-Teams, postete jedoch auf X, er glaube, die von seinem Team entdeckten Jailbreaks seien "auch ohne diesen Zugang auffindbar, nur langsamer" (Fortune(wird in einem neuen Tab geöffnet), 2026).
OpenAI verwies auf seinen GPT-5.6 Launch-Blog, der feststellt, dass "perfekte Sicherheit nicht existiert" und dass das Unternehmen einen "mehrschichtigen" Ansatz verfolgt, der kontinuierliche Überwachung und schnelle Behebung umfasst. Margaret Cunningham, VP of Security bei DarkTrace und NIST-Spezialistin, lieferte die fundierteste Einschätzung: "Meine Sorge ist weniger, dass ein Modell gejailbreakt wurde, sondern vielmehr, dass die offensive Erkennung schneller wird, während die Verteidigung weiterhin von sehr menschlichen Prozessen abhängt" (Fortune(wird in einem neuen Tab geöffnet), 2026).
Stanislav Fort, Chief Scientist beim AI-Cybersicherheits-Startup AISLE und ehemaliger Forscher bei Anthropic und Google DeepMind, fasste die unbequeme Realität zusammen: "Jedes aktuell eingesetzte Modell hat mit an Sicherheit grenzender Wahrscheinlichkeit unentdeckte Jailbreaks, das gilt also leider für alles, nicht nur für GPT-5.6" (Fortune(wird in einem neuen Tab geöffnet), 2026).
Warum das wichtig ist
Das Eindämmung-durch-Einschränkung-Argument — die Vorstellung, wir könnten die Welt sicherer machen, indem wir bestimmte Modelle blockieren — wurde nun empirisch von genau dem Sicherheitsinstitut widerlegt, das es validieren sollte. Die Zahlen erzählen die Geschichte:
| Modell | Schwachstellenprofil | Behördliche Maßnahme | Aktueller Zugang |
|---|---|---|---|
| Fable 5 | Cyber-Exploit-Fähigkeit | 19 Tage verboten (12. Jun–1. Jul) | Nur Credits, $10/$50 pro 1M Tokens |
| GPT-5.6 Sol | Gleiche Schwachstellen (AISI bestätigt) | Keine Einschränkungen | Im Abo enthalten, $5/$30 pro 1M Tokens |
Beide Modelle bergen ein gleichwertiges Cyber-Risiko. Nur eines wurde abgeschaltet. Das andere startete weltweit mit Abo-Zugang zu einem niedrigeren Preis.
Diese Asymmetrie ist bedeutsam, weil sie das Exportkontroll-Framework der Regierung als reaktiv und inkonsistent statt risikokalibriert entlarvt. Wenn die US-Regierung behauptet, Modelle aufgrund nationaler Sicherheitsrisiken einzuschränken, zeigen die AISI-Daten — veröffentlicht in OpenAIs eigener System Card — nun, dass das gleiche Risikoprofil gegensätzlich behandelt wird. Entweder ist der Maßstab die Schwachstellen-Äquivalenz — dann hätten beide eingeschränkt werden müssen — oder das Fable-5-Verbot war ein Fehler. Die Regierung hat keines von beidem getan.
Lennart Heim, ein KI-Politikforscher, fing die Absurdität mit einem Post auf X ein: "good thing amazon didn't report this one to the white house" — eine Anspielung darauf, wie die Trump-Administration vom Fable-5-Jailbreak durch das Amazon-Entdeckungsteam erfuhr. Ein ehemaliger KI-Politikberater sagte Fortune: "Was wir in letzter Zeit sehen, schafft Unsicherheit, die im besten Fall schädlich ist und möglicherweise die Frage aufwirft, ob die USA — beabsichtigt oder nicht — einen inkonsistenten Standard auf verschiedene KI-Labore anwenden" (Fortune(wird in einem neuen Tab geöffnet), 2026).
Für Organisationen, die sich auf behördliche Freigaben als Sicherheitssignal verlassen, sollte diese Erkenntnis eine sofortige Neubewertung auslösen. Wenn zwei Modelle mit identischen Schwachstellenprofilen unterschiedlich regulatorisch behandelt werden, ist die regulatorische Behandlung selbst kein verlässlicher Indikator für Sicherheit.
Was sich für Sie ändert
Beschaffungsentscheidungen neu bewerten. Gehen Sie nicht davon aus, dass ein Modell, das die behördliche Prüfung bestanden hat, inhärent sicherer ist als eines, das dies nicht tat. Die AISI-Daten zeigen, dass sie gleichermaßen verwundbar sind — nur die regulatorische Behandlung unterscheidet sich.
Direkt testen. Wenn Ihre Organisation KI-Modelle für sicherheitskritische Arbeiten einsetzt, testen Sie beide Modelle gegen Ihr eigenes Bedrohungsmodell, statt sich auf behördliche Genehmigungen als Sicherheits-Proxy zu verlassen. Die Beobachtung von Stanislav Fort — dass jedes eingesetzte Modell mit an Sicherheit grenzender Wahrscheinlichkeit unentdeckte Jailbreaks hat — sollte Ihre Grundannahme sein.
Die politische Reaktion beobachten. Zwei gleichermaßen verwundbare Modelle, die gegensätzlich regulatorisch behandelt werden, erzeugen eine politische Spannung, die nicht halten kann. Entweder verschärfen sich die Einschränkungen für alle Frontier-Modelle, oder das Framework kollabiert unter seiner eigenen Inkonsistenz. Beide Szenarien verändern die Beschaffungskalkulation.
FAQ
Bedeutet das, dass GPT-5.6 Sol unsicher ist? Nicht in einzigartiger Weise — das ist der Punkt. Die AISI-Erkenntnis bestätigt, dass Schwachstellen-Äquivalenz bei Frontier-Modellen die Grundvoraussetzung ist. GPT-5.6 Sol ist in Bezug auf Cybersicherheit nicht mehr und nicht weniger gefährlich als Fable 5. Jedes Modell dieser Stufe trägt unentdeckte Jailbreaks in sich.
Was sollte mein Sicherheitsteam tun? Behandeln Sie alle Frontier-Modelle als gleichwertig riskant für Cybersicherheits-Workloads. Bauen Sie eigene Tests in Beschaffungs-Workflows ein, statt Sicherheitsurteile an behördliche Freigabeentscheidungen auszulagern.
UK AISI confirms GPT-5.6 Sol carries equivalent cyber vulnerabilities to Fable 5 — every frontier model shares this risk, which does not diminish Sol's coding and cost advantages. Vulnerability equivalence is now table stakes for frontier models; the verdict moves from Pending to Recommended.
Was zu tun ist
- 1 Re-evaluate any procurement or policy decisions that assume one frontier model is inherently safer than another
- 2 If your organization uses AI models for security-sensitive work, test both — don't rely on government gating as a safety proxy
Betroffene Tools & Modelle
Nie wieder etwas verpassen
Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.