GPT-5.5-Cyber findet hunderte OSS-Bugs in der ersten Woche
- Was ist passiert
- OpenAI's GPT-5.5-Cyber found hundreds of real vulnerabilities — including 8 Linux kernel PoCs, 34 FreeBSD CVEs, and 5 Chrome V8 bugs — in a five-day sprint across 19 open-source projects, with Trail of Bits engineers validating every finding.
- Warum es wichtig ist
- This is the first frontier model deliberately deployed as a defense weapon at internet scale. It's not just coding — it's finding exploitable bugs faster than any human team, with expert triage that actually reduces the burden on maintainers.
- Was zu tun ist
- Open-source maintainers should apply to participate via Trail of Bits. Security teams should evaluate GPT-5.5-Cyber against internal tooling. If this proves sustained, revisit the GPT-4o verdict.
GPT-5.5-Cyber, eingesetzt im Rahmen von OpenAIs Patch the Planet-Initiative mit Trail of Bits, fand hunderte echter Schwachstellen in einem einzigen fünftägigen Sprint — 8 Linux-Kernel-PoCs, 34 FreeBSD-CVEs, 5 Chrome V8-Bugs und eine WebAssembly-Schwachstelle, die fünf Teams vor Beginn des Wettbewerbs zum Rückzug von Pwn2Own Berlin veranlasste. Dies ist das erste Mal, dass ein Frontier-KI-Modell gezielt für die Open-Source-Verteidigung im Internet-Maßstab eingesetzt wurde. Es funktionierte.
Was passiert ist
Am 22. Juni 2026 erweiterte OpenAI seine Daybreak-Cybersicherheitsinitiative mit drei Veröffentlichungen: der Vollversion von GPT-5.5-Cyber, beschränkt auf vertrauenswürdige Verteidiger über das Trusted Access for Cyber-Programm; einem Codex Security-Plugin zur Schwachstellenerkennung innerhalb von Entwickler-Workflows; und Patch the Planet — einer Initiative mit Trail of Bits, um Schwachstellen in der Open-Source-Software, von der die Welt abhängt, zu finden, zu validieren und zu beheben.
Trail of Bits setzte 25 Ingenieure ein — etwa ein Fünftel der Belegschaft — um Vollzeit mit GPT-5.5-Cyber über 19 Open-Source-Projekte hinweg zu arbeiten. Jeder KI-generierte Fund wurde manuell überprüft, bevor er die Maintainer erreichte. Der erste Sprint produzierte hunderte entdeckter Bugs, 64 Pull Requests und 51 eingereichte Issues, wobei viele weitere noch unter koordinierter Offenlegung stehen (OpenAI, 2026(wird in einem neuen Tab geöffnet)).
Die Zahlen aus Woche eins
| Projekt | Fund | Anzahl |
|---|---|---|
| Linux Kernel | Kernel-Pointer-Info-Leak-PoCs | 8 |
| Linux Kernel | Lokale Privilege-Escalation-Exploits | 24 |
| FreeBSD | Bestätigte Schwachstellen | 34 |
| FreeBSD | Lokale Privilege-Escalation-PoCs | 7 |
| Chrome V8 | Ausnutzbare Bugs (3 innerhalb von Tagen behoben) | 5 |
| Safari/WebKit | Ausnutzbare Schwachstellen | 10+ |
| Firefox | WebAssembly CVE-2026-8390, vor Pwn2Own gepatcht | 1 |
| OpenBSD | 23 Jahre alter Use-After-Free in SysV-Semaphore | 1 |
| dnsmasq | Fand unabhängig 4 von 6 CVEs in v2.92rel2 | 4 |
| HTTP/2 Bomb | DoS betrifft NGINX, Apache, IIS, Pingora | 880K+ Seiten |
Im CyberGym erreichte GPT-5.5-Cyber 85,6 % und schlug GPT-5.5 (81,8 %) und Anthropics Mythos 5 (83,8 %) (MLQ, 2026(wird in einem neuen Tab geöffnet)).
Der Firefox-Fund war der dramatischste: Eine WebAssembly-Schwachstelle (CVE-2026-8390) wurde zwei Tage vor Pwn2Own Berlin gepatcht. Fünf von sechs registrierten Firefox-Einträgen zogen zurück. Kein Firefox-Exploit wurde beim Wettbewerb demonstriert (WIRED, 2026(wird in einem neuen Tab geöffnet)).
Warum es wichtig ist
Open-Source-Maintainer ertrinken. KI-generierte Schwachstellenberichte fluten ihre Warteschlangen mit False Positives, und dieselben begrenzten Freiwilligen werden gebeten, mehr Rauschen als je zuvor zu sichten. Patch the Planet löst den eigentlichen Engpass: Trail of Bits-Ingenieure reproduzieren die Belege, filtern False Positives, bewerten den Schweregrad neu und reichen geprüfte Patches ein — was die Last für Maintainer reduziert, statt sie zu erhöhen.
Wie Trail of Bits-CEO Dan Guido es formulierte: „Patch the Planet ist eine Anstrengung im Internet-Maßstab, um Open-Source-Software zu helfen, KI-Bug-Hunting-Tools einen Schritt voraus zu sein. Aber es ist auch eine Anstrengung, der Open-Source-Community die Vorteile und nicht nur die Nachteile von KI-Coding-Tools zu zeigen" (Trail of Bits, 2026(wird in einem neuen Tab geöffnet)).
Die Five Eyes-Geheimdienstallianz unternahm den außergewöhnlichen Schritt, noch am selben Tag eine gemeinsame Erklärung abzugeben: „Von Frontier-KI-Modellen wird erwartet, dass sie die aktuellen Branchenerwartungen übertreffen und sowohl offensive als auch defensive Cyber-Fähigkeiten grundlegend verändern. Der Zeitrahmen ist nicht Jahre, sondern Monate."
Das Fähigkeitssignal ist unmissverständlich. Ein Frontier-Modell, gezielt für Cyber-Offensive-zur-Verteidigung optimiert, fand echte, ausnutzbare Schwachstellen auf jeder Ebene des Software-Stacks — von Browsern über Kernel bis zur Netzwerkinfrastruktur — in Tagen. GPT-5.5-Cyber ist nicht öffentlich verfügbar; es erfordert die Trusted Access for Cyber-Genehmigung, die Phishing-resistente Authentifizierung vorschreibt und Credential-Diebstahl, Tarnung, Persistenz und Malware-Einsatz blockiert. Das Modell ist ausdrücklich auf defensive Workflows beschränkt.
Das herausragende technische Detail: Trail of Bits-Ingenieure nutzten GPT-5.5-Cyber, um in weniger als einem Tag ein vollständiges Fuzzing-Labor aufzubauen — Arbeit, die normalerweise „mindestens mehrere Wochen" dauern würde. Das Modell traf autonome Entscheidungen über Coverage-Erweiterung, Build-Varianten und Kandidatenfilterung, wobei Ingenieure Ziele setzten und Prompts verfeinerten.
Erste Teilnehmer — cURL, NATS Server, pyca/cryptography, Sigstore, aiohttp, das Go-Projekt, freenginx, Python und python.org — erhalten sechs Monate ChatGPT Pro, bedingten Codex Security-Zugang und API-Guthaben für die Kernentwicklung. Mehr als 30 Projekte haben zugesagt.
Wenn dies zu einer nachhaltigen Fähigkeit statt einer Launch-Day-Demonstration wird, verdienen unsere GPT-4o- und breiteren GPT-5.x-Urteile eine gründliche Neubewertung. Die Verteidigungs-Community hat gerade ein neues Werkzeug erhalten, und die Implikationen für die Zeitpläne der Schwachstellenerkennung sind tiefgreifend.
Was sich für dich ändert
Wenn du Open-Source-Software wartest: Bewirb dich um Teilnahme. Mehr als 30 Projekte haben bereits zugesagt und erhalten ChatGPT Pro, Codex Security-Zugang und API-Guthaben. Die Hürde ist die Prüfung — Trail of Bits-Ingenieure übernehmen die Sichtung, sodass du nicht mit einer Flut ungeprüfter KI-Berichte konfrontiert wirst.
Wenn du in einem Sicherheitsteam bist: GPT-5.5-Cyber über das Trusted Access for Cyber-Programm ist der neue Maßstab für automatisierte Schwachstellenerkennung. Beginne mit der Evaluierung gegen deine internen Tools. Die Five Eyes-Erklärung bedeutet, dass regulatorische Anforderungen an KI-Cyber-Fähigkeiten sich beschleunigen — Compliance-Teams sollten dies verfolgen.
Wenn du KI-Tools evaluierst: Beobachte, ob dies zu einer nachhaltigen Fähigkeit wird. Ein einwöchiger Sprint ist beeindruckend; ein dauerhaftes Programm, das Monat für Monat Bugs findet, würde das Wertversprechen von Frontier-Modellen grundlegend verändern.
FAQ
Kann ich auf GPT-5.5-Cyber zugreifen? Nicht ohne Genehmigung. GPT-5.5-Cyber ist auf vertrauenswürdige Verteidiger über das Trusted Access for Cyber-Programm beschränkt, das Phishing-resistente Authentifizierung erfordert und offensive Fähigkeiten ausdrücklich blockiert. Wenn du Open-Source-Infrastruktur wartest, bewirb dich über Patch the Planet für vermittelten Zugang über Trail of Bits.
Wie schneidet dies im Vergleich zu Anthropics Mythos 5 ab? Im CyberGym erreicht GPT-5.5-Cyber 85,6 % gegenüber Mythos 5s 83,8 %. Aber der eigentliche Unterschied liegt im Einsatz: GPT-5.5-Cyber findet aktiv Bugs in Produktionsinfrastruktur mit fachkundiger menschlicher Validierung. Mythos 5s reale Cyber-Leistung wurde noch nicht in vergleichbarem Umfang demonstriert.
Ist das eine einmalige Launch-Demo? Der Härtetest ist die Nachhaltigkeit. Ein fünftägiger Sprint mit 25 Trail of Bits-Ingenieuren produzierte außergewöhnliche Ergebnisse, aber die Frage ist, ob die Pipeline die Geschwindigkeit über 30+ zugesagte Projekte hinweg halten kann. OpenAI wettet darauf, dass sie es kann — und die anfängliche Infrastruktur (Fuzzing-Harnesses, CVE-Analyse-Pipelines, differentielle Testsysteme) ist auf Wiederverwendung ausgelegt.
Was zu tun ist
- 1 Open-source maintainers: apply to Patch the Planet via Trail of Bits for free security review with expert-validated findings
- 2 Security teams: evaluate GPT-5.5-Cyber against internal vulnerability discovery tooling
- 3 Track whether this becomes a sustained program — a persistent capability would change frontier model value assessment
Betroffene Tools & Modelle
Nie wieder etwas verpassen
Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.