GPT-5.6 Luna
OpenAI · Veröffentlicht Juni 2026
OpenAIs günstigste GPT-5.6-Stufe — TerminalBench 2.1 mit 82,5 % für 1/6 $ pro 1M Tokens, günstiger als Claude Haiku 4.5 und Gemini Flash bei der Leistung pro Dollar. Der Haken: Luna ist auf rund 20 vertrauenswürdige Partner beschränkt, ohne unabhängige Überprüfung oder GA-Termin. Am besten geeignet für Teams, die Modell-Routing-Architekturen aufbauen und günstige Fehlschläge an Terra oder Sol eskalieren können.
Ist es das Richtige für dich?
Gut für
- Beste Leistung pro Dollar in der GPT-5.6-Familie: TerminalBench 2.1 mit 82,5 % liegt nur 0,9 Punkte hinter GPT-5.5 (83,4 %) zu einem Fünftel von Sols Kosten. Für hochvolumige agentenbasierte Workflows ist Luna der wirtschaftliche Gewinner.
- Geschwindigkeit und Durchsatz: positioniert als schnellstes GPT-5.6-Modell, optimiert für latenzempfindliche Produkte, Agenten-Schwärme, Kundensupport und Echtzeit-Klassifizierungspipelines.
- Routine-Automatisierung und -Extraktion: Klassifizierung, Zusammenfassung, Formatierung, Routing, Entwurfserstellung und Hintergrundautomatisierung, wo Kosten pro Anfrage und Durchsatz über reiner Reasoning-Tiefe stehen.
- Modell-Routing-Architekturen: die unterste Stufe einer Sol > Terra > Luna Eskalationsleiter. Luna standardmäßig nutzen, zu Terra oder Sol eskalieren, wenn Lunas Bewertung bei einer bestimmten Aufgabe unter den Schwellenwert fällt.
Nicht geeignet für
- Regierungsbeschränkt ohne öffentlichen Zugang: dieselbe eingeschränkte Vorschau-Beschränkung. Lunas Wertversprechen ist auf dem Papier klar, aber es gibt keine unabhängige Überprüfung.
- CTF-Ergebnis von 85,19 % ist das niedrigste in der Familie — solide, aber nicht dominant. Für sicherheitskritische Workflows sind Terra oder Sol die angemessene Stufe.
- Fehlende Sicherheitstiefe von Sol und Terra: keine Activation Classifier bei Luna (laut System Card). Für regulierte Cyber- und Bio-Workflows Terra oder Sol mit vollständigem Monitoring-Stack nutzen.
- Mit 1/6 $ ist Luna wettbewerbsfähig, aber nicht das günstigste Modell auf dem Markt — GLM-5.2 (1,40/4,40 $) und DeepSeek V4 Pro (0,44/0,87 $) bieten niedrigere Ausgabepreise für ähnliche Leistungsstufen.
Leistung nach Aufgabe
Hochvolumiges agentenbasiertes Programmieren (Budget)
82,5 % bei TerminalBench 2.1, nur 0,9 hinter GPT-5.5. Bemerkenswert für eine Budget-Stufe. Routine-Coding-Aufgaben an Luna routen, komplexe eskalieren.
Klassifizierung und Extraktion
Das ideale Modell für günstige, hochvolumige Aufgaben. Klassifizierung, Entitätsextraktion, Sentiment, Routing und Formatierung zu 1/6 $ ist der wirtschaftliche Gewinn der GPT-5.6-Familie.
Zusammenfassung und Entwurfserstellung
Schnell und erschwinglich für Dokumentenzusammenfassung, E-Mail-Entwürfe, Berichtserstellung und Content-Workflows, bei denen Geschwindigkeit wichtiger ist als extreme Präzision.
Cybersicherheit
CTF 85,19 % ist solide für ein Budget-Modell, liegt aber hinter Terra (91,84 %) und Sol (96,7 %). Keine Activation Classifier. Nicht die richtige Stufe für sicherheitskritische Arbeit.
Hartes Reasoning und Deep Research
Budget-Stufe ohne Max- oder Ultra-Reasoning-Modi. Für harte Probleme zu Sol routen. Für alltägliches Reasoning Terra. Luna ist für Volumen, nicht für Tiefe.
Preise
Eingabe
$1 / 1M tokens
Ausgabe
$6 / 1M tokens
Kontext
Fastest and most cost-efficient GPT-5.6 tier.
Benchmarks
Urteilsverlauf
Quellen
Prüfprotokoll
- Preise— Keine Änderungen
Automatisierter Agent
- Preise— Keine Änderungen
Automatisierter Agent
- Status— Aktualisiert
Automatisierter Agent
Summary re-dated to Jul 7 2026 and made explicit about what is awaited: stays pending pending GA + independent benchmarks; still government-gated (~20 orgs); family trending toward release (~Jul 9 GA per prediction markets, unconfirmed). Verdict unchanged (pending).
- Preise— Keine Änderungen
Automatisierter Agent
- Preise— Keine Änderungen
Automatisierter Agent
Pricing unchanged: $1/$6 per 1M tokens. Government-gated. Confirmed by OpenAI blog.
- Profil— Keine Änderungen
Beim Start importiert
- Preise— Keine Änderungen
Beim Start importiert