GPT-5.6 Luna logo

GPT-5.6 Luna

OpenAI · Veröffentlicht Juni 2026

pending

OpenAIs günstigste GPT-5.6-Stufe — TerminalBench 2.1 mit 82,5 % für 1/6 $ pro 1M Tokens, günstiger als Claude Haiku 4.5 und Gemini Flash bei der Leistung pro Dollar. Der Haken: Luna ist auf rund 20 vertrauenswürdige Partner beschränkt, ohne unabhängige Überprüfung oder GA-Termin. Am besten geeignet für Teams, die Modell-Routing-Architekturen aufbauen und günstige Fehlschläge an Terra oder Sol eskalieren können.

Ist es das Richtige für dich?

Gut für

  • Beste Leistung pro Dollar in der GPT-5.6-Familie: TerminalBench 2.1 mit 82,5 % liegt nur 0,9 Punkte hinter GPT-5.5 (83,4 %) zu einem Fünftel von Sols Kosten. Für hochvolumige agentenbasierte Workflows ist Luna der wirtschaftliche Gewinner.
  • Geschwindigkeit und Durchsatz: positioniert als schnellstes GPT-5.6-Modell, optimiert für latenzempfindliche Produkte, Agenten-Schwärme, Kundensupport und Echtzeit-Klassifizierungspipelines.
  • Routine-Automatisierung und -Extraktion: Klassifizierung, Zusammenfassung, Formatierung, Routing, Entwurfserstellung und Hintergrundautomatisierung, wo Kosten pro Anfrage und Durchsatz über reiner Reasoning-Tiefe stehen.
  • Modell-Routing-Architekturen: die unterste Stufe einer Sol > Terra > Luna Eskalationsleiter. Luna standardmäßig nutzen, zu Terra oder Sol eskalieren, wenn Lunas Bewertung bei einer bestimmten Aufgabe unter den Schwellenwert fällt.

Nicht geeignet für

  • Regierungsbeschränkt ohne öffentlichen Zugang: dieselbe eingeschränkte Vorschau-Beschränkung. Lunas Wertversprechen ist auf dem Papier klar, aber es gibt keine unabhängige Überprüfung.
  • CTF-Ergebnis von 85,19 % ist das niedrigste in der Familie — solide, aber nicht dominant. Für sicherheitskritische Workflows sind Terra oder Sol die angemessene Stufe.
  • Fehlende Sicherheitstiefe von Sol und Terra: keine Activation Classifier bei Luna (laut System Card). Für regulierte Cyber- und Bio-Workflows Terra oder Sol mit vollständigem Monitoring-Stack nutzen.
  • Mit 1/6 $ ist Luna wettbewerbsfähig, aber nicht das günstigste Modell auf dem Markt — GLM-5.2 (1,40/4,40 $) und DeepSeek V4 Pro (0,44/0,87 $) bieten niedrigere Ausgabepreise für ähnliche Leistungsstufen.

Leistung nach Aufgabe

Hochvolumiges agentenbasiertes Programmieren (Budget)

Very Good

82,5 % bei TerminalBench 2.1, nur 0,9 hinter GPT-5.5. Bemerkenswert für eine Budget-Stufe. Routine-Coding-Aufgaben an Luna routen, komplexe eskalieren.

Klassifizierung und Extraktion

Excellent

Das ideale Modell für günstige, hochvolumige Aufgaben. Klassifizierung, Entitätsextraktion, Sentiment, Routing und Formatierung zu 1/6 $ ist der wirtschaftliche Gewinn der GPT-5.6-Familie.

Zusammenfassung und Entwurfserstellung

Very Good

Schnell und erschwinglich für Dokumentenzusammenfassung, E-Mail-Entwürfe, Berichtserstellung und Content-Workflows, bei denen Geschwindigkeit wichtiger ist als extreme Präzision.

Cybersicherheit

Good

CTF 85,19 % ist solide für ein Budget-Modell, liegt aber hinter Terra (91,84 %) und Sol (96,7 %). Keine Activation Classifier. Nicht die richtige Stufe für sicherheitskritische Arbeit.

Hartes Reasoning und Deep Research

Fair

Budget-Stufe ohne Max- oder Ultra-Reasoning-Modi. Für harte Probleme zu Sol routen. Für alltägliches Reasoning Terra. Luna ist für Volumen, nicht für Tiefe.

Preise

Eingabe

$1 / 1M tokens

Ausgabe

$6 / 1M tokens

Kontext

Fastest and most cost-efficient GPT-5.6 tier.

Alle Preise ansehen

Benchmarks

BenchmarkWertQuelle
TerminalBench 2.182.5% Quelle
Internal CTF (capture-the-flag)85.19% Quelle

Urteilsverlauf

16. Juli 2026
copy edit to brevity standard, detail preserved in children — Density rewrite: compressed 176w/9s to ~70w/3s per the 55–90w verdict_summary standard. Benchmark scores, pricing detail, audience fit, and per-task ratings remain in strengths[], benchmarks[], task_strengths[], and verdict_audiences[].

Prüfprotokoll

  • Preise— Keine Änderungen

    Automatisierter Agent

  • Preise— Keine Änderungen

    Automatisierter Agent

  • Status— Aktualisiert

    Automatisierter Agent

    Summary re-dated to Jul 7 2026 and made explicit about what is awaited: stays pending pending GA + independent benchmarks; still government-gated (~20 orgs); family trending toward release (~Jul 9 GA per prediction markets, unconfirmed). Verdict unchanged (pending).

  • Preise— Keine Änderungen

    Automatisierter Agent

  • Preise— Keine Änderungen

    Automatisierter Agent

    Pricing unchanged: $1/$6 per 1M tokens. Government-gated. Confirmed by OpenAI blog.

  • Profil— Keine Änderungen

    Beim Start importiert

  • Preise— Keine Änderungen

    Beim Start importiert

Wie wir bewerten