GPT-5.6 Terra logo

GPT-5.6 Terra

OpenAI · Veröffentlicht Juni 2026

pending

Das mittlere GPT-5.6-Arbeitstier — GPT-5.5-Klasse-Leistung zum halben Preis (2,50/15 $ pro 1M Tokens) mit TerminalBench 2.1 bei 84,3 %, gleichauf mit Claude Fable 5. Die Einschränkung: alle Angaben stammen vom Anbieter, Terra ist auf ~20 Partner beschränkt, und es gibt kein bestätigtes GA-Datum. Für die meisten Produktionsworkloads wäre Terra der pragmatische Standard, sobald verfügbar; GPT-5.5 und Opus 4.8 sind die heutigen Alternativen.

Ist es das Richtige für dich?

Gut für

  • Kosteneffizienz-Sweetspot: GPT-5.5-Niveau zum halben Preis. Mit 2,50/15 $ pro 1M Tokens ist Terra bepreist, um GPT-5.5 als Standardmodell für die meisten Produktions-Workloads zu ersetzen — sofern der Qualitätsanspruch hält.
  • TerminalBench 2.1 mit 84,3 % gleichauf mit Claude Fable 5 — Anthropics öffentlich verfügbarem Flaggschiff — beim gleichen Ergebnis. Für agentenbasiertes Programmieren ohne Sols extreme Reasoning-Tiefe ist Terra die rationale Wahl.
  • Hochvolumige Unternehmens-Workloads: Kundensupport, interne Tools, Dokumentenanalyse und Produktions-Pipelines, bei denen Zuverlässigkeit zählt, aber Kosten pro Anfrage skalieren müssen.
  • Starke Cybersicherheitsfähigkeit für seine Stufe: 91,84 % bei internen CTF-Tests. Trägt Activation Classifier und denselben Sicherheits-Stack wie Sol für regulierte Cyber- und Bio-Workflows.

Nicht geeignet für

  • Regierungsbeschränkte Vorschau: gleiche Zugangsbeschränkungen wie Sol — nur ~20 vertrauenswürdige Partner heute. Behauptungen zu 'GPT-5.5-Leistung zum halben Preis' sind anbieterbasiert, nicht unabhängig überprüfbar.
  • Keine Ultra- oder Max-Reasoning-Modi: Terra fehlen die Subagent-Zerlegung und die erweiterte Überlegung, die Sol auszeichnen. Für die härteste agentenbasierte Arbeit brauchst du weiterhin Sol.
  • Das TerminalBench-Ergebnis von 84,3 % liegt nur 0,9 Punkte vor GPT-5.5 mit 83,4 %. Die Behauptung 'wettbewerbsfähig mit GPT-5.5' ist richtungsmäßig korrekt, aber der Abstand ist gering — deine eigenen Evaluierungen werden dir mehr sagen als die Anzeigetafel.

Leistung nach Aufgabe

Agentenbasiertes Programmieren (Mittelstufe)

Very Good

84,3 % bei TerminalBench 2.1 gleichauf mit Claude Fable 5. Stark genug für die meisten Produktions-Coding-Agenten. Sol ist das Upgrade für die härtesten Probleme.

Cybersicherheit

Very Good

CTF-Ergebnis von 91,84 %. Robuste Sicherheitsfähigkeiten mit Activation Classifiern. Gut für defensive Workflows und Schwachstellenanalyse ohne Sols Premium.

Kosteneffiziente Produktions-Workloads

Excellent

Mit 2,50/15 $ pro 1M hat Terra das beste Kosten-Leistungs-Verhältnis in der GPT-5.6-Familie. OpenAIs Anspruch von GPT-5.5-Leistung zum halben Preis ist die kommerziell wichtigste Schlagzeile für die meisten Teams.

Allgemeines Reasoning und Alltagsarbeit

Very Good

Positioniert als ausgewogenes Alltagsmodell. Für Routine-Reasoning, Schreiben, Analyse und Business Intelligence sollte Terra qualitativ nicht von Sol zu unterscheiden sein.

Deep Research und hartes Reasoning

Good

Fehlende Max-Reasoning- und Ultra-Subagent-Modi von Sol. Fällt bei den härtesten Problemen hinter Sol, Mythos 5 und Fable 5 zurück. Harte Aufgaben an Sol routen, nicht an Terra.

Preise

Eingabe

$2.50 / 1M tokens

Ausgabe

$15 / 1M tokens

Kontext

Roughly 2x cheaper than GPT-5.5 for similar perf.

Alle Preise ansehen

Benchmarks

BenchmarkWertQuelle
TerminalBench 2.184.3% Quelle
Internal CTF (capture-the-flag)91.84% Quelle

Urteilsverlauf

16. Juli 2026
copy edit to brevity standard, detail preserved in children — Density rewrite: compressed 157w/10s to ~85w/3s per the 55–90w verdict_summary standard. Benchmark scores, pricing tiers, audience fit, and per-task ratings remain in strengths[], benchmarks[], task_strengths[], and verdict_audiences[].

Prüfprotokoll

  • Preise— Keine Änderungen

    Automatisierter Agent

  • Preise— Keine Änderungen

    Automatisierter Agent

  • Status— Aktualisiert

    Automatisierter Agent

    Summary re-dated to Jul 7 2026 and made explicit about what is awaited: stays pending pending GA + independent benchmarks; still government-gated (~20 orgs); family trending toward release (Sol Ultra confirmed for Codex Jul 6, ~Jul 9 GA per prediction markets, unconfirmed). Verdict unchanged (pending).

  • Preise— Keine Änderungen

    Automatisierter Agent

  • Preise— Keine Änderungen

    Automatisierter Agent

    Pricing unchanged: $2.50/$15 per 1M tokens. Government-gated. Confirmed by OpenAI blog (GPT-5.5-class at half cost).

  • Profil— Keine Änderungen

    Beim Start importiert

  • Preise— Keine Änderungen

    Beim Start importiert

Wie wir bewerten