GPT-5.6 Luna logo

GPT-5.6 Luna

OpenAI · Sorti juin 2026

pending

Le niveau budgétaire de la famille GPT-5.6 d'OpenAI — TerminalBench 2.1 à 82,5 % pour 1/6 $ par million de tokens, moins cher que Claude Haiku 4.5 et Gemini Flash en rapport capacité-prix. La réserve : Luna est limitée à ~20 partenaires de confiance, sans vérification indépendante ni date de disponibilité générale. Idéal pour les équipes construisant des architectures de routage de modèles qui peuvent escalader les échecs bon marché vers Terra ou Sol.

Est-ce fait pour vous ?

Recommandé pour

  • Meilleur rapport capacité-prix de la famille GPT-5.6 : TerminalBench 2.1 à 82,5% n'est qu'à 0,9 point derrière GPT-5.5 (83,4%) pour 1/5 du coût de Sol. Pour les workflows agentiques à haut volume, Luna est le gagnant économique.
  • Vitesse et débit : positionné comme le modèle GPT-5.6 le plus rapide, optimisé pour les produits sensibles à la latence, les essaims d'agents, le support client et les pipelines de classification en temps réel.
  • Automatisation routinière et extraction : classification, résumé, formatage, routage, génération de brouillons et automatisation en arrière-plan où le coût par requête et le débit priment sur la profondeur de raisonnement.
  • Architectures de routage de modèles : le niveau inférieur d'une chaîne d'escalade Sol > Terra > Luna. Utilisez Luna par défaut, escaladez vers Terra ou Sol lorsque le score d'évaluation de Luna descend sous le seuil.

Déconseillé pour

  • Accès restreint par le gouvernement sans disponibilité publique : même restriction de preview limitée. La proposition de valeur de Luna est claire sur le papier, mais aucune vérification indépendante n'existe.
  • Le score CTF de 85,19% est le plus bas de la famille — solide mais pas dominant. Pour les workflows critiques en sécurité, Terra ou Sol sont le niveau approprié.
  • Absence de la profondeur de sécurité de Sol et Terra : pas de classificateurs d'activation sur Luna (selon la fiche système). Pour les workflows réglementés cyber et bio, utilisez Terra ou Sol avec la pile de surveillance complète.
  • À $1/$6, Luna est compétitif mais pas le modèle le moins cher du marché — GLM-5.2 ($1,40/$4,40) et DeepSeek V4 Pro ($0,44/$0,87) offrent des prix de sortie inférieurs pour des niveaux de capacité similaires.

Performances par tâche

Codage agentique à haut volume (budget)

Very Good

82,5% sur TerminalBench 2.1, seulement 0,9 derrière GPT-5.5. Remarquable pour un niveau budget. Routez les tâches de codage routinières vers Luna, escaladez les complexes.

Classification et extraction

Excellent

Le modèle idéal pour les tâches économiques à haut débit. Classification, extraction d'entités, analyse de sentiment, routage et formatage à $1/$6 est la victoire économique de la famille GPT-5.6.

Résumé et rédaction

Very Good

Rapide et abordable pour le résumé de documents, la rédaction d'emails, la génération de rapports et les workflows de contenu où la vitesse prime sur la précision extrême.

Cybersécurité

Good

CTF 85,19% est solide pour un modèle budget mais reste derrière Terra (91,84%) et Sol (96,7%). Pas de classificateurs d'activation. Pas le bon niveau pour le travail critique en sécurité.

Raisonnement difficile et recherche approfondie

Fair

Niveau budget sans modes de raisonnement max ou ultra. Pour les problèmes difficiles, routez vers Sol. Pour le raisonnement quotidien, Terra. Luna est pour le volume, pas la profondeur.

Tarifs

Entrée

$1 / 1M tokens

Sortie

$6 / 1M tokens

Contexte

Fastest and most cost-efficient GPT-5.6 tier.

Voir tous les tarifs

Tests de performance

TestScoreSource
TerminalBench 2.182.5% Source
Internal CTF (capture-the-flag)85.19% Source

Historique des verdicts

16 juil. 2026
copy edit to brevity standard, detail preserved in children — Density rewrite: compressed 176w/9s to ~70w/3s per the 55–90w verdict_summary standard. Benchmark scores, pricing detail, audience fit, and per-task ratings remain in strengths[], benchmarks[], task_strengths[], and verdict_audiences[].

Journal de vérification

  • Tarifs— Aucun changement

    Agent automatisé

  • Tarifs— Aucun changement

    Agent automatisé

  • Statut— Mis à jour

    Agent automatisé

    Summary re-dated to Jul 7 2026 and made explicit about what is awaited: stays pending pending GA + independent benchmarks; still government-gated (~20 orgs); family trending toward release (~Jul 9 GA per prediction markets, unconfirmed). Verdict unchanged (pending).

  • Tarifs— Aucun changement

    Agent automatisé

  • Tarifs— Aucun changement

    Agent automatisé

    Pricing unchanged: $1/$6 per 1M tokens. Government-gated. Confirmed by OpenAI blog.

  • Profil— Aucun changement

    Importé au lancement

  • Tarifs— Aucun changement

    Importé au lancement

Comment nous évaluons