GPT-Live-1 arrive dans l'API à $0.05 la minute, mais ce prix ne couvre que la couche vocale
- Ce qui s’est passé
- OpenAI made GPT-Live-1 generally available in the API on 10 September at $0.05 per minute for the voice session, with telephony support and a backend model of your choice handling the reasoning.
- Pourquoi c’est important
- The published price excludes the backend model and tool usage, which OpenAI bills separately, and OpenAI states no all-in per-minute figure, so the $0.05 alone cannot budget a voice agent.
- Que faire
- Cost a real call through both the voice session and your chosen backend before building; GPT-Live-1 stays conditional.
Verdict : GPT-Live-1 reste Conditionnel. La condition que nous avions posée en juillet, l'absence d'API, a disparu. Celle qui la remplace, c'est le coût : les $0.05 la minute facturés par OpenAI ne couvrent que la session vocale. Le raisonnement tourne sur un modèle backend de votre choix, comme GPT-5.6 Luna ou GPT-6 Astra, facturé à part, et OpenAI ne donne aucun chiffre tout compris.
Ce qui s'est passé
L'entrée du changelog de l'API d'OpenAI datée du 10 septembre et sa documentation pour développeurs indiquent :
- Disponibilité. "GPT-Live 1 est désormais en disponibilité générale dans l'API."
- Prix. "$0.05 par minute, facturé à la seconde". "L'usage du modèle backend et des outils est facturé séparément."
- Choix du backend. Le backend peut être "un modèle Responses pris en charge" ou "n'importe quel modèle, framework d'agent ou service exécuté par votre application".
- Téléphonie. Le guide de prise en main mentionne "Telephony and SIP" (téléphonie et SIP) pour connecter des appels téléphoniques.
Nous n'avons pas testé l'API.
Pourquoi c'est important
$0.05 la minute, c'est $3 de l'heure de session vocale. Et chaque minute de conversation fait aussi tourner un modèle backend, à son propre tarif au token. Deux modèles OpenAI de notre répertoire, à titre d'exemple :
| Backend (selon notre répertoire) | Entrée / sortie par million de tokens | Notre verdict |
|---|---|---|
| GPT-5.6 Luna | $0.20 / $1.20 | Conditionnel |
| GPT-6 Astra | $10 / $50 | Conditionnel |
La documentation d'OpenAI ne donne aucun calcul à la minute pour quelque combinaison que ce soit : le chiffre de $0.05 ne suffit donc pas à budgéter un agent vocal. Entre ces deux backends, l'écart atteint un facteur 50 sur les tokens d'entrée.
Notre répertoire référence aussi GPT-6 Luna, sorti le 22 septembre, à $0.10 / $0.50 par million de tokens. Nous n'avons pas confirmé quels modèles comptent comme "modèle Responses pris en charge" pour GPT-Live-1 : vérifiez-le avant de bâtir un budget sur l'un d'eux.
Ce qui change pour vous
- Chiffrez les deux volets. Faites passer la transcription d'un appel représentatif par la session vocale et par le backend choisi, puis calculez le coût tout compris à la minute avant de vous engager.
- Aiguillez selon la difficulté. Confiez les flux simples et à fort volume, comme la prise de rendez-vous, à un backend économique, et réservez un modèle de pointe comme Astra aux appels qui l'exigent.
- Vérifiez le backend. Assurez-vous que le modèle choisi est pris en charge avant de budgéter sur son tarif.
Notre répertoire. La fiche GPT-Live-1 affiche désormais le tarif de l'API : $0.05 la minute pour la session vocale, le modèle backend et les outils étant facturés à part. Son résumé décrit encore le modèle réservé à ChatGPT, mention "pas d'API" comprise, et il est signalé pour mise à jour. La note ne bouge pas : la condition liée à l'absence d'API est levée, mais le coût tout compris n'est pas publié et nous n'avons pas testé l'API.
FAQ
Combien coûte GPT-Live-1 dans l'API ? $0.05 la minute pour la session vocale, facturée à la seconde, selon OpenAI. Le modèle backend et l'usage des outils sont facturés à part : le vrai coût à la minute dépend donc du modèle auquel vous l'associez.
GPT-Live-1 peut-il répondre à des appels téléphoniques ? Oui. Le guide de prise en main d'OpenAI mentionne Telephony and SIP (téléphonie et SIP) pour connecter des appels téléphoniques.
Quel modèle backend choisir ? La documentation d'OpenAI autorise un modèle Responses pris en charge ou n'importe quel modèle, framework d'agent ou service exécuté par votre application. Chiffrez vos candidats sur une vraie transcription avant de choisir.
GPT-Live-1 est-il en disponibilité générale ? Oui. Le changelog de l'API d'OpenAI indique que GPT-Live 1 est en disponibilité générale dans l'API depuis le 10 septembre.
Que faire
- 1 Run a representative call transcript through GPT-Live-1 plus your chosen backend model and compute the all-in cost per minute before committing.
- 2 Start high-volume, simple flows such as scheduling on a budget backend, and reserve a frontier model such as GPT-6 Astra for calls that need it.
- 3 Confirm which models GPT-Live-1 accepts as a supported backend before budgeting on any per-token rate, including GPT-6 Luna's.
Outils et modèles concernés
Ne ratez plus jamais une mise à jour
Le récap hebdomadaire — uniquement les changements de verdict et les actions urgentes. Sans remplissage.