GPT-Live-1 chega à API por US$ 0,05 o minuto, mas esse preço cobre só a camada de voz
- O que aconteceu
- OpenAI made GPT-Live-1 generally available in the API on 10 September at $0.05 per minute for the voice session, with telephony support and a backend model of your choice handling the reasoning.
- Porque é importante
- The published price excludes the backend model and tool usage, which OpenAI bills separately, and OpenAI states no all-in per-minute figure, so the $0.05 alone cannot budget a voice agent.
- O que fazer
- Cost a real call through both the voice session and your chosen backend before building; GPT-Live-1 stays conditional.
Veredito: o GPT-Live-1 continua como "condicional". A condição que impusemos em julho, a falta de API, deixou de existir. A que entra no lugar é o custo: os US$ 0,05 por minuto cobrados pela OpenAI pagam apenas a sessão de voz. O raciocínio roda em um modelo de backend escolhido por você, como o GPT-5.6 Luna ou o GPT-6 Astra, cobrado separadamente, e a OpenAI não informa nenhum valor total.
O que aconteceu
A entrada de 10 de setembro no changelog da API da OpenAI e a documentação para desenvolvedores dizem:
- Disponibilidade. "O GPT-Live 1 agora está em disponibilidade geral na API."
- Preço. "US$ 0,05 por minuto, cobrado por segundo". "O uso do modelo de backend e de ferramentas é cobrado separadamente."
- Escolha do backend. O backend pode ser "um modelo compatível da Responses" ou "qualquer modelo, harness de agente ou serviço que sua aplicação execute".
- Telefonia. O guia de primeiros passos lista "Telephony and SIP" (telefonia e SIP) para conectar chamadas telefônicas.
Não testamos a API.
Por que isso importa
US$ 0,05 por minuto equivale a US$ 3 por hora de sessão de voz. Cada minuto dessa conversa também aciona um modelo de backend com a tarifa por token dele. Dois modelos da OpenAI do nosso diretório como exemplo:
| Backend (segundo nosso diretório) | Entrada / saída por 1M de tokens | Nosso veredito |
|---|---|---|
| GPT-5.6 Luna | US$ 0,20 / US$ 1,20 | Condicional |
| GPT-6 Astra | US$ 10 / US$ 50 | Condicional |
A documentação da OpenAI não traz nenhum cálculo de custo por minuto para qualquer combinação, então o valor de US$ 0,05 sozinho não basta para orçar um agente de voz. A diferença entre esses dois backends é de 50 vezes nos tokens de entrada.
Nosso diretório também lista o GPT-6 Luna, lançado em 22 de setembro, a US$ 0,10 / US$ 0,50 por 1M de tokens. Não confirmamos quais modelos contam como "modelo compatível da Responses" para o GPT-Live-1; verifique antes de orçar com base em qualquer um deles.
O que muda para você
- Calcule as duas metades. Passe a transcrição de uma chamada representativa pela sessão de voz e pelo backend escolhido, e calcule o custo total por minuto antes de se comprometer.
- Distribua pela dificuldade. Coloque fluxos simples e de alto volume, como agendamentos, em um backend barato e reserve um modelo de fronteira, como o Astra, para as chamadas que precisam dele.
- Confirme o backend. Verifique se o modelo escolhido é compatível antes de orçar com base na tarifa dele.
Nosso diretório. A ficha do GPT-Live-1 agora traz os preços da API: US$ 0,05 por minuto de sessão de voz, com o modelo de backend e as ferramentas cobrados à parte. O resumo ainda descreve o modelo exclusivo do ChatGPT, inclusive o "sem API", e está marcado para atualização. A classificação não muda: a condição da falta de API foi superada, mas o custo total não foi publicado e não testamos a API.
FAQ
Quanto custa o GPT-Live-1 na API? US$ 0,05 por minuto de sessão de voz, cobrado por segundo, segundo a OpenAI. O uso do modelo de backend e de ferramentas é cobrado à parte, então o custo real por minuto depende do modelo com que você o combina.
O GPT-Live-1 consegue atender chamadas telefônicas? Sim. O guia de primeiros passos da OpenAI lista Telephony and SIP para conectar chamadas telefônicas.
Qual modelo de backend devo usar? A documentação da OpenAI admite um modelo compatível da Responses ou qualquer modelo, harness de agente ou serviço que sua aplicação execute. Calcule o preço dos candidatos com uma transcrição real antes de escolher.
O GPT-Live-1 está em disponibilidade geral? Sim. O changelog da API da OpenAI lista o GPT-Live 1 como disponível de forma geral na API desde 10 de setembro.
O que fazer
- 1 Run a representative call transcript through GPT-Live-1 plus your chosen backend model and compute the all-in cost per minute before committing.
- 2 Start high-volume, simple flows such as scheduling on a budget backend, and reserve a frontier model such as GPT-6 Astra for calls that need it.
- 3 Confirm which models GPT-Live-1 accepts as a supported backend before budgeting on any per-token rate, including GPT-6 Luna's.
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.