O GPT Live 1 ficou disponível de forma geral na API da OpenAI em 10 de setembro de 2026. O modelo foi projetado para lidar com pausas, interrupções, confirmações breves e mudanças de ritmo sem exigir que a pessoa conclua uma fala antes da resposta.
Publicado porEditado com GPT-5.6 TerraImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT-Live-1 full-duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11. It introduced GPT‑Live‑1 as a generally available, full‑duplex voice layer: a model intended to make voice agents more natural by listening and spe. Topic tags: general, general web, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
A OpenAI anunciou a disponibilidade geral do GPT-Live-1 em sua API em 10 de setembro de 2026, e não em 11 de setembro. A novidade oferece aos desenvolvedores uma camada de voz para criar agentes capazes de ouvir e falar ao mesmo tempo, em vez de conduzir a conversa em turnos rígidos e concluídos. 1
16
Muitos agentes de voz funcionam como uma sequência: o sistema transforma a fala em texto, um modelo de linguagem produz a resposta e, por fim, outro sistema converte o texto de volta em voz. O GPT-Live-1 é apresentado como uma camada unificada para a parte conversacional em tempo real dessa interação. 1
Na prática, a diferença está na alternância de fala. Segundo a OpenAI, o GPT-Live-1 consegue ouvir e falar simultaneamente, acompanhar pausas e mudanças de ritmo e decidir se deve responder ou continuar ouvindo. A proposta é tratar interrupções e breves sinais de atenção — como um “aham” — como partes normais de uma conversa, e não como falhas. 1
9
15
Isso não quer dizer que o modelo de voz precise executar todas as tarefas sozinho. A conversa com o GPT-Live-1 pode continuar enquanto um modelo ou agente de backend realiza raciocínios mais profundos ou usa ferramentas. A OpenAI oferece a delegação via Responses para modelos da própria empresa e a delegação pelo cliente para conectar o backend do desenvolvedor. 1
16
O GPT-Live-1 atua como a camada de voz voltada à conversa ao vivo. Já o backend pode assumir tarefas como raciocínio mais complexo, busca e recuperação de informações, execução de fluxos de trabalho ou chamadas de ferramentas. Nas notas da OpenAI sobre seus produtos, o GPT-6 Astra aparece como opção para tarefas mais difíceis de busca e raciocínio; quem usa a API também pode conectar o próprio backend pela delegação do cliente. 4
16
Para quem desenvolve, essa separação cria uma arquitetura em duas partes:
A OpenAI também destacou melhor seguimento de instruções, vozes personalizadas e suporte a telefonia no lançamento da API. 13
As sessões de voz com o GPT-Live-1 custam US$ 0,05 por minuto. A cobrança é feita por segundo, sem arredondamento para o minuto inteiro seguinte. 16
18
Esse valor cobre a sessão de voz, não necessariamente todo o custo de um agente de voz. O uso do modelo de backend e de ferramentas é cobrado à parte. Por isso, um orçamento de produção precisa considerar tanto a duração da conversa quanto o trabalho delegado ao sistema por trás dela. 16
18
A OpenAI informou que o GPT-Live-1 teve melhora de 30 pontos percentuais no seu Full Duplex Bench em relação ao GPT-Realtime-2.1. A empresa também afirmou que o GPT-Live-1 combinado ao GPT-6 Astra, com esforço de raciocínio médio, ficou em primeiro lugar no Tau3. 1
Por outro lado, o material fornecido não confirma de forma independente os números específicos mencionados na pergunta sobre latência de alternância de fala nem a comparação exata de taxas de aprovação no Tau3. Portanto, essas cifras precisas não devem ser tratadas aqui como verificadas.
A OpenAI apresentou algumas implementações iniciais em produção como exemplos do ganho de naturalidade na alternância de fala:
Esses são resultados relatados pelas próprias empresas, e não avaliações independentes. Eles devem ser entendidos como exemplos de uso em produção, não como garantias universais de desempenho.
As evidências disponíveis não sustentam alegações sobre acesso empresarial por um produto gerenciado chamado “Presence”, nem comprovam uma expansão específica de sotaques, dialetos ou idiomas para este lançamento da API. Antes de incluir esses pontos em decisões de compra ou implementação, é recomendável verificá-los diretamente na documentação atual da OpenAI.
A principal mudança do GPT-Live-1 é arquitetural: ele leva à API uma camada de conversa por voz full-duplex, capaz de manter uma interação mais natural enquanto outro sistema executa raciocínios mais lentos ou chama ferramentas. A tarifa de US$ 0,05 por minuto — cobrada por segundo — torna o custo do tempo de voz fácil de calcular, mas a conta completa ainda varia conforme o modelo de backend e as ferramentas escolhidas. 1
16
18
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
O GPT Live 1 ficou disponível de forma geral na API da OpenAI em 10 de setembro de 2026.
O GPT Live 1 ficou disponível de forma geral na API da OpenAI em 10 de setembro de 2026. O modelo foi projetado para lidar com pausas, interrupções, confirmações breves e mudanças de ritmo sem exigir que a pessoa conclua uma fala antes da resposta.
O custo total de um agente de voz não se resume à taxa por minuto: uso do modelo de backend e de ferramentas é cobrado separadamente.