O anúncio da API foi publicado em 10 de setembro de 2026, e não em 11 de setembro. O GPT Live 1 é uma camada de voz full duplex: pode ouvir e falar simultaneamente, em vez de operar em turnos separados.
Publicado porImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
A OpenAI anunciou em 10 de setembro de 2026 — e não em 11 de setembro — o lançamento do GPT-Live-1 na API. Disponível de forma geral, o modelo é uma camada de voz full-duplex, criada para que agentes de IA possam escutar e falar ao mesmo tempo, com conversas menos rígidas e mais próximas de uma interação humana. 3
Em arquiteturas tradicionais, um agente costuma encadear três etapas: conversão de fala em texto, processamento por um modelo de linguagem ou raciocínio e, por fim, conversão do texto em voz. Cada passagem entre esses componentes pode acrescentar demora e prejudicar elementos como timing, contexto e ritmo da conversa. 3
O GPT-Live-1 reúne a escuta e a fala em um único modelo de voz. Com isso, pode reagir a interrupções e sinais breves de atenção enquanto eles acontecem, enquanto um modelo de backend cuida, em segundo plano, de tarefas mais complexas de raciocínio ou do uso de ferramentas. 3
Desenvolvedores podem conectar essa camada de voz a um backend da OpenAI, como o GPT-6 Astra, ou a um modelo de terceiros. A escolha permite ajustar o equilíbrio entre capacidade de raciocínio, velocidade e custo conforme a aplicação. 3
A OpenAI também destacou controles por system prompt para tom de voz, ritmo e estilo de conversa, além de recursos voltados à telefonia, tratamento de ruído de fundo e silêncio, confiabilidade em sessões longas, transcrições e texto das respostas, reconhecimento alfanumérico e priorização de palavras-chave. 3
As sessões de voz com o GPT-Live-1 custam US$ 0,05 por minuto. A cobrança é feita por segundo, sem arredondamento para minutos completos. 2
O valor se refere à camada de voz. O uso do modelo de backend e de ferramentas é cobrado separadamente; portanto, o custo final de uma sessão depende também do modelo e das integrações escolhidas. 2
As evidências fornecidas não confirmam detalhes sobre um suposto acesso empresarial gerenciado chamado “Presence”, nem a alegação específica de ampliação de sotaques, dialetos e idiomas.
Segundo a empresa, o GPT-Live-1 registrou melhora de 30 pontos percentuais no teste Full Duplex Bench em comparação com o GPT-Realtime-2.1. A OpenAI afirmou ainda que a combinação do GPT-Live-1 com o GPT-6 Astra, em esforço médio de raciocínio, ficou em primeiro lugar no Tau3. 3
Os materiais fornecidos sustentam essas conclusões gerais, mas não exibem de forma independente os números específicos de latência de 1,41 para 0,798 segundo nem as taxas de aprovação de 86,2% contra 45,7% no Tau3. Esses valores exatos, portanto, não podem ser confirmados com base nas evidências disponíveis.
A Yelp informou que a integração do GPT-Live-1 ao Yelp Host e ao Hatch melhorou a alternância entre falantes e a precisão frente à arquitetura de voz anterior. Em ligações para reservas e pedidos de comida, a empresa relatou ganhos relevantes na taxa de atendimento e falas mais completas e naturais dos clientes. 3
A Speak, plataforma de aprendizado de idiomas, disse que o modelo deu aos alunos mais tempo para pensar antes de o tutor responder e reduziu as interrupções em quase 80% em relação a sistemas anteriores baseados em turnos. 3
Já o cofundador e CTO de uma empresa de saúde afirmou que substituir uma implementação em cascata simplificou a base de código em 80%, eliminando 23 mil linhas e permitindo conversas em tempo real mais naturais com pacientes. 3
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
O anúncio da API foi publicado em 10 de setembro de 2026, e não em 11 de setembro.
O anúncio da API foi publicado em 10 de setembro de 2026, e não em 11 de setembro. O GPT Live 1 é uma camada de voz full duplex: pode ouvir e falar simultaneamente, em vez de operar em turnos separados.
O modelo substitui a cadeia tradicional de fala para texto, modelo de linguagem e texto para fala por uma abordagem unificada para a interação por voz.