GPT Live 1 quedó disponible de forma general en la API de OpenAI el 10 de septiembre de 2026; no el día 11. El modelo está diseñado para escuchar y hablar simultáneamente, gestionar pausas e interrupciones y delegar razonamiento o herramientas a un backend.
Publicado porEditado con GPT-5.6 TerraImágenes generadas con GPT Image 2
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT-Live-1 full-duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11. It introduced GPT‑Live‑1 as a generally available, full‑duplex voice layer: a model intended to make voice agents more natural by listening and spe. Topic tags: general, general web, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
OpenAI anunció la disponibilidad general de GPT-Live-1 en su API el 10 de septiembre de 2026, no el 11 de septiembre. El lanzamiento ofrece a los desarrolladores una capa de voz para crear agentes capaces de escuchar y hablar al mismo tiempo, en lugar de tratar cada intercambio como un turno rígido que debe terminar por completo antes de responder. 1
16
Muchos agentes de voz se construyen como una cadena: un sistema de reconocimiento convierte el audio en texto; un modelo de lenguaje prepara la respuesta; y otro sistema la transforma nuevamente en voz. GPT-Live-1 se presenta como una capa de voz unificada para la parte conversacional en tiempo real. 1
La diferencia práctica está en el manejo de los turnos. Según OpenAI, GPT-Live-1 puede escuchar y hablar simultáneamente, seguir pausas y cambios de ritmo, y decidir si conviene contestar o continuar escuchando. Así, las interrupciones y las breves señales de asentimiento —los llamados backchannels— pueden tratarse como elementos normales de una conversación, no como fallos del sistema. 1
9
15
Eso no implica que el modelo de voz deba resolverlo todo por sí solo. La conversación con GPT-Live-1 puede continuar mientras un modelo o agente de backend realiza razonamientos más complejos o utiliza herramientas. OpenAI permite la delegación mediante Responses con un modelo de OpenAI, así como la delegación al cliente para conectar el backend propio de cada desarrollador. 1
16
GPT-Live-1 funciona como la capa conversacional de cara al usuario: escucha, habla y administra el ritmo del diálogo. El backend puede encargarse de razonamiento más exigente, recuperación de información, ejecución de flujos de trabajo o llamadas a herramientas. En las notas de producto de OpenAI, GPT-6 Astra aparece como una opción para tareas complejas de búsqueda y razonamiento; quienes usan la API también pueden integrar su propio backend mediante delegación al cliente. 4
16
Para los equipos de desarrollo, la separación supone lo siguiente:
OpenAI también destacó mejoras en el seguimiento de instrucciones, voces personalizadas y soporte para telefonía. 13
Las sesiones de voz de GPT-Live-1 cuestan US$0,05 por minuto. La facturación se calcula por segundo, sin redondear al siguiente minuto completo. 16
18
Esa tarifa corresponde a la sesión de voz, no necesariamente al coste total de un agente. El consumo del modelo de backend y de las herramientas se cobra por separado, por lo que un presupuesto de producción debe considerar tanto la duración de la conversación como el trabajo delegado al sistema que opera detrás. 16
18
OpenAI informó que GPT-Live-1 mejoró en 30 puntos porcentuales en su prueba Full Duplex Bench frente a GPT-Realtime-2.1. También indicó que GPT-Live-1, combinado con GPT-6 Astra con esfuerzo de razonamiento medio, ocupó el primer puesto en Tau3. 1
Sin embargo, el material proporcionado no sustenta de forma independiente las cifras concretas planteadas sobre latencia de turnos ni la comparación exacta de tasas de aprobación en Tau3. Por ello, esos números específicos no deben considerarse verificados aquí.
OpenAI presentó varios despliegues en producción como ejemplos del valor de un intercambio de turnos más natural:
Son resultados comunicados por las propias empresas, no evaluaciones independientes. Conviene interpretarlos como ejemplos de implementación y no como garantías de rendimiento generalizadas.
La evidencia disponible no respalda afirmaciones sobre acceso empresarial mediante un producto gestionado llamado «Presence», ni confirma una ampliación específica de acentos, dialectos o idiomas para este lanzamiento de API. Esos puntos deberían verificarse directamente en la documentación vigente de OpenAI antes de tomar decisiones de compra o implementación.
La novedad principal de GPT-Live-1 es arquitectónica: incorpora a la API una capa de voz conversacional full-duplex que puede seguir escuchando y hablando de forma más natural mientras otro sistema realiza razonamiento más lento o llama a herramientas. El precio de US$0,05 por minuto, facturado por segundo, hace transparente el coste del tiempo de voz; pero el coste final seguirá dependiendo del modelo de backend y de las herramientas elegidas. 1
16
18
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
GPT Live 1 quedó disponible de forma general en la API de OpenAI el 10 de septiembre de 2026; no el día 11.
GPT Live 1 quedó disponible de forma general en la API de OpenAI el 10 de septiembre de 2026; no el día 11. El modelo está diseñado para escuchar y hablar simultáneamente, gestionar pausas e interrupciones y delegar razonamiento o herramientas a un backend.
La capa de voz cuesta US$0,05 por minuto y se factura por segundo; el uso del modelo de backend y de herramientas se cobra aparte.