L’annonce API d’OpenAI date du 10 septembre 2026, et non du 11 septembre. GPT‑Live‑1 est un modèle vocal full duplex disponible de manière générale : il peut écouter et parler simultanément.
Publié parImages générées avec GPT Image 2
Réponse de recherche

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
L’annonce d’OpenAI concernant son API est datée du 10 septembre 2026, et non du 11 septembre. L’entreprise y a lancé GPT‑Live‑1, un modèle vocal « full duplex » disponible de manière générale, conçu pour rendre les agents vocaux plus naturels : il peut écouter et parler en même temps, au lieu d’attendre qu’un interlocuteur ait entièrement fini son tour de parole. 3
La plupart des agents vocaux reposent sur une chaîne en plusieurs étapes :
Chaque passage d’un composant à l’autre ajoute de la latence et peut faire perdre des éléments importants de rythme, de timing ou de contexte conversationnel. Avec GPT‑Live‑1, l’écoute et la parole sont intégrées au sein d’un seul modèle vocal. 3
Concrètement, le système peut réagir au fil de l’échange aux interruptions, aux acquiescements ou aux changements de direction de l’utilisateur. Pendant ce temps, un modèle associé peut gérer en arrière-plan les demandes nécessitant davantage de raisonnement ou le recours à des outils. 3
Les développeurs peuvent déléguer cette partie « backend » à un modèle OpenAI, tel que GPT‑6 Astra, ou à un modèle tiers, selon le compromis recherché entre capacités de raisonnement, rapidité et coût. 3
OpenAI met également en avant des réglages via le prompt système pour le ton, le débit et le style de conversation, ainsi que des fonctions adaptées notamment à la téléphonie : gestion du bruit de fond et des silences, fiabilité sur les longues sessions, transcription et texte des réponses, reconnaissance de séquences alphanumériques et pondération de mots-clés. 3
Les sessions vocales GPT‑Live‑1 sont tarifées 0,05 $ par minute, avec une facturation à la seconde, sans arrondi à la minute entière. 2
Ce montant ne couvre toutefois que la couche vocale. L’utilisation du modèle chargé du raisonnement en arrière-plan, ainsi que celle des outils, est facturée séparément. Le coût réel dépend donc aussi du modèle et des outils choisis par le développeur. 2
Les éléments fournis ne permettent pas de confirmer les détails évoqués sur un accès entreprise géré baptisé « Presence », ni une affirmation précise sur l’élargissement des accents, dialectes et langues pris en charge.
OpenAI indique que GPT‑Live‑1 affiche un gain de 30 points de pourcentage sur son benchmark Full Duplex Bench par rapport à GPT‑Realtime‑2.1. Associé à GPT‑6 Astra avec un effort de raisonnement moyen, le modèle se classe également premier sur Tau3, selon l’entreprise. 3
En revanche, les sources fournies ne montrent pas directement les chiffres précis de latence de 1,41 à 0,798 seconde, ni des taux de réussite Tau3 de 86,2 % contre 45,7 %. Ces valeurs précises doivent donc être considérées comme non vérifiées à partir des éléments disponibles.
Yelp affirme que l’intégration de GPT‑Live‑1 dans Yelp Host et Hatch a amélioré la gestion des tours de parole et la précision par rapport à son ancienne architecture vocale. Pour les appels de réservation et de commande de repas, l’entreprise évoque une amélioration notable de la prise en charge des appels et des demandes formulées de façon plus complète et naturelle par les clients. 3
L’application d’apprentissage des langues Speak indique, de son côté, que les apprenants disposent de davantage de temps pour réfléchir avant que le tuteur ne réponde. Elle rapporte une baisse de près de 80 % des interruptions par rapport à ses précédents systèmes fonctionnant par tours successifs. 3
Enfin, le cofondateur et directeur technique d’une entreprise de santé affirme qu’en remplaçant une architecture en cascade, son équipe a simplifié sa base de code de 80 % et supprimé 23 000 lignes de code, afin de permettre des conversations patients plus naturelles en temps réel. 3
Studio Global AI
Cette page comprend une réponse basée sur la source que vous pouvez continuer dans Studio Global.
L’annonce API d’OpenAI date du 10 septembre 2026, et non du 11 septembre.
L’annonce API d’OpenAI date du 10 septembre 2026, et non du 11 septembre. GPT‑Live‑1 est un modèle vocal full duplex disponible de manière générale : il peut écouter et parler simultanément.
Contrairement aux chaînes classiques reconnaissance vocale → modèle de langage → synthèse vocale, il réunit l’écoute et la parole dans un même modèle.