Thông báo API của OpenAI được đăng ngày 10/9/2026, không phải 11/9/2026. GPT‑Live‑1 là lớp giọng nói song công hoàn toàn, cho phép AI nghe và nói đồng thời thay vì chờ từng lượt hội thoại.
Đăng bởiHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
OpenAI cho biết thông báo đưa GPT‑Live‑1 vào API được đăng ngày 10/9/2026, không phải ngày 11/9. Đây là mô hình giọng nói song công hoàn toàn (full duplex), nhằm giúp các tác nhân AI có thể nghe và nói cùng lúc, gần với nhịp hội thoại tự nhiên hơn. 3
Nhiều tác nhân giọng nói trước đây vận hành theo một chuỗi gồm ba bước: chuyển giọng nói thành văn bản (speech-to-text), đưa văn bản qua mô hình ngôn ngữ hoặc suy luận, rồi chuyển câu trả lời thành giọng nói (text-to-speech). Mỗi lần chuyển tiếp có thể làm tăng độ trễ, đồng thời làm suy giảm thông tin về thời điểm, ngữ cảnh và nhịp điệu của cuộc trò chuyện. 3
GPT‑Live‑1 gộp việc lắng nghe và phản hồi bằng lời nói vào một mô hình giọng nói duy nhất. Vì vậy, mô hình có thể xử lý lời ngắt ngang hay những tín hiệu phản hồi ngắn như xác nhận, đồng tình ngay khi chúng diễn ra; trong khi đó, một mô hình hậu trường có thể đảm nhiệm suy luận sâu hơn hoặc gọi công cụ. 3
Nhà phát triển có thể để phần hậu trường dùng mô hình của OpenAI, chẳng hạn GPT‑6 Astra, hoặc một mô hình bên thứ ba. Cách triển khai này cho phép lựa chọn sự cân bằng giữa năng lực suy luận, tốc độ và chi phí tùy từng tác vụ. 3
OpenAI cho biết GPT‑Live‑1 cung cấp các tùy chỉnh qua system prompt để kiểm soát giọng điệu, nhịp nói và phong cách hội thoại. Các điểm được nêu gồm khả năng triển khai cho điện thoại, xử lý tiếng ồn nền và khoảng lặng, tăng độ ổn định trong các phiên dài, cung cấp bản chép lời hoặc văn bản phản hồi, nhận diện ký tự chữ-số và thiên lệch theo từ khóa. 3
Các thông tin được cung cấp không đủ để xác nhận các chi tiết về quyền truy cập doanh nghiệp dạng quản lý mang tên “Presence”, cũng như tuyên bố cụ thể về việc mở rộng hỗ trợ giọng vùng miền, phương ngữ và ngôn ngữ.
OpenAI cho biết GPT‑Live‑1 cải thiện 30 điểm phần trăm trên bài đánh giá Full Duplex Bench so với GPT‑Realtime‑2.1. Khi ghép GPT‑Live‑1 với GPT‑6 Astra ở mức suy luận trung bình, hệ thống này đứng đầu trên Tau3, theo công bố của công ty. 3
Tuy nhiên, nguồn thông tin được cung cấp không hiển thị độc lập các số liệu độ trễ cụ thể 1,41 giây so với 0,798 giây, hoặc tỷ lệ vượt qua Tau3 86,2% so với 45,7%. Do đó, các con số này chưa thể được xác minh từ bằng chứng hiện có.
Yelp cho biết việc tích hợp GPT‑Live‑1 vào Yelp Host và Hatch đã cải thiện khả năng luân phiên lượt nói và độ chính xác so với kiến trúc giọng nói trước đó. Với cuộc gọi đặt bàn và gọi món, Yelp ghi nhận tỷ lệ xử lý cuộc gọi tăng lên đáng kể, đồng thời người gọi nói thành các câu đầy đủ và tự nhiên hơn. 3
Speak cho biết mô hình tạo thêm thời gian để người học ngôn ngữ suy nghĩ trước khi gia sư AI phản hồi, nhờ đó giảm gần 80% tình trạng ngắt lời so với các hệ thống luân phiên lượt nói trước đây. 3
Một đồng sáng lập kiêm giám đốc công nghệ của công ty trong lĩnh vực y tế cũng nói rằng việc thay thế hệ thống phân tầng bằng GPT‑Live‑1 đã giúp đơn giản hóa 80% cơ sở mã và loại bỏ 23.000 dòng mã, từ đó hỗ trợ các cuộc trò chuyện thời gian thực tự nhiên hơn với bệnh nhân. 3
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Thông báo API của OpenAI được đăng ngày 10/9/2026, không phải 11/9/2026.
Thông báo API của OpenAI được đăng ngày 10/9/2026, không phải 11/9/2026. GPT‑Live‑1 là lớp giọng nói song công hoàn toàn, cho phép AI nghe và nói đồng thời thay vì chờ từng lượt hội thoại.
Mô hình hợp nhất khả năng nghe và nói, thay cho chuỗi chuyển giọng nói thành văn bản – mô hình ngôn ngữ – chuyển văn bản thành giọng nói.