ประกาศเปิดตัว GPT‑Live‑1 ใน API ของ OpenAI ลงวันที่ 10 กันยายน 2026 ไม่ใช่ 11 กันยายน GPT‑Live‑1 ฟังและพูดได้พร้อมกัน ต่างจากระบบเสียงเดิมที่ส่งงานต่อเป็นทอด ๆ ระหว่างถอดเสียง โมเดลภาษา และสังเคราะห์เสียง ระบบรับรู้การพูดแทรกและสัญญาณตอบรับระหว่างสนทนาได้ ขณะให้โมเดลแบ็กเอนด์ทำงานด้านเหตุผลหรือเรียกใช้เครื่องมือ
เผยแพร่โดยรูปภาพสร้างด้วย GPT Image 2
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
ประกาศของ OpenAI ใน API ลงวันที่ 10 กันยายน 2026 ไม่ใช่วันที่ 11 กันยายน โดยบริษัทเปิดตัว GPT‑Live‑1 แบบใช้งานทั่วไป (generally available) ในฐานะเลเยอร์เสียงแบบฟูลดูเพล็กซ์ สำหรับสร้างเอเจนต์เสียงที่สนทนาเป็นธรรมชาติกว่าเดิม โมเดลสามารถฟังและพูดไปพร้อมกัน แทนการรอให้จบเป็นรอบ ๆ ของบทสนทนา 3
ระบบเอเจนต์เสียงทั่วไปมักทำงานต่อกันเป็นลำดับ: แปลงเสียงเป็นข้อความ (speech-to-text) → ให้โมเดลภาษาประมวลผล → แปลงข้อความกลับเป็นเสียง (text-to-speech) ทุกจุดส่งต่องานเพิ่มความหน่วง และอาจทำให้จังหวะ น้ำเสียง หรือบริบทในการคุยหลุดหายไปได้
GPT‑Live‑1 รวมการฟังและการพูดไว้ในโมเดลเสียงเดียว จึงออกแบบมาให้ตอบสนองต่อการพูดแทรกและคำรับสั้น ๆ ระหว่างคุยได้แบบทันที ขณะเดียวกัน โมเดลแบ็กเอนด์สามารถทำงานที่ใช้เหตุผลเชิงลึกหรือเรียกใช้เครื่องมือต่าง ๆ อยู่เบื้องหลัง 3
นักพัฒนาสามารถเลือกมอบงานส่วนแบ็กเอนด์ให้โมเดลของ OpenAI เช่น GPT‑6 Astra หรือใช้โมเดลจากผู้ให้บริการรายอื่นได้ เพื่อปรับสมดุลระหว่างความสามารถด้านเหตุผล ความเร็ว และต้นทุนให้เหมาะกับแต่ละงาน 3
OpenAI ยังระบุความสามารถในการควบคุมน้ำเสียง ความเร็ว และสไตล์การสนทนาด้วย system prompt รวมถึงการนำไปใช้กับระบบโทรศัพท์ การจัดการเสียงรบกวนและความเงียบ ความเสถียรของเซสชันยาวขึ้น ทรานสคริปต์หรือข้อความคำตอบ การรู้จำอักขระและตัวเลข และการให้น้ำหนักคำสำคัญเป็นพิเศษ 3
เซสชันเสียงของ GPT‑Live‑1 มีราคา 0.05 ดอลลาร์สหรัฐต่อนาที และคิดค่าบริการตามจำนวนวินาทีจริง โดยไม่ปัดขึ้นเป็นนาทีเต็ม 2 อย่างไรก็ดี ค่าการใช้งานโมเดลแบ็กเอนด์และเครื่องมือจะถูกคิดแยกออกไป ดังนั้นต้นทุนรวมของแต่ละเซสชันจะขึ้นกับทั้งเลเยอร์เสียง โมเดลที่เลือก และเครื่องมือที่เรียกใช้
2
ข้อมูลที่ให้มายังไม่เพียงพอจะยืนยันรายละเอียดการเข้าถึงระดับองค์กรแบบจัดการที่เรียกว่า “Presence” หรือข้ออ้างเรื่องการเพิ่มสำเนียง ภาษาถิ่น และภาษาแบบเฉพาะเจาะจง
OpenAI ระบุว่า GPT‑Live‑1 ทำคะแนน Full Duplex Bench ดีขึ้น 30 จุดเปอร์เซ็นต์เมื่อเทียบกับ GPT‑Realtime‑2.1 และเมื่อจับคู่ GPT‑Live‑1 กับ GPT‑6 Astra ที่ตั้งค่าความพยายามด้านเหตุผลระดับกลาง ระบบดังกล่าวขึ้นอันดับหนึ่งบน Tau3 3
อย่างไรก็ตาม หลักฐานที่ให้มาไม่ได้แสดงตัวเลขเวลาแฝง 1.41 เทียบกับ 0.798 วินาที หรืออัตราผ่าน Tau3 ที่ 86.2% เทียบกับ 45.7% โดยตรง จึงยังไม่ควรถือว่าตัวเลขเฉพาะเหล่านี้ยืนยันได้จากข้อมูลชุดนี้
Yelp ระบุว่าการนำ GPT‑Live‑1 ไปใช้กับ Yelp Host และ Hatch ช่วยให้การผลัดกันพูดและความแม่นยำดีขึ้นกว่าสถาปัตยกรรมเสียงเดิม สำหรับสายจองโต๊ะและสั่งอาหาร บริษัทบอกว่าอัตราการจัดการสายดีขึ้น และผู้โทรพูดเป็นประโยคที่สมบูรณ์และเป็นธรรมชาติมากขึ้น 3
Speak รายงานว่าโมเดลทำให้ผู้เรียนภาษามีเวลาคิดก่อนติวเตอร์ตอบมากขึ้น ลดการขัดจังหวะลงเกือบ 80% เมื่อเทียบกับระบบเดิมที่ทำงานเป็นรอบผลัดกันพูด 3
ส่วนผู้ร่วมก่อตั้งและ CTO ของบริษัทด้านสุขภาพรายหนึ่งกล่าวว่า การเปลี่ยนจากระบบแบบต่อเป็นทอดช่วยให้โค้ดเบสเรียบง่ายขึ้น 80% และตัดโค้ดออกได้ 23,000 บรรทัด ส่งผลให้สนทนากับผู้ป่วยแบบเรียลไทม์ได้เป็นธรรมชาติมากขึ้น 3
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
ประกาศเปิดตัว GPT‑Live‑1 ใน API ของ OpenAI ลงวันที่ 10 กันยายน 2026 ไม่ใช่ 11 กันยายน
ประกาศเปิดตัว GPT‑Live‑1 ใน API ของ OpenAI ลงวันที่ 10 กันยายน 2026 ไม่ใช่ 11 กันยายน GPT‑Live‑1 ฟังและพูดได้พร้อมกัน ต่างจากระบบเสียงเดิมที่ส่งงานต่อเป็นทอด ๆ ระหว่างถอดเสียง โมเดลภาษา และสังเคราะห์เสียง
ระบบรับรู้การพูดแทรกและสัญญาณตอบรับระหว่างสนทนาได้ ขณะให้โมเดลแบ็กเอนด์ทำงานด้านเหตุผลหรือเรียกใช้เครื่องมือ