GPT‑Live‑1 זמין ב‑API מ־10 בספטמבר 2026, במחיר של 0.05 דולר לדקה עבור שכבת הקול הקדמית. הארכיטקטורה הדו־כיוונית המלאה מאפשרת למודל להאזין ולדבר במקביל, כדי להתמודד בצורה טבעית יותר עם קטיעות, אישורים קצרים ורעשי רקע.
פורסם על ידינערך באמצעות GPT-5.6 Terraהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is OpenAI’s GPT-Live-1 voice model, when was it released in the API and at what price, how does its full-duplex single-model architectu. Article summary: GPT‑Live‑1 is OpenAI’s flagship API voice model for natural, expressive, full‑duplex conversations: it can listen and generate speech concurrently, with smooth interruption handling. It entered the API on September 10, 2. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
GPT‑Live‑1 הוא מודל קול של OpenAI למפתחים, שנבנה לשיחות שנשמעות פחות כמו רצף של הקלטות בתורות ויותר כמו שיחה חיה. הוא זמין ב‑API מאז 10 בספטמבר 2026, במחיר של 0.05 דולר לדקה עבור שכבת הקול הקדמית. מודל ההסקה, הכלים והתשתיות שמחוברים מאחור מתומחרים בנפרד. 3
5
OpenAI ממצבת אותו כמודל המוביל שלה לשיחות קוליות טבעיות ואקספרסיביות, עם טיפול חלק בקטיעות. 2
3
סוכן קולי מסורתי בנוי בדרך כלל כשרשרת: המרת דיבור לטקסט (STT), מודל שפה שמייצר תשובה טקסטואלית, ואז המרת טקסט לדיבור (TTS). הגישה הזו יכולה לעבוד היטב, אך כל שלב מוסיף מסירה בין רכיבים — והאפליקציה צריכה לתאם בעצמה השהיות, שינויי כוונה וקטיעות של המשתמש. 3
GPT‑Live‑1 מתואר כמודל קולי יחיד שמעבד אודיו נכנס ויוצא. בפועל, תכנון של דו־כיווניות מלאה מאפשר לו להמשיך להאזין בזמן שהוא מדבר. הכוונה היא שיוכל להגיב לקטיעה או לאישור קצר, בלי לפרש כל צליל, שתיקה או שיחה ברקע כתור חדש שמחייב תשובה. 3
היתרון אינו רק מהירות הפקת הדיבור. הוא קשור לניהול השיחה: להבין שהאדם עדיין חושב, לזהות מתי הוא מתפרץ לדברי הסוכן, ולהבדיל בין "כן" קצר שמאותת על הקשבה לבין בקשה לתשובה חדשה. 3
GPT‑Live‑1 לא חייב לבצע בעצמו את כל הלוגיקה העסקית. הוא יכול לנהל את השיחה בזמן אמת ובמקביל להעביר הסקה מורכבת, קריאות לכלים או ביצוע פעולות למודל ולמסגרת סוכן שנבחרו בקצה האחורי. 3
לכן מפתחים יכולים, למשל:
כלומר, מדובר במערכת דו־שכבתית: GPT‑Live‑1 מטפל באינטראקציה הקולית החיה, ואילו ה‑backend מספק הסקה, גישה לנתונים עסקיים ופעולות. המשמעות התקציבית חשובה: המחיר המפורסם לדקת קול אינו העלות הכוללת של הסוכן. גם הסקה, כלים, טלפוניה ושירותים נלווים עשויים להוסיף עלויות. 3
5
לפי OpenAI, אפשר לכוון באמצעות ה‑system prompt את הטון, הקצב והסגנון השיחתי של המודל. GPT‑Live‑1 מספק גם תמלולים וטקסט תגובה, תומך בהבנת רצפים אלפאנומריים ובהטיית זיהוי לפי מילות מפתח, ומציע זיהוי תורות דיבור למוצרים שעדיין זקוקים לגבול מפורש בין תור לתור. 3
הוא מיועד גם למפגשים ארוכים ולסוכנים טלפוניים — למשל בשירות לקוחות ובהזמנות. OpenAI מציינת שהמודל יכול להתמודד עם שתיקות ורעשי רקע בלי לתאר בקול כל שלב פנימי, התנהגות רלוונטית במיוחד לשיחות טלפון ולסביבות פחות מבוקרות. 3
החומרים שסופקו אינם קובעים רשימה סופית של שפות נתמכות או מפרטים פקדי API מדויקים למבטאים ולניבים. לפני פריסה בסביבה שבה אלה דרישות מהותיות, יש לבדוק את תיעוד ה‑API העדכני.
OpenAI מדווחת על שיפור של 30 נקודות אחוז לעומת GPT‑Realtime‑2.1 במבחן Full Duplex Bench, שמודד התנהגות קולית אינטראקטיבית כגון חלוקת תורות, הפסקות, קטיעות, אישורים קצרים ודיבור ברקע. 3
בשילוב עם GPT‑6 Astra ברמת מאמץ הסקה בינונית, OpenAI מדווחת גם על דירוג ראשון ב‑Tau3 — מדד מקצה לקצה לסוכנים קוליים. רכיב שירות הלקוחות במדד כולל משימות מדוברות בתחומי תעופה, קמעונאות וטלקום. 3
דיווחים משניים מציגים נתונים מספריים מדויקים יותר על זמן חילופי תורות ועל ציוני Tau3, אך החומר הראשוני שסופק כאן אינו כולל את הערכים הללו. לכן המסקנה המבוססת היא ש‑OpenAI מדווחת על שיפור ניכר בהתנהגות האינטראקטיבית ועל תוצאה מובילה ב‑Tau3 עבור השילוב עם Astra — לא שכל הטמעה תשחזר מספר מדד מסוים. 3
7
OpenAI מציגה כמה יישומים מוקדמים של סוכנים קוליים:
אלו בדיוק המצבים שבהם דו־כיווניות מלאה עשויה להיות בעלת ערך: כשהמתקשר מהסס, מתקן את עצמו, מאשר דבר מה באמצע משפט או קוטע את הסוכן בלי לרצות להתחיל את כל התהליך מחדש.
מחיר GPT‑Live‑1 הוא 0.05 דולר לדקה עבור שכבת הקול הקדמית. אפשר לצמד אליו מודל backend ומסגרת סוכן לפי בחירת המפתח, אך הבחירות האלה קובעות חלק מהעלות הכוללת, מפני שהן מחויבות בנפרד משכבת הקול. 3
5
OpenAI מציינת גם את OpenAI Presence כדרך נוספת לבנות תהליכים קוליים המבוססים על GPT‑Live‑1 לאינטראקציה קולית בזמן אמת. עם זאת, החומר שסופק אינו מגדיר את תנאי הזכאות הארגונית, התנאים המסחריים, מודל האירוח או תהליך הגישה ל‑Presence; אין להסיק פרטים אלה מהודעת ה‑API בלבד. 3
לצוותים שבוחנים את המודל, השאלה המרכזית רחבה יותר מהמחיר לדקה: כמה ערך עסקי מייצרת שיחה זורמת יותר, ואיזה שילוב של מודל backend וכלים יספק את רמת האמינות הדרושה בעלות כוללת סבירה?
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
GPT‑Live‑1 זמין ב‑API מ־10 בספטמבר 2026, במחיר של 0.05 דולר לדקה עבור שכבת הקול הקדמית.
GPT‑Live‑1 זמין ב‑API מ־10 בספטמבר 2026, במחיר של 0.05 דולר לדקה עבור שכבת הקול הקדמית. הארכיטקטורה הדו־כיוונית המלאה מאפשרת למודל להאזין ולדבר במקביל, כדי להתמודד בצורה טבעית יותר עם קטיעות, אישורים קצרים ורעשי רקע.
OpenAI מדווחת על שיפור של 30 נקודות אחוז ב‑Full Duplex Bench לעומת GPT‑Realtime‑2.1, ועל מקום ראשון ב‑Tau3 בשילוב GPT‑6 Astra.