SeedRealtime מחליף את הצנרת הזו בארבעה יתרונות מרכזיים:
הבעיה הקשה ביותר ש-SeedRealtime פתרה היא "מתי לדבר, מתי להקשיב" בזרם מולטימודלי רציף. עוזרים מסורתיים מבוססי תורות (חצי דופלקס) ממתינים להפסקת דיבור לפני שהם מגיבים — מה שאומר שהם קוטעים או שותקים .
הארכיטקטורה במלוא הדופלקס של SeedRealtime מאפשרת לו:
תוצאות הערכה אנושית של קצה-לקצה מראות שלעומת מודלים עוקתים, בעיות קצב השיחה האודיו-וידאו של SeedRealtime הופחתו בחצי. תופעות כמו "הפרעה לפני סיום, תגובה מאוחרת לאחר דיבור, או הפעלה שווא על ידי רעשי רקע" ירדו משמעותית, בעוד שההסתברות לשיחה בודדת מלאה וחלקה עלתה באופן ניכר .
SeedRealtime הוא האבולוציה המולטימודלית של עבודת הדופלקס המלא המוקדמת יותר של ByteDance. Seeduplex הושק ב-9 באפריל 2026 כ-LLM מקורי במלוא הדופלקס המבוסס על דיבור בלבד – הוא יכול היה להקשיב ולדבר בו-זמנית, תוך מעבר מהפרדיגמה הקודמת של חצי דופלקס .
| Seeduplex (9 באפריל 2026) | SeedRealtime (5 באוגוסט 2026) |
|---|---|
| דופלקס מלא מבוסס אודיו בלבד | דופלקס מלא מבוסס אודיו + וידאו + טקסט |
| "הקשב תוך כדי דיבור" לקול | "צפה, הקשב ודבר" בו-זמנית |
| מודאליות יחידה (דיבור) | ארכיטקטורה מולטימודלית אחידה |
SeedRealtime לוקח את פריצת הדרך המרכזית של Seeduplex — עיבוד במלוא הדופלקס של קצה-לקצה — ומרחיב אותה כדי לשלב הבנה חזותית בזמן אמת, המאפשרת למודל להגיב למה שהוא רואה בנוסף למה שהוא שומע .
SeedRealtime פרוס במלואו באפליקציית Doubao (豆包) — העוזר החכם של ByteDance – וזמין לכל המשתמשים. משתמשים מעדכנים את Doubao לגרסה העדכנית ביותר ונכנסים לממשק שיחת הווידאו דרך תכונת "שיחת טלפון" כדי לחוות אינטראקציה עם AI בזמן אמת עם אודיו ווידאו .
ByteDance הדגימה מספר מקרי שימוש: זיהוי אנשים שונים בשיחה קבוצתית ומעקב אחר מי שמדבר; עזרה לתייר זר להבין תפריט סיני והסברים של מלצר בזמן אמת; התבוננות רציפה בתערוכה במוזיאון והתראה יזומה כאשר חפץ מסוים מופיע; הדרכת משתמש בתפעול מכונת קפה ותיקון שגיאות על סמך שינויים חזותיים; ניטור דפים תוך כדי קריאת מאמר והצגת התראה אוטומטית כאשר פרק יעד מופיע .
SeedRealtime הוא חלק מקצב שחרור מואץ של דגמי AI של ByteDance. צוות Seed שיגר מספר מודלים מאמצע 2025 עד אמצע 2026: