עם זאת, חשוב להדגיש: המודל עדיין רחוק מהשקה, והמספר של 10 טריליון הוא תקרת יעד ולא בהכרח גודלו הסופי. בנוסף, מספר הפרמטרים לבדו אינו מדד ישיר לאיכות או ליכולת של מודל. Reuters ציינה כי לא הצליחה לאמת באופן עצמאי את הדיווח המקורי של Financial Times .
לפי דיווח של Financial Times מ-7 באוגוסט 2026, ByteDance החלה לאמן מודל שפה גדול שעשוי לכלול עד 10 טריליון פרמטרים . הפרויקט נמצא כעת בשלב האימון המקדים — השלב שבו המודל לומד כמויות עצומות של טקסט, קוד ונתונים לפני הכוונון הסופי.
שלב האימון המקדים עשוי להימשך בדרך כלל שלושה עד שישה חודשים, ולאחריו נדרשים שלבי כוונון, בדיקות בטיחות והכנה להפצה . לכן, גם אם האימון מתקדם כמתוכנן, אין משמעות הדבר שהמודל יהיה זמין לציבור בזמן הקרוב.
היקפו הסופי עדיין אינו סגור. דיווח נפרד מ-LatePost דיבר מוקדם יותר על מודל עם יותר מ-5 טריליון פרמטרים, כך שייתכן שהפרויקט הורחב בהמשך .
על פי הערכות תעשייה שצוטטו בדיווחים, Mythos 5 של Anthropic כולל כ-8 טריליון פרמטרים . יעד של 10 טריליון יציב את ByteDance באותה ליגה מבחינת היקף ארכיטקטוני — ואף מעט מעליו.
| מודל | מספר פרמטרים משוער | מצב והערות |
|---|---|---|
| המודל החדש של ByteDance | עד 10 טריליון | נמצא באימון מקדים; יהיה הגדול ביותר שיוחס לחברה סינית אם יושלם בהיקף זה |
| Anthropic Claude Mythos 5 | כ-8 טריליון | זמין בעיקר לארגונים שנבדקו במסגרת Project Glasswing; גרסה ציבורית מוגבלת יותר, Claude Fable 5, הושקה ביוני 2026 |
| Moonshot AI Kimi K3 | 2.8 טריליון | המודל של ByteDance עשוי להיות גדול ממנו ביותר מפי שלושה |
| מודל הדגל של OpenAI | לא פורסם | הערכות חיצוניות מציבות אותו בטווח של כמה טריליוני פרמטרים, אך OpenAI אינה מפרסמת את המספר הרשמי |
ההשוואה הזו מרשימה, אך היא גם מוגבלת. פרמטרים הם רכיבים מספריים בתוך רשת עצבית — מעין משתנים שהמודל מתאים במהלך האימון. יותר פרמטרים עשויים לאפשר ייצוג מורכב יותר של מידע, אבל הם אינם מבטיחים בהכרח תשובות טובות יותר, יעילות גבוהה יותר או ביצועים טובים יותר במשימות מעשיות.
הדיווחים מדברים על 10 טריליון פרמטרים בסך הכול. במודלים מתקדמים רבים נעשה שימוש בארכיטקטורת Mixture of Experts — MoE, שבה רק חלק מהפרמטרים מופעל בכל פעם שהמודל מעבד בקשה.
במילים פשוטות, מודל יכול להכיל 10 טריליון פרמטרים בארכיטקטורה המלאה, אך להפעיל בכל שאילתה רק חלק מהם — למשל 1–2 טריליון. לכן, כדי להשוות ביצועים ועלויות חישוב באופן הוגן, צריך לדעת לא רק כמה פרמטרים קיימים, אלא גם כמה מהם פעילים בכל שלב.
נכון לעכשיו, הדיווחים לא הבהירו אם המספר של 10 טריליון מתייחס לפרמטרים כוללים, לפרמטרים פעילים או לשילוב של מדדים שונים. זו אינה סמנטיקה בלבד; מדובר בהבדל שעשוי לשנות לחלוטין את משמעות ההשוואה ל-Mythos 5 ולמודלים אחרים .
מייסד ByteDance, ג'אנג יימינג, הנחה לפי דיווחים את צוות Seed שלא להשתמש ב-AI distillation — שיטה שבה מודל חדש לומד מהפלטים של מודל חזק יותר — כדי לשפר את המודל החדש .
לפי דיווח Reuters, ג'אנג אמר לעובדים כי החברה מוכנה לספוג הישגים חלשים יותר בטווח הקצר כדי לבנות יכולת עצמאית לאורך זמן . בדיווחים נוספים תוארה הגישה כ"חשיבה לטווח ארוך" וכוויתור על סיפוק מיידי .
זיקוק מודלים הפך לכלי נפוץ בתעשיית ה-AI, משום שהוא מאפשר למעבדות ללמוד במהירות ממערכות חזקות יותר. ההחלטה של ByteDance להימנע ממנו, אם אכן תיושם כפי שתוארה, משקפת ניסיון לבנות את המודל באופן עצמאי יותר — גם אם הדבר יגרום לחברה להישאר זמנית מאחור מול מתחרות מקומיות .
לגישה הזו יש גם ממד משפטי וגיאופוליטי. ByteDance מתמודדת ממילא עם מערכת יחסים רגולטורית מורכבת מול ממשלת ארצות הברית סביב TikTok. הימנעות מהסתמכות על פלטים של מודלים זרים עשויה לצמצם, לפחות מבחינת החברה, חשיפה למחלוקות על זכויות שימוש, קניין רוחני ובקרות יצוא .
הפרויקט נמצא בידי חטיבת Seed, זרוע המחקר המרכזית של ByteDance בתחום מודלי היסוד. החטיבה הוקמה בתחילת 2023, בעקבות הופעת ChatGPT והאצת מרוץ מודלי השפה .
הפרטים המרכזיים על הארגון:
המודל החדש מגיע על רקע מאבק רחב יותר על עליונות בתחום הבינה המלאכותית. ארצות הברית הגבילה את יצואם לסין של שבבים מתקדמים המשמשים לאימון מודלים, ולכן ByteDance נדרשת להסתמך על חומרה מקומית ועל מלאי שבבים שנצבר מראש .
לפי דיווחים, החברה בונה עבור הפרויקט תשתית מחשוב רחבת היקף, וג'אנג יימינג עצמו מעורב בבחינת הקצאת משאבי המחשוב . במקביל, ההצלחה של DeepSeek R1 בינואר 2025 חיזקה בסין את התחושה שניתן להגיע לתוצאות תחרותיות גם תחת מגבלות חומרה .
גם בצד האמריקאי, מודלי החזית הפכו לנכס אסטרטגי. היכולות הרגישות של Mythos 5 בתחומי הסייבר והביולוגיה הוגבלו בארצות הברית, והגישה אליו הוחזרה באופן חלקי רק לארגונים שהוגדרו מהימנים . ההתפתחויות האלה ממחישות שמודלים מתקדמים אינם נתפסים עוד רק כמוצרים מסחריים, אלא גם כתשתיות בעלות משמעות ביטחונית ולאומית.
ByteDance עדיין לא מסרה אם המודל בעל 10 הטריליון פרמטרים יופץ לציבור או יישאר לשימוש פנימי. עד כה, החברה נקטה גישה יחסית סגורה: היא אינה מפרסמת בקוד פתוח את מודלי הדגל שלה, בניגוד ל-Meta עם Llama ולכמה חברות סיניות אחרות, בהן DeepSeek.
המותג הצרכני המרכזי של ByteDance בתחום ה-AI הוא Doubao (豆包), המשלב מודלי Seed בשירותי צ'אט, עוזרים דיגיטליים ויצירת תוכן . סדר העדיפויות של החברה ל-2026 כולל גם מודלי עולם, סוכן תכנות בשם Seedance והמשך המסחור של Doubao .
אם המודל הענק יושלם, סביר שהוא ישמש כתשתית למוצרים האלה ולמערכות פנימיות נוספות, ולא בהכרח יושק כמודל פתוח ונפרד. אבל בשלב זה מדובר עדיין בפרויקט עם לא מעט סימני שאלה: ההיקף הסופי אינו ידוע, לוח הזמנים אינו סגור, ואין ודאות שמודל גדול יותר אכן יוביל ליכולת פורצת דרך.
השורה התחתונה: ByteDance מהמרת על בניית יכולת AI עצמאית בקנה מידה עצום. היא עושה זאת באמצעות צוות Seed המונה כ-2,000 עובדים, בהובלת וו יונגחווי, ובניגוד לקיצור הדרך של זיקוק מודלים מתחרים. אם המהלך יצליח, הוא עשוי להפוך את החברה לשחקנית מרכזית עוד יותר במרוץ ה-AI העולמי; אך נכון לעכשיו, מדובר בראש ובראשונה בהימור ארוך טווח — לא במוצר שאפשר כבר להשתמש בו.