Qwen3.8 Flash הוא מודל מולטי־מודאלי לשימוש בייצור, עם מחיר של 0.16 דולר למיליון טוקני קלט ו 0.47 דולר למיליון טוקני פלט. Flash Next הוא מודל בעל משקולות פתוחות, עם מודל מרכזי של 125 מיליארד פרמטרים, 51 מיליארד פרמטרים בהטמעות N gram ורק 6 מיליארד פרמטרים פעילים בכל טוקן.
פורסם על ידינערך באמצעות GPT-5.6 Lunaהתמונות נוצרו באמצעות GPT Image 1.5
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Alibaba announce with the release of the multimodal Qwen3.8-Flash and the open-weight Qwen3.8-Flash-Next prototype for its future Q. Article summary: Alibaba is pairing a low-cost production model with an open-weight architectural preview: it is trying to make Qwen a widely deployed cloud service while seeding the developer ecosystem for the forthcoming Qwen4 generati. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Alibaba מציגה שתי גרסאות קרובות בשם Qwen3.8-Flash, אך התפקיד שלהן שונה. Qwen3.8-Flash הוא המוצר המיועד להפעלה בענן ולשימושים מסחריים, בעוד Qwen3.8-Flash-Next הוא מודל בעל משקולות פתוחות שנועד לשמש הצצה לארכיטקטורה העתידית של משפחת Qwen4. 5
15
האסטרטגיה שמאחורי המהלך ברורה: למשוך עומסי עבודה ארגוניים באמצעות שירות AI זול במיוחד, ובמקביל להרחיב את קהילת המפתחים סביב Qwen באמצעות מודל שאפשר להוריד, להתאים ולהפעיל באופן עצמאי. עם זאת, חשוב לזכור שחלק ניכר מנתוני הביצועים והעלות מגיע מ-Alibaba או מכרטיס המודל שלה, ולא מבדיקות בלתי תלויות.
Alibaba מתארת את Qwen3.8-Flash כמודל מולטי־מודאלי מסוג Mixture of Experts — ארכיטקטורה שבה רק חלק מהפרמטרים מופעל בכל עיבוד — המיועד לתכנות, עבודה משרדית ומשימות בעלות הקשר ארוך. חלון ההקשר שלו הוא 262,144 טוקנים כברירת מחדל, וניתן להרחיבו עד מיליון טוקנים עבור קבצים גדולים, שיחות ממושכות ותהליכי מחקר. 5
15
המחיר שהוכרז עבור QwenCloud הוא 0.16 דולר למיליון טוקני קלט ו-0.47 דולר למיליון טוקני פלט. Alibaba מסרה שממשק ה-API לייצור יהיה זמין בקרוב, ודיווחים מאוחרים יותר תיארו את QwenCloud כשירות שמפעיל את המודל במחירים האלה. 4
15
במחיר כזה, Flash הוא לא רק השקה של מודל אלא גם מוצר תשתית. מפתחים יכולים לבחון עיבוד מסמכים, סוכני קוד ותהליכי עבודה בהיקף גדול בלי לשלם את הפרמיה שמזוהה בדרך כלל עם מודלים מתקדמים במיוחד.
Flash-Next אינו פשוט מסלול API נוסף. מדובר במודל בעל משקולות פתוחות, שנועד להציג רעיונות ארכיטקטוניים שצפויים להופיע במשפחת Qwen4. לפי מאגר המודל, הוא כולל 125 מיליארד פרמטרים במודל המרכזי, 51 מיליארד פרמטרים נוספים בהטמעות N-gram, ורק 6 מיליארד פרמטרים פעילים בכל טוקן.
זהו תכנון דליל מסוג Mixture of Experts: המודל מכיל מאגר גדול של פרמטרים, אך בכל שלב משתמש רק בחלק קטן ממנו. באופן עקרוני, הדבר עשוי להפחית את כמות החישוב לכל טוקן, תוך שמירה על קיבולת גבוהה יותר מזו של מודל צפוף בעל גודל דומה.
כרטיס המודל מציין חלון הקשר מקומי של 262,144 טוקנים, שניתן להרחיב עד מיליון טוקנים באמצעות YaRN. 13 מכיוון ש-Flash ו-Flash-Next הם מוצרים נפרדים, מפתחים צריכים לבדוק את מגבלות ההקשר, אופן ההפעלה ודרישות הזיכרון המדויקות בתיעוד של הגרסה שבה הם מתכוונים להשתמש.
| מאפיין | Qwen3.8-Flash | Qwen3.8-Flash-Next |
|---|---|---|
| תפקיד עיקרי | מודל ענן לשימושי ייצור | הצצה פתוחה לארכיטקטורה המיועדת ל-Qwen4 |
| שימושים | תכנות מולטי־מודאלי, עבודה משרדית וסוכני AI | תכנות מולטי־מודאלי, עבודה משרדית ומשימות סוכנים ארוכות טווח |
| חלון הקשר | 262,144 טוקנים כברירת מחדל; ניתן להרחבה עד מיליון | 262,144 טוקנים באופן מקומי; לפי הדיווחים ניתן להרחיב עד מיליון באמצעות YaRN |
| מחיר בענן | 0.16 דולר למיליון טוקני קלט; 0.47 דולר למיליון טוקני פלט | לא נקבע מחיר API של Alibaba עבור המשקולות הפתוחות |
| נתוני ארכיטקטורה מרכזיים | Alibaba מציגה את סדרת Flash כמודל מולטי־מודאלי מסוג MoE | 125 מיליארד פרמטרים במודל המרכזי, 51 מיליארד בהטמעות N-gram ו-6 מיליארד פעילים בכל טוקן |
| זמינות | ממשק QwenCloud לייצור הוכרז ל-26 באוגוסט 2026 | המשקולות ופרטי כרטיס המודל הופיעו בסוף אוגוסט 2026 |
התזמון מחזק את הקשר בין המוצרים. מאגר Flash-Next וחומרי כרטיס המודל הופיעו לפני ההכרזה על שירות הייצור או במקביל אליה, וכך סיפקו למפתחים הצצה מוקדמת לארכיטקטורה בזמן ש-Alibaba הכינה את השירות המארח. 7
Alibaba טוענת שסדרת Flash דורשת בערך תשיעית מעלות האימון של Qwen3.7-Plus, תוך שיפור בביצועים — במיוחד בתכנות ובמשימות משרדיות. 5
15
זו טענה גדולה, אך יש להתייחס אליה כהשוואה שמסרה החברה ולא כמחקר עלויות שעבר ביקורת בלתי תלויה. עלות אימון תלויה במחירי חומרה, משך האימון, הכנת הנתונים, ניסיונות כושלים ושיטת החשבונאות. עם זאת, הארכיטקטורה הדלילה מספקת בסיס טכני סביר לדגש של Alibaba על יעילות: רק חלק מהפרמטרים הזמינים מופעל עבור כל טוקן.
מבחינת לקוחות, ההבחנה פשוטה יותר. מחיר ה-API של Flash הוא נתון שאפשר להשתמש בו ישירות לתכנון תקציב; טענת "תשיעית מהעלות" היא בשלב זה בעיקר איתות טכנולוגי ואסטרטגי, עד שיתפרסמו מדידות חיצוניות הניתנות להשוואה.
כרטיס המודל של Flash-Next מציג את התוצאות הבאות:
בטבלת ההשוואה של כרטיס המודל, Flash-Next מקבל ציון גבוה יותר מהתוצאה המוצגת עבור Claude Opus 4.6 Max ב-SWE-bench Pro, ב-SWE-bench Multilingual, ב-CoWorkBench וב-JobBench. לדוגמה, ב-SWE-bench Pro ההשוואה המדווחת היא 62.5 לעומת 53.4, וב-SWE-bench Multilingual — 81.0 לעומת 77.5.
התוצאות מצביעות על ביצועים חזקים במשימות הנדסת תוכנה ובמשימות משרדיות המבוצעות בידי סוכנים. הן אינן מוכיחות ש-Flash-Next טוב יותר מ-Claude או מכל מערכת חזיתית אחרת בכל משימה. הנתונים פורסמו בידי ספק המודל, מערכי הבדיקה עשויים להיות שונים, ואין להשליך אוטומטית את תוצאות Flash-Next על כל פריסה של Qwen3.8-Flash בייצור.
המקורות מתארים את Flash-Next כמודל בעל משקולות פתוחות. סיכום מודל אחד מציין רישיון בשם qwen-community-1.0, אך מפתחים צריכים לאמת את הרישיון המחייב במאגר הרשמי ובכרטיס המודל לפני הפצה מסחרית, אימון נוסף או הפעלה כשירות. 6
"משקולות פתוחות" אינן אומרות שכל שימוש מותר ללא הגבלה. הרישיון עשוי לכלול תנאים הנוגעים להפצה מחדש, מתן קרדיט, שימושים מותרים או מודלים נגזרים. המידע הקיים אינו מספיק כדי לקבוע באופן גורף מהן ההרשאות המסחריות של כל רכיב בהשקה.
השקת המודלים מגיעה בזמן ש-Alibaba מגדילה במהירות את השקעותיה בתשתיות AI. לפי Reuters, הכנסות הענן הרבעוניות עלו ב-45%, בעוד ההשקעות ההוניות גדלו ב-75% והרווח הנקי הרבעוני ירד ב-75%. 18
Reuters דיווחה גם ש-Alibaba גייסה או פעלה לגיוס של 10 מיליארד דולר באמצעות הקצאת מניות בהונג קונג, כדי לממן את שאיפות ה-AI שלה. יחד, הנתונים מציגים את המחיר של אסטרטגיית Qwen: הביקוש לענן ולמחשוב AI גדל, אך בניית הקיבולת מפעילה לחץ מיידי על הרווחים ועל תזרים המזומנים.
לכן מחיר נמוך עשוי להיות שימושי מבחינה אסטרטגית גם אם הוא מצמצם את שולי הרווח בטווח הקצר. שירות inference זול יכול להגדיל את ניצולת תשתיות הענן של Alibaba, למשוך עומסי עבודה ארגוניים ולהפוך את Qwen לאפשרות ברירת מחדל עבור מפתחים שבונים יישומים עם הקשר ארוך.
Flash-Next מרחיב את החשיפה של Alibaba אל מעבר ל-API שלה. מפתחים יכולים לבדוק את המודל, להתאים אותו ולהפעיל אותו בעצמם, וכך להכיר את הכלים ואת הארכיטקטורה של Qwen בלי להתחייב מיד ל-QwenCloud.
מודל הפצה כזה עשוי לסייע ל-Alibaba בכמה דרכים:
הראיות תומכות בפרשנות האסטרטגית הזו, אך אינן מוכיחות ש-Qwen כבר השתלטה על קהילת המפתחים בסין. המקורות אינם מספקים נתון עדכני ומאומת על מספר המפתחים הפעילים, ההורדות או הפריסות הארגוניות.
Qwen3.8-Flash ו-Flash-Next הם למעשה שני חלקים באסטרטגיית מוצר אחת. Flash הוא שירות ענן זול עם הקשר ארוך; Flash-Next הוא מהלך אקוסיסטם וארכיטקטורה שמכוון אל Qwen4.
השילוב בין מחיר של 0.16 דולר לטוקני קלט, הקשר של עד מיליון טוקנים, מסלול של 6 מיליארד פרמטרים פעילים בתוך מודל גדול בהרבה, ותוצאות חזקות שפורסמו בידי החברה, הופך את ההשקה לרלוונטית במיוחד למפתחים שעוקבים אחר כלכלת ה-inference. 4
אבל ההסתייגויות חשובות: אין לבלבל בין מודל הייצור לבין גרסת התצוגה המקדימה, טענת עלות האימון לא עברה ביקורת בלתי תלויה, השוואות הביצועים הן מטעם הספק, ולא ניתן עדיין לכמת את שיעור האימוץ. Alibaba נראית כמו מתחרה רצינית ובעלת משאבים במרוץ ה-AI בסין — אך לא כמובילה בלתי מעורערת. הנכונות שלה להשקיע סכומים גדולים מצביעה על כך ש-Qwen נתפסת כהימור ארוך טווח על ענן ואקוסיסטם, ולא כמקור רווח מיידי. 18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Qwen3.8 Flash הוא מודל מולטי־מודאלי לשימוש בייצור, עם מחיר של 0.16 דולר למיליון טוקני קלט ו 0.47 דולר למיליון טוקני פלט.
Qwen3.8 Flash הוא מודל מולטי־מודאלי לשימוש בייצור, עם מחיר של 0.16 דולר למיליון טוקני קלט ו 0.47 דולר למיליון טוקני פלט. Flash Next הוא מודל בעל משקולות פתוחות, עם מודל מרכזי של 125 מיליארד פרמטרים, 51 מיליארד פרמטרים בהטמעות N gram ורק 6 מיליארד פרמטרים פעילים בכל טוקן.
שתי ההשקות משתלבות בהימור הרחב של Alibaba על AI: הכנסות הענן צמחו ב 45%, אך ההשקעות ההוניות זינקו ב 75% והרווח הרבעוני צנח ב 75%.
Qwen3.8 Flash הוא מודל מולטי־מודאלי לשימוש בייצור, עם מחיר של 0.16 דולר למיליון טוקני קלט ו 0.47 דולר למיליון טוקני פלט. Flash Next הוא מודל בעל משקולות פתוחות, עם מודל מרכזי של 125 מיליארד פרמטרים, 51 מיליארד פרמטרים בהטמעות N gram ורק 6 מיליארד פרמטרים פעילים בכל טוקן.
פורסם על ידינערך באמצעות GPT-5.6 Lunaהתמונות נוצרו באמצעות GPT Image 1.5
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Alibaba announce with the release of the multimodal Qwen3.8-Flash and the open-weight Qwen3.8-Flash-Next prototype for its future Q. Article summary: Alibaba is pairing a low-cost production model with an open-weight architectural preview: it is trying to make Qwen a widely deployed cloud service while seeding the developer ecosystem for the forthcoming Qwen4 generati. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Alibaba מציגה שתי גרסאות קרובות בשם Qwen3.8-Flash, אך התפקיד שלהן שונה. Qwen3.8-Flash הוא המוצר המיועד להפעלה בענן ולשימושים מסחריים, בעוד Qwen3.8-Flash-Next הוא מודל בעל משקולות פתוחות שנועד לשמש הצצה לארכיטקטורה העתידית של משפחת Qwen4. 5
15
האסטרטגיה שמאחורי המהלך ברורה: למשוך עומסי עבודה ארגוניים באמצעות שירות AI זול במיוחד, ובמקביל להרחיב את קהילת המפתחים סביב Qwen באמצעות מודל שאפשר להוריד, להתאים ולהפעיל באופן עצמאי. עם זאת, חשוב לזכור שחלק ניכר מנתוני הביצועים והעלות מגיע מ-Alibaba או מכרטיס המודל שלה, ולא מבדיקות בלתי תלויות.
Alibaba מתארת את Qwen3.8-Flash כמודל מולטי־מודאלי מסוג Mixture of Experts — ארכיטקטורה שבה רק חלק מהפרמטרים מופעל בכל עיבוד — המיועד לתכנות, עבודה משרדית ומשימות בעלות הקשר ארוך. חלון ההקשר שלו הוא 262,144 טוקנים כברירת מחדל, וניתן להרחיבו עד מיליון טוקנים עבור קבצים גדולים, שיחות ממושכות ותהליכי מחקר. 5
15
המחיר שהוכרז עבור QwenCloud הוא 0.16 דולר למיליון טוקני קלט ו-0.47 דולר למיליון טוקני פלט. Alibaba מסרה שממשק ה-API לייצור יהיה זמין בקרוב, ודיווחים מאוחרים יותר תיארו את QwenCloud כשירות שמפעיל את המודל במחירים האלה. 4
15
במחיר כזה, Flash הוא לא רק השקה של מודל אלא גם מוצר תשתית. מפתחים יכולים לבחון עיבוד מסמכים, סוכני קוד ותהליכי עבודה בהיקף גדול בלי לשלם את הפרמיה שמזוהה בדרך כלל עם מודלים מתקדמים במיוחד.
Flash-Next אינו פשוט מסלול API נוסף. מדובר במודל בעל משקולות פתוחות, שנועד להציג רעיונות ארכיטקטוניים שצפויים להופיע במשפחת Qwen4. לפי מאגר המודל, הוא כולל 125 מיליארד פרמטרים במודל המרכזי, 51 מיליארד פרמטרים נוספים בהטמעות N-gram, ורק 6 מיליארד פרמטרים פעילים בכל טוקן.
זהו תכנון דליל מסוג Mixture of Experts: המודל מכיל מאגר גדול של פרמטרים, אך בכל שלב משתמש רק בחלק קטן ממנו. באופן עקרוני, הדבר עשוי להפחית את כמות החישוב לכל טוקן, תוך שמירה על קיבולת גבוהה יותר מזו של מודל צפוף בעל גודל דומה.
כרטיס המודל מציין חלון הקשר מקומי של 262,144 טוקנים, שניתן להרחיב עד מיליון טוקנים באמצעות YaRN. 13 מכיוון ש-Flash ו-Flash-Next הם מוצרים נפרדים, מפתחים צריכים לבדוק את מגבלות ההקשר, אופן ההפעלה ודרישות הזיכרון המדויקות בתיעוד של הגרסה שבה הם מתכוונים להשתמש.
| מאפיין | Qwen3.8-Flash | Qwen3.8-Flash-Next |
|---|---|---|
| תפקיד עיקרי | מודל ענן לשימושי ייצור | הצצה פתוחה לארכיטקטורה המיועדת ל-Qwen4 |
| שימושים | תכנות מולטי־מודאלי, עבודה משרדית וסוכני AI | תכנות מולטי־מודאלי, עבודה משרדית ומשימות סוכנים ארוכות טווח |
| חלון הקשר | 262,144 טוקנים כברירת מחדל; ניתן להרחבה עד מיליון | 262,144 טוקנים באופן מקומי; לפי הדיווחים ניתן להרחיב עד מיליון באמצעות YaRN |
| מחיר בענן | 0.16 דולר למיליון טוקני קלט; 0.47 דולר למיליון טוקני פלט | לא נקבע מחיר API של Alibaba עבור המשקולות הפתוחות |
| נתוני ארכיטקטורה מרכזיים | Alibaba מציגה את סדרת Flash כמודל מולטי־מודאלי מסוג MoE | 125 מיליארד פרמטרים במודל המרכזי, 51 מיליארד בהטמעות N-gram ו-6 מיליארד פעילים בכל טוקן |
| זמינות | ממשק QwenCloud לייצור הוכרז ל-26 באוגוסט 2026 | המשקולות ופרטי כרטיס המודל הופיעו בסוף אוגוסט 2026 |
התזמון מחזק את הקשר בין המוצרים. מאגר Flash-Next וחומרי כרטיס המודל הופיעו לפני ההכרזה על שירות הייצור או במקביל אליה, וכך סיפקו למפתחים הצצה מוקדמת לארכיטקטורה בזמן ש-Alibaba הכינה את השירות המארח. 7
Alibaba טוענת שסדרת Flash דורשת בערך תשיעית מעלות האימון של Qwen3.7-Plus, תוך שיפור בביצועים — במיוחד בתכנות ובמשימות משרדיות. 5
15
זו טענה גדולה, אך יש להתייחס אליה כהשוואה שמסרה החברה ולא כמחקר עלויות שעבר ביקורת בלתי תלויה. עלות אימון תלויה במחירי חומרה, משך האימון, הכנת הנתונים, ניסיונות כושלים ושיטת החשבונאות. עם זאת, הארכיטקטורה הדלילה מספקת בסיס טכני סביר לדגש של Alibaba על יעילות: רק חלק מהפרמטרים הזמינים מופעל עבור כל טוקן.
מבחינת לקוחות, ההבחנה פשוטה יותר. מחיר ה-API של Flash הוא נתון שאפשר להשתמש בו ישירות לתכנון תקציב; טענת "תשיעית מהעלות" היא בשלב זה בעיקר איתות טכנולוגי ואסטרטגי, עד שיתפרסמו מדידות חיצוניות הניתנות להשוואה.
כרטיס המודל של Flash-Next מציג את התוצאות הבאות:
בטבלת ההשוואה של כרטיס המודל, Flash-Next מקבל ציון גבוה יותר מהתוצאה המוצגת עבור Claude Opus 4.6 Max ב-SWE-bench Pro, ב-SWE-bench Multilingual, ב-CoWorkBench וב-JobBench. לדוגמה, ב-SWE-bench Pro ההשוואה המדווחת היא 62.5 לעומת 53.4, וב-SWE-bench Multilingual — 81.0 לעומת 77.5.
התוצאות מצביעות על ביצועים חזקים במשימות הנדסת תוכנה ובמשימות משרדיות המבוצעות בידי סוכנים. הן אינן מוכיחות ש-Flash-Next טוב יותר מ-Claude או מכל מערכת חזיתית אחרת בכל משימה. הנתונים פורסמו בידי ספק המודל, מערכי הבדיקה עשויים להיות שונים, ואין להשליך אוטומטית את תוצאות Flash-Next על כל פריסה של Qwen3.8-Flash בייצור.
המקורות מתארים את Flash-Next כמודל בעל משקולות פתוחות. סיכום מודל אחד מציין רישיון בשם qwen-community-1.0, אך מפתחים צריכים לאמת את הרישיון המחייב במאגר הרשמי ובכרטיס המודל לפני הפצה מסחרית, אימון נוסף או הפעלה כשירות. 6
"משקולות פתוחות" אינן אומרות שכל שימוש מותר ללא הגבלה. הרישיון עשוי לכלול תנאים הנוגעים להפצה מחדש, מתן קרדיט, שימושים מותרים או מודלים נגזרים. המידע הקיים אינו מספיק כדי לקבוע באופן גורף מהן ההרשאות המסחריות של כל רכיב בהשקה.
השקת המודלים מגיעה בזמן ש-Alibaba מגדילה במהירות את השקעותיה בתשתיות AI. לפי Reuters, הכנסות הענן הרבעוניות עלו ב-45%, בעוד ההשקעות ההוניות גדלו ב-75% והרווח הנקי הרבעוני ירד ב-75%. 18
Reuters דיווחה גם ש-Alibaba גייסה או פעלה לגיוס של 10 מיליארד דולר באמצעות הקצאת מניות בהונג קונג, כדי לממן את שאיפות ה-AI שלה. יחד, הנתונים מציגים את המחיר של אסטרטגיית Qwen: הביקוש לענן ולמחשוב AI גדל, אך בניית הקיבולת מפעילה לחץ מיידי על הרווחים ועל תזרים המזומנים.
לכן מחיר נמוך עשוי להיות שימושי מבחינה אסטרטגית גם אם הוא מצמצם את שולי הרווח בטווח הקצר. שירות inference זול יכול להגדיל את ניצולת תשתיות הענן של Alibaba, למשוך עומסי עבודה ארגוניים ולהפוך את Qwen לאפשרות ברירת מחדל עבור מפתחים שבונים יישומים עם הקשר ארוך.
Flash-Next מרחיב את החשיפה של Alibaba אל מעבר ל-API שלה. מפתחים יכולים לבדוק את המודל, להתאים אותו ולהפעיל אותו בעצמם, וכך להכיר את הכלים ואת הארכיטקטורה של Qwen בלי להתחייב מיד ל-QwenCloud.
מודל הפצה כזה עשוי לסייע ל-Alibaba בכמה דרכים:
הראיות תומכות בפרשנות האסטרטגית הזו, אך אינן מוכיחות ש-Qwen כבר השתלטה על קהילת המפתחים בסין. המקורות אינם מספקים נתון עדכני ומאומת על מספר המפתחים הפעילים, ההורדות או הפריסות הארגוניות.
Qwen3.8-Flash ו-Flash-Next הם למעשה שני חלקים באסטרטגיית מוצר אחת. Flash הוא שירות ענן זול עם הקשר ארוך; Flash-Next הוא מהלך אקוסיסטם וארכיטקטורה שמכוון אל Qwen4.
השילוב בין מחיר של 0.16 דולר לטוקני קלט, הקשר של עד מיליון טוקנים, מסלול של 6 מיליארד פרמטרים פעילים בתוך מודל גדול בהרבה, ותוצאות חזקות שפורסמו בידי החברה, הופך את ההשקה לרלוונטית במיוחד למפתחים שעוקבים אחר כלכלת ה-inference. 4
אבל ההסתייגויות חשובות: אין לבלבל בין מודל הייצור לבין גרסת התצוגה המקדימה, טענת עלות האימון לא עברה ביקורת בלתי תלויה, השוואות הביצועים הן מטעם הספק, ולא ניתן עדיין לכמת את שיעור האימוץ. Alibaba נראית כמו מתחרה רצינית ובעלת משאבים במרוץ ה-AI בסין — אך לא כמובילה בלתי מעורערת. הנכונות שלה להשקיע סכומים גדולים מצביעה על כך ש-Qwen נתפסת כהימור ארוך טווח על ענן ואקוסיסטם, ולא כמקור רווח מיידי. 18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Qwen3.8 Flash הוא מודל מולטי־מודאלי לשימוש בייצור, עם מחיר של 0.16 דולר למיליון טוקני קלט ו 0.47 דולר למיליון טוקני פלט.
Qwen3.8 Flash הוא מודל מולטי־מודאלי לשימוש בייצור, עם מחיר של 0.16 דולר למיליון טוקני קלט ו 0.47 דולר למיליון טוקני פלט. Flash Next הוא מודל בעל משקולות פתוחות, עם מודל מרכזי של 125 מיליארד פרמטרים, 51 מיליארד פרמטרים בהטמעות N gram ורק 6 מיליארד פרמטרים פעילים בכל טוקן.
שתי ההשקות משתלבות בהימור הרחב של Alibaba על AI: הכנסות הענן צמחו ב 45%, אך ההשקעות ההוניות זינקו ב 75% והרווח הרבעוני צנח ב 75%.