DeepSeek השיקה את V4.1 Flash ב 10 בספטמבר 2026, כמודל מולטימודלי עם משקלים פתוחים וביצועי הסקה מהירים יותר לפי החברה. החל מ 14 בספטמבר, בקשות API ל V4 Pro ינותבו אוטומטית ל V4.1 Flash ויחויבו לפי תעריפי Flash, עד להשקת V4.1 Pro.
פורסם על ידינערך באמצעות GPT-5.6 Terraהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Chinese AI startup DeepSeek announce with the launch of its V4.1 Flash model on September 11, 2026, including how the slimmed-down. Article summary: DeepSeek launched V4.1-Flash on September 10, not September 11. It positioned the smaller, open-weight model as a new-architecture successor that combines native visual understanding with lower-cost, faster inference—and. Topic tags: general, news, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermark
DeepSeek השיקה ב-10 בספטמבר 2026 את DeepSeek-V4.1-Flash — מודל שהחברה מציגה כחלופה זולה יותר, בעלת יכולות מולטימודליות מובנות, עבור משתמשי API. מבחינת משתמשי V4-Pro, זו אינה רק השקה של גרסה חדשה: בקרוב בקשות שנשלחות לנקודת הקצה הישנה יועברו אוטומטית למודל Flash החדש. 1
3
10
החל מ-14 בספטמבר, 04:00 UTC — כלומר 12:00 לפי שעון בייג'ינג — בקשות ל-V4-Pro אמורות להיות מנותבות אוטומטית ל-V4.1-Flash. החיוב עבורן יהיה לפי תעריפי Flash, עד שתושק V4.1-Pro. 3
המשמעות המעשית: צוותים שממשיכים לקרוא ל-endpoint הקודם עשויים לקבל מודל אחר, גם בלי לשנות את שם המודל בקוד. עבור מערכות ייצור, במיוחד כאלה שתלויות בפורמט פלט עקבי, קריאות לכלים, זמני תגובה או איכות במשימות ספציפיות, כדאי לבצע בדיקות השוואה לפני שהמעבר הופך לחלק מהתפעול השוטף.
לפי DeepSeek, V4.1-Flash הוא המודל הקטן ביותר במשפחת הארכיטקטורה החדשה שלה. החברה אומרת שהארכיטקטורה נועדה להעלות את תקרת היכולות, לשפר את מהירות ההסקה ואת קצב העיבוד, ולאפשר התרחבות למודלים גדולים יותר. 10
המודל כולל הבנה חזותית מולטימודלית מובנית: הוא מסוגל לעבד תמונות וטקסט במסגרת מודל הליבה, ולא באמצעות תוסף ראייה נפרד. ב-API של DeepSeek יש להשתמש בשם המודל deepseek-flash. הדגמים V4-Flash ו-V4-Flash-Vision-Exp הוצאו משימוש. 10
16
בדיווחים סביב ההשקה מתואר V4.1-Flash כמודל Mixture of Experts עם 552 מיליארד פרמטרים, בארכיטקטורת Causal Encoder–Decoder. לפי התיאור, 8 מיליארד פרמטרים פעילים בעיבוד קלט ו-16 מיליארד ביצירת פלט. המשקלים פורסמו ברישיון MIT, לפי הדיווחים. 16
DeepSeek טוענת לשיפור ביכולות, במהירות ההסקה ובקצב העיבוד. דיווחים על ההשקה תיארו את V4.1-Flash כמודל שעולה על V4-Pro במשימות קוד וסוכנים (agents), ובעלות תפעולית נמוכה יותר. 1
עם זאת, מדובר בעיקר בטענות ביצועים של החברה. החומרים הזמינים אינם כוללים בדיקות בלתי תלויות שמוכיחות כי V4.1-Flash מהיר או טוב יותר מ-V4-Pro — או ממודלי קצה מתחרים — בכל סוגי המשימות. התוצאות בפועל תלויות, בין היתר, בהנחיה, בסוג המשימה, בחומרה, בעומס המקבילי ובהגדרת השימוש בכלים.
למפתחים, המסקנה היא ש-V4.1-Flash ראוי לבחינה בפרויקטים מולטימודליים, בזרימות עבודה של כתיבת קוד ובמערכות סוכנים, שבהם עלות ההסקה וקצב העיבוד חשובים לצד איכות התשובה.
DeepSeek עדכנה את מחירי Flash החל מ-10 בספטמבר. בשעות השפל, המחירים שפורסמו הם:
בשעות השיא המחיר הוא פי שניים מתעריף שעות השפל. 15
התמחור הנמוך מדגיש תחרות שממוקדת לא רק ביכולות המודל, אלא גם בעלות הפריסה שלו. עבור מפתחים, הוא עשוי לאפשר יותר קריאות לסוכנים, אינטראקציות עם הקשר ארוך או בקשות מולטימודליות באותו תקציב.
מן הצד האחר, הורדת מחירים אגרסיבית מציבה דילמה עסקית לספקיות AI: היא יכולה להגדיל שימוש ונתח שוק, אך גם ללחוץ על ההכנסה לכל טוקן ועל שולי הרווח. המידע שסופק אינו מבסס השפעה ישירה ועכשווית על מניות של חברות כגון MiniMax, Z.AI או Alibaba, ולכן יש להתייחס בזהירות לטענות על תגובת שוק ספציפית.
ההשקה הגיעה לאחר שרויטרס דיווחה כי DeepSeek פנתה ל-CITIC Securities לקראת אפשרות של הנפקה ראשונית בשוק STAR של בורסת שנגחאי — זירה המתמקדת בחברות טכנולוגיה. לפי מקורות רויטרס, החברה שאפה להתחיל את תהליך ההנפקה ב-2026, אך היקף העסקה ולוח הזמנים שלה עדיין אינם ברורים.
מודל חדש שמשלב משקלים פתוחים, יכולות מולטימודליות ועלויות API נמוכות עשוי לחזק את סיפור המוצר של החברה לקראת הנפקה אפשרית. זו פרשנות, ולא סיבה רשמית שהחברה מסרה להשקה. במקביל, אסטרטגיית המחיר הנמוך מעלה שאלה עסקית מרכזית: האם גידול בביקוש יפצה על הכנסה נמוכה יותר לכל יחידת הסקה.
ימים ספורים לפני ההשקה פרסמו רשויות אמריקאיות התראה משותפת, שבה נטען כי DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun ו-Z.AI ביצעו חילוץ שיטתי ובהיקף תעשייתי של יכולות ממודלי AI אמריקאיים באמצעות זיקוק ידע (knowledge distillation). לפי ההתראה, מיליארדי טוקנים חולצו באמצעות מיליוני בקשות ממודלים כגון Claude, GPT, Gemini ו-Grok, ולכאורה הדבר נעשה ככל הנראה בידיעת ממשלת סין. 17
אלה טענות של ממשלת ארה״ב, ולא קביעות של בית משפט. סין דחתה את ההאשמות כחסרות בסיס וטענה כי צעדי ארה״ב נועדו לשמר מונופול בתעשיית ה-AI. גורמים סיניים הדגישו גם את הצורך בעצמאות טכנולוגית, לצד נכונות עקרונית לדיאלוג.
החפיפה בין השקת מודל סיני משמעותי לבין העימות הזה ממחישה שתי מגמות מקבילות: תחרות מהירה על טכנולוגיה ומחירים מצד אחד, ובחינה גוברת של גישה למודלים, נתוני אימון וזרימת טכנולוגיה חוצת גבולות מצד שני.
V4.1-Flash הוא ניסיון של DeepSeek להפוך מודל קטן יותר ממשפחת הארכיטקטורה החדשה שלה לברירת המחדל עבור קהל רחב יותר של משתמשי API. התמיכה המולטימודלית המובנית, המשקלים הפתוחים, שיפורי היעילות הנטענים ולוח המחירים הזול הם לב ההצעה. 10
15
16
השינוי המוחשי ביותר בטווח הקרוב הוא העברת בקשות V4-Pro ל-V4.1-Flash ב-14 בספטמבר. את הטענות הרחבות יותר על הובלה בביצועים יהיה צורך לבחון בהערכות בלתי תלויות, בעוד שמדיניות התמחור של DeepSeek והמתיחות המתעצמת בין ארה״ב לסין ישפיעו על חשיבותה הרחבה יותר של ההשקה. 3
17
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeek השיקה את V4.1 Flash ב 10 בספטמבר 2026, כמודל מולטימודלי עם משקלים פתוחים וביצועי הסקה מהירים יותר לפי החברה.
DeepSeek השיקה את V4.1 Flash ב 10 בספטמבר 2026, כמודל מולטימודלי עם משקלים פתוחים וביצועי הסקה מהירים יותר לפי החברה. החל מ 14 בספטמבר, בקשות API ל V4 Pro ינותבו אוטומטית ל V4.1 Flash ויחויבו לפי תעריפי Flash, עד להשקת V4.1 Pro.
מחירי ה API בשעות השפל מתחילים ב 0.003 דולר למיליון טוקני קלט מהמטמון; מחירי שעות השיא כפולים.