Naive N0.5 Flash הוא מודל במשקולות פתוחות ברישיון MIT, שמיועד לתכנות ולמחקר ופיתוח בתחום הבינה המלאכותית. המודל מציע, לפי NaiveAI, חלון הקשר מובנה של מיליון טוקנים באמצעות שילוב של SWA ו DSA, ללא שכבות קשב מלאות; מבנה השכבות מתואר בעיקרו ביחס של 5:1.[2][7] המודל מבוסס על MiMo V2.5 של Xiaomi, וההסקה נעשית באמצעות Nai...
פורסם על ידינערך באמצעות GPT-6 Lunaהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is NaiveAI’s MIT-licensed, open-weight Naive-N0.5-Flash model, and how do its 309B-total/15.5B-active MoE architecture, native one-mill. Article summary: Naive-N0.5-Flash is NaiveAI’s MIT-licensed, open-weight model aimed at coding and AI research and development. The release pairs a large but sparsely activated model with a claimed native one-million-token context and a . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Naive-N0.5-Flash הוא מודל במשקולות פתוחות של NaiveAI, המיועד לתכנות ולמחקר ופיתוח בתחום הבינה המלאכותית. המפרט שהחברה מציגה משלב מודל MoE עם 309 מיליארד פרמטרים, חלון הקשר מובנה של מיליון טוקנים ומערכת הסקה ייעודית בשם NaiveRT.2
4
חשוב להבחין בין גודל המודל לבין החישוב הפעיל בכל רגע: לפי כרטיס המודל, בכל טוקן מופעלים 15.5 מיליארד פרמטרים. אין פירוש הדבר שהמודל כולו מכיל רק 15.5 מיליארד פרמטרים. NaiveAI מציינת כי משקולות המודל וקוד ההסקה פורסמו ברישיון MIT.2
4
7
במודל מסוג תערובת מומחים (Mixture of Experts, או MoE), לא כל הפרמטרים משתתפים בחישוב של כל טוקן. Naive-N0.5-Flash כולל 309 מיליארד פרמטרים בסך הכול, אך 15.5 מיליארד מהם פעילים בכל טוקן.2 הנתון השני מתאר את החישוב הדליל בזמן הריצה, ולא את מספר הפרמטרים הכולל.
המודל מכוון למשימות תכנות ולמחקר ופיתוח בתחום ה-AI. הוא פותח בהמשך אימון על בסיס MiMo-V2.5 של Xiaomi, ולא מוצג כמודל שנבנה כולו מאפס.1
2
NaiveAI אומרת שהמודל תומך באופן מובנה בחלון הקשר של מיליון טוקנים, באמצעות שילוב של קשב בחלון נע (Sliding-Window Attention, או SWA) ו-DeepSeek Sparse Attention (DSA) קל. לפי חומרי המודל, המבנה משלב ביניהם בעיקר ביחס של 5:1, ואינו כולל שכבות קשב מלאות.2
7
בפשטות, SWA מתמקד בחלון מקומי של טקסט, ואילו DSA מספק מנגנון קשב דליל שנועד לסייע בטיפול בהקשר רחב יותר. הרעיון הוא לתמוך בהקשרים ארוכים בלי להסתמך על שכבות שבהן כל הטוקנים מקושרים זה לזה. עם זאת, חלון של מיליון טוקנים הוא יכולת מוצהרת של המודל; הוא אינו מבטיח שכל משימה ארוכת הקשר תתבצע באותה יעילות או איכות.
NaiveRT היא מערכת ההסקה ש-NaiveAI פרסמה לצד המודל. החברה מציינת שהיא משלבת איחוד של ליבות חישוב (mega-kernel fusion), את מנגנון Programmatic Dependent Launch (PDL) ופענוח ספקולטיבי. לפי נתוני החברה, מצב Standard מספק 50 טוקנים לשנייה למשתמש, ואילו מצב Ultrafast מגיע, לפי הטענה, לעד 2,000 טוקנים לשנייה.2
אלה נתוני ביצועים שפרסמה החברה, ולא הבטחה למהירות שתתקבל בכל חומרה, הגדרה או עומס עבודה. חשוב גם לא לערבב בין הנתון למשתמש יחיד במצב Standard לבין שיא המהירות במצב Ultrafast: מדובר במדדים שונים, ולא בקצב אחיד שאפשר לצפות לו בכל שימוש.2
הייחוד של Naive-N0.5-Flash, לפי המפרט שפרסמה NaiveAI, הוא השילוב בין משקולות פתוחות ברישיון MIT, מודל MoE גדול עם הפעלה חלקית של הפרמטרים, חלון הקשר מובנה של מיליון טוקנים ומערכת הסקה ייעודית.2
4
7 כדאי להפריד בין המפרט והצהרות המהירות לבין ביצועים מוכחים במשימה מסוימת: חומרי ההשקה מתארים את היכולות ואת נתוני החברה, אך אינם לבדם קובעים כיצד המודל יתפקד בתהליך עבודה מסוים של תכנות או מחקר.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Naive N0.5 Flash הוא מודל במשקולות פתוחות ברישיון MIT, שמיועד לתכנות ולמחקר ופיתוח בתחום הבינה המלאכותית.
Naive N0.5 Flash הוא מודל במשקולות פתוחות ברישיון MIT, שמיועד לתכנות ולמחקר ופיתוח בתחום הבינה המלאכותית. המודל מציע, לפי NaiveAI, חלון הקשר מובנה של מיליון טוקנים באמצעות שילוב של SWA ו DSA, ללא שכבות קשב מלאות; מבנה השכבות מתואר בעיקרו ביחס של 5:1.[2][7]
המודל מבוסס על MiMo V2.5 של Xiaomi, וההסקה נעשית באמצעות NaiveRT. החברה מדווחת על 50 טוקנים לשנייה למשתמש במצב Standard ועד 2,000 טוקנים לשנייה במצב Ultrafast.[1][2]