Naive N0.5 Flash نموذج مفتوح الأوزان بترخيص MIT، موجّه للبرمجة وأبحاث الذكاء الاصطناعي. يعتمد على مزيج من آلية الانتباه ذات النافذة المنزلقة (SWA) وآلية DeepSeek Sparse Attention (DSA)، من دون طبقات انتباه كامل؛ وتصف NaiveAI الترتيب بأنه يغلب عليه توزيع 5:1 بين SWA وDSA.[2][7] استُكمل تدريبه انطلاقًا من MiMo V2.5 من...
نشر بواسطةتم التحرير باستخدام GPT-6 Lunaتم إنشاء الصور باستخدام GPT Image 2
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What is NaiveAI’s MIT-licensed, open-weight Naive-N0.5-Flash model, and how do its 309B-total/15.5B-active MoE architecture, native one-mill. Article summary: Naive-N0.5-Flash is NaiveAI’s MIT-licensed, open-weight model aimed at coding and AI research and development. The release pairs a large but sparsely activated model with a claimed native one-million-token context and a . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Naive-N0.5-Flash هو نموذج مفتوح الأوزان من شركة NaiveAI، موجّه للبرمجة وأبحاث الذكاء الاصطناعي وتطويره. وتتمثل أبرز مواصفاته في بنية «مزيج الخبراء» (MoE) بقدرة إجمالية تبلغ 309 مليارات معامل، ينشط منها 15.5 مليارًا لكل رمز، إلى جانب نافذة سياق أصلية تقول الشركة إنها تصل إلى مليون رمز ونظام استدلال خاص باسم NaiveRT.2
4
والفرق مهم هنا: رقم 15.5 مليارًا لا يعني أن النموذج كله بهذا الحجم؛ بل يشير إلى عدد المعاملات النشطة في معالجة الرمز الواحد ضمن بنية MoE المتفرقة. وتذكر مواد الإطلاق أن أوزان النموذج وشيفرة الاستدلال متاحة بترخيص MIT.4
7
في نموذج مزيج الخبراء، لا تُستخدم كل المعاملات في كل خطوة؛ إذ يُفعَّل جزء منها بحسب الرمز الجاري معالجته. ووفق بطاقة النموذج، تبلغ المعاملات 309 مليارات إجمالًا، بينما ينشط 15.5 مليارًا لكل رمز.2 لذلك يصف الرقم الثاني الحسابات النشطة، لا الحجم الكلي لأوزان النموذج.
وتستهدف NaiveAI بهذا النموذج أعمال البرمجة والبحث والتطوير في الذكاء الاصطناعي. كما أنه مبني على مواصلة التدريب انطلاقًا من نموذج MiMo-V2.5 التابع لشركة Xiaomi، وليس نموذجًا بدأ تطويره من الصفر.1
2
تقول NaiveAI إن النموذج يدعم نافذة سياق أصلية تصل إلى مليون رمز، عبر الجمع بين الانتباه ذي النافذة المنزلقة (SWA) وآلية DeepSeek Sparse Attention (DSA) خفيفة، من دون استخدام طبقات انتباه كامل. وتصف مواد النموذج ترتيب الطبقات بأنه يغلب عليه توزيع بنسبة 5:1 بين SWA وDSA.2
7
بصورة مبسطة، تركز النافذة المنزلقة على نطاق محلي من السياق، فيما توفّر DSA طريقة متفرقة للتعامل مع المعلومات الأبعد. ويهدف هذا التصميم إلى دعم السياقات الطويلة من دون الاعتماد على طبقات الانتباه الكامل. لكن إعلان نافذة مليون رمز يصف قدرة النموذج المعلنة، ولا يثبت وحده أن أداءه سيكون متساويًا في كل مهمة طويلة السياق.
NaiveRT هو نظام الاستدلال الذي أُطلق مع النموذج. وتذكر NaiveAI أنه يجمع بين دمج النوى البرمجية، والإطلاق المعتمد على البرامج (PDL)، وفك الترميز التخميني. كما تعلن الشركة سرعة تبلغ 50 رمزًا في الثانية لكل مستخدم في الوضع القياسي، وسرعة تصل إلى 2000 رمز في الثانية في وضع Ultrafast.2
هذه أرقام معلنة من الشركة لخدمة النموذج، وليست ضمانًا للسرعة التي سيحصل عليها كل مستخدم في جميع ظروف التشغيل. كما أن الرقم الأول محسوب لكل مستخدم في الوضع القياسي، بينما الثاني حد أقصى معلن لوضع Ultrafast؛ لذا لا ينبغي التعامل معهما على أنهما قياس واحد أو سرعة متوقعة ثابتة.2
ما يميز Naive-N0.5-Flash هو اجتماع عدة مواصفات في إصدار واحد: أوزان مفتوحة بترخيص MIT، وبنية MoE تضم 309 مليارات معامل مع تفعيل جزء منها لكل رمز، وسياق أصلي معلن بمليون رمز من دون طبقات انتباه كامل، إلى جانب نظام استدلال مخصص.2
4
7 وعند تقييمه، من المفيد الفصل بين هذه المواصفات المعلنة وبين جودة الأداء الفعلية في المهام وسرعة التشغيل في بيئة بعينها؛ فالمواد المشار إليها تعرض قدرات النموذج وأرقام السرعة التي تذكرها الشركة، لكنها لا تحسم وحدها نتائجه في كل سير عمل للبرمجة أو البحث.
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
Naive N0.5 Flash نموذج مفتوح الأوزان بترخيص MIT، موجّه للبرمجة وأبحاث الذكاء الاصطناعي.
Naive N0.5 Flash نموذج مفتوح الأوزان بترخيص MIT، موجّه للبرمجة وأبحاث الذكاء الاصطناعي. يعتمد على مزيج من آلية الانتباه ذات النافذة المنزلقة (SWA) وآلية DeepSeek Sparse Attention (DSA)، من دون طبقات انتباه كامل؛ وتصف NaiveAI الترتيب بأنه يغلب عليه توزيع 5:1 بين SWA وDSA.[2][7]
استُكمل تدريبه انطلاقًا من MiMo V2.5 من Xiaomi. أما نظام NaiveRT فيستخدم دمج النوى البرمجية والإطلاق المعتمد على البرامج وفك الترميز التخميني، مع سرعات تعلنها الشركة تختلف بحسب الوضع.[1][2]