Naive N0.5 Flash — модель із відкритими вагами для програмування та досліджень і розробок у сфері ШІ. Для контексту на 1 млн токенів модель поєднує ковзне вікно уваги (SWA) і розріджену увагу DeepSeek (DSA), не використовуючи повноуважних шарів.
ОпублікувавВідредаговано за допомогою GPT-6 LunaЗображення створено за допомогою GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is NaiveAI’s MIT-licensed, open-weight Naive-N0.5-Flash model, and how do its 309B-total/15.5B-active MoE architecture, native one-mill. Article summary: Naive-N0.5-Flash is NaiveAI’s MIT-licensed, open-weight model aimed at coding and AI research and development. The release pairs a large but sparsely activated model with a claimed native one-million-token context and a . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Naive-N0.5-Flash — відкрита модель NaiveAI для програмування та досліджень і розробок у сфері штучного інтелекту. Її головні заявлені особливості — 309 млрд параметрів, із яких активними є 15,5 млрд на токен, контекстне вікно на 1 млн токенів і власна система інференсу NaiveRT.2
4
Важливо розрізняти загальну кількість параметрів і ті, що задіюються під час обробки конкретного токена. Показник 15,5 млрд не означає, що вся модель має лише стільки параметрів. Ваги моделі та код для інференсу, згідно з матеріалами NaiveAI, опубліковані за ліцензією MIT.4
7
Naive-N0.5-Flash використовує архітектуру суміші експертів (mixture of experts, MoE): для обробки токена задіюється лише частина параметрів моделі. У модельній картці вказано 309 млрд параметрів загалом і 15,5 млрд активних на токен.2 Отже, число активних параметрів описує обчислення під час роботи, а не повний розмір моделі.
NaiveAI позиціює модель як інструмент для програмування та досліджень і розробок у сфері ШІ. Її створили на базі MiMo-V2.5 від Xiaomi, продовживши навчання, а не розробляючи модель цілком із нуля.1
2
За словами NaiveAI, модель нативно підтримує контекстне вікно на 1 млн токенів завдяки поєднанню ковзного вікна уваги (sliding-window attention, SWA) та полегшеного механізму розрідженої уваги DeepSeek (DeepSeek Sparse Attention, DSA). У ній немає повноуважних шарів; за описом компанії, співвідношення SWA до DSA переважно становить 5:1.2
7
У спрощеному вигляді SWA зосереджується на локальному фрагменті тексту, а DSA забезпечує розріджений механізм роботи з віддаленішим контекстом. Такий підхід покликаний підтримувати довгий контекст без повноуважних шарів. Заявлена місткість у 1 млн токенів — це характеристика моделі, але сама по собі вона не доводить, що будь-яке завдання на такій довжині буде виконано однаково добре.
NaiveRT — система інференсу, яку NaiveAI представила разом із моделлю. Серед її методів компанія називає об’єднання операцій у мегаядра, Programmatic Dependent Launch (PDL) і спекулятивне декодування. За даними NaiveAI, у стандартному режимі система забезпечує 50 токенів за секунду на користувача, а в режимі Ultrafast швидкість може сягати 2 000 токенів за секунду.2
Це показники, наведені розробником, а не гарантія швидкодії в кожній конфігурації чи для будь-якого завдання. Також компанія розрізняє результат на одного користувача у стандартному режимі та максимальне значення Ultrafast, тому ці цифри не варто сприймати як два рівнозначні виміри або єдину очікувану швидкість.2
Naive-N0.5-Flash вирізняється поєднанням заявлених характеристик: відкритими вагами за ліцензією MIT, розрідженою активацією в моделі MoE на 309 млрд параметрів, нативним контекстом на 1 млн токенів без повноуважних шарів і окремою системою для інференсу.2
4
7
Оцінюючи реліз, варто відокремлювати технічні характеристики та заяви про швидкість від перевіреної якості на конкретних завданнях і реальної продуктивності під час розгортання. Наведені матеріали описують можливості моделі й показники, заявлені компанією, але самі по собі не визначають, як вона працюватиме в певному процесі програмування чи досліджень.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Naive N0.5 Flash — модель із відкритими вагами для програмування та досліджень і розробок у сфері ШІ.
Naive N0.5 Flash — модель із відкритими вагами для програмування та досліджень і розробок у сфері ШІ. Для контексту на 1 млн токенів модель поєднує ковзне вікно уваги (SWA) і розріджену увагу DeepSeek (DSA), не використовуючи повноуважних шарів.
Модель продовжили навчати на базі MiMo V2.5 від Xiaomi. Система NaiveRT, за даними NaiveAI, видає 50 токенів за секунду на користувача у стандартному режимі та до 2 000 токенів за секунду в режимі Ultrafast.[1][2]