Коротко: що сталося з Ox Alpha
Таємницю Ox Alpha вже розкрито. Це була не окрема довготривала анонімна модель, а короткострокове безкоштовне прев’ю моделі серії GLM від китайської компанії Z.ai, раніше відомої як Zhipu AI. 20 серпня 2026 року вона з’явилася на OpenRouter під назвою stealth/ox-alpha, а 26 серпня Z.ai офіційно назвала її GLM-5.3-Flash.
2
5
10
Інтерес до моделі виник не лише через загадкове походження. Розробники отримали безкоштовний доступ до великої мультимодальної системи, орієнтованої на програмування, складні міркування та роботу AI-агентів. А перші тести показали, що вона може бути особливо сильною у практичній розробці програмного забезпечення.
Якою була Ox Alpha
OpenRouter описував Ox Alpha як reasoning-модель для програмування, тривалої роботи агентів і виробничих навантажень. Вона мала підходити для довгих інженерних задач, складного міркування та сценаріїв, де потрібно поєднувати текстову й візуальну інформацію.
30
39
Основні характеристики прев’ю:
- Ідентифікатор:
stealth/ox-alpha;
- дата появи: 20 серпня 2026 року;
- контекстне вікно: 1 048 576 токенів — приблизно мільйон;
- максимальний вивід: 131 072 токени;
- вхідні дані: текст, зображення та відео;
- можливості: виклик інструментів і функцій, структурований вивід;
- ціна під час анонімного прев’ю: нульова для вхідних і вихідних токенів.
6
12
14
Такі параметри робили модель цікавою для великих кодових баз, довгих діалогів, аналізу відео та багатокрокової автоматизації. Водночас велике контекстне вікно й безкоштовний доступ самі по собі не доводять перевагу над комерційними конкурентами. Вирішальним фактором стали результати на реальних інженерних завданнях.
Чому модель називали «Ню Лай»
Китайські користувачі швидко перетворили Ox Alpha на «Ню Лай» — 牛来. Причина проста: Ox можна перекласти як «бик» або «вол», що пов’язується з китайським 牛 («ню»). Додатковий поштовх дала популярність анімаційного фільму «Ню Лай», назву якого можна приблизно передати як «Бик прийшов».
15
Це було інтернет-прізвисько, а не офіційна назва продукту. Воно також не свідчить про будь-який зв’язок моделі з фільмом, його творцями чи правовласниками.
14
15
Що показав тест DeepSWE
Найвідомішим раннім результатом стала невелика спільнотна перевірка DeepSWE. Ox Alpha розв’язала 8 із 10 завдань, тобто отримала 80% Pass@1. У тій самій ранній порівняльній серії Claude Fable 5 набрала 65%, а GPT-5.6 Sol — 52%.
1
3
48
| Модель |
Результат раннього тесту DeepSWE |
| Ox Alpha |
8 із 10 (80%) |
| Claude Fable 5 |
65% |
| GPT-5.6 Sol |
52% |
DeepSWE перевіряє не абстрактне написання коду, а здатність агента працювати зі справжнім репозиторієм: зрозуміти структуру проєкту, знайти проблему та підготувати працездатне виправлення.
49
57
Однак десять завдань — надто мала вибірка для гучних висновків. На результат могли вплинути вибір задач, промпти, налаштування запуску та процедура оцінювання. Тому коректніше говорити, що Ox Alpha яскраво виступила в одному ранньому тесті з десяти завдань, а не що вона загалом перемогла всі інші моделі.
Пізніше з’явилися повідомлення, що на повному наборі DeepSWE зі 113 завдань модель розв’язала 63 і наблизилася до рівня Claude Opus 4.8.
5 Це потенційно інформативніший результат, але публічні матеріали не містили достатньо деталей про конфігурацію та відтворюваність тесту. Тож його варто сприймати як заявлений у повідомленнях показник, а не як остаточно незалежно підтверджений стандартний результат.
Як Ox Alpha очолила рейтинги OpenRouter
У моделі зійшлися кілька факторів, які майже гарантовано створюють вірусний ефект:
- анонімне походження;
- безкоштовний доступ;
- контекст приблизно на мільйон токенів;
- підтримка зображень і відео;
- акцент на програмуванні та агентних сценаріях.
3
6
10
Ox Alpha швидко піднялася на перше місце в рейтингах використання OpenRouter. За повідомленнями Bloomberg, це був один із найбільших запусків в історії майданчика, а обсяг використання перевищив показник DeepSeek більш ніж удвічі.
5
10
16
Тут важливо не змішувати різні метрики. Рейтинг OpenRouter, позиції в OpenCode, кількість сесій і витрати токенів — це не одне й те саме. Вони не дають підстав автоматично говорити про кількість користувачів або про універсальну перевагу моделі за якістю.
Водночас масштаб інтересу був очевидним: безкоштовне вікно та сильні ранні результати привернули величезну кількість розробників. Генеральний директор Stripe Патрік Коллісон назвав модель «дуже вражаючою».
59 Це свідчить про увагу індустрії, але не є незалежною оцінкою її продуктивності.
Які технічні «відбитки» вказували на Zhipu
Ще до офіційного оголошення розробники намагалися визначити походження моделі за допомогою чорної скриньки — аналізуючи лише її відповіді, API та підрахунок токенів.
1. Фіксована різниця в 75 токенів
Дослідники порівнювали підрахунок токенів Ox Alpha та GLM-5.3 на різних запитах. За їхніми повідомленнями, базові підрахунки майже повністю збігалися, а різниця становила стабільно близько 75 токенів.
1
17
Якщо така різниця зберігається в текстах різними мовами, коді та емодзі, це може означати додаткову системну інструкцію або службову оболонку з боку OpenRouter чи постачальника. Окремий масштабніший аналіз повідомляв про точний збіг у 95 із 95 тестів.
18
Такий результат сильно натякає на спільний словник токенізатора або близьку реалізацію сервісного шару. Але сам по собі токенізатор не доводить, що дві системи мають однакові ваги чи повністю ідентичну архітектуру.
2. Ідентичне споживання відеотокенів
Ще переконливіша підказка стосувалася відео. У спільнотних тестах Ox Alpha та мультимодальна GLM-5V-Turbo нібито витрачали однакову кількість токенів на кілька відеозаписів. Також збігалися закономірності вибору кадрів і масштабування роздільної здатності.
17
24
Поведінку відеокодера складніше випадково відтворити лише за допомогою текстових інструкцій, тому цей сигнал багато спостерігачів вважали особливо важливим. Проте це все одно був зовнішній black-box-аналіз, а не офіційне розкриття виробника.
3. Схожі помилки API та реакції на налаштування
Розробники також повідомляли про подібні формати помилок API, реакції на параметри міркування та особливості генерації.
2
4 У сукупності з токенізатором і відеотестами ці ознаки зробили гіпотезу про попередню модель Zhipu дуже правдоподібною.
Оцінка «99% упевненості», яка поширювалася в мережі, була думкою окремого спостерігача, а не формальною статистичною ймовірністю.
27 Обережні натяки людей, пов’язаних із Google DeepMind, навіть породили версію про Gemini, але вони не були підтвердженням.
Остаточну крапку поставила сама Z.ai: 26 серпня компанія підтвердила, що Ox Alpha належить до серії GLM, і представила її під офіційною назвою GLM-5.3-Flash.
5
10
Ox Alpha — частина ширшої стратегії «Stealth Alpha»
Ox Alpha була не першою анонімною Alpha-моделлю на OpenRouter. Серед попередніх прикладів згадувалися:
- Pony Alpha → Zhipu GLM-5;
- Hunter Alpha → Xiaomi MiMo-V2-Pro;
- Elephant Alpha → Inclusion AI від Ant Group;
- Owl Alpha → LongCat-2.0 від Meituan.
3
8
33
Схема виглядає подібно: модель на короткий час запускають під кодовою або анонімною назвою, часто безкоштовно, дають розробникам протестувати її у реальних сценаріях, а потім розкривають офіційний бренд і назву.
34
38
Можливі переваги такого підходу:
- Менше упереджень щодо бренду та походження. Користувачі спочатку оцінюють результат, не знаючи назви лабораторії.
- Швидкий збір реального зворотного зв’язку. Модель перевіряють не лише на внутрішніх тестах, а й у кодових базах, інструментах та автоматизованих процесах.
- Органічне поширення. Поєднання безкоштовного доступу, загадковості та високих ранніх показників саме стимулює експерименти й обговорення.
- Перевірка інфраструктури. Великий потік безкоштовних запитів дає змогу протестувати пропускну здатність, довгий контекст і стабільність агентних навантажень.
Це логічні пояснення стратегії, а не повний перелік мотивів, офіційно підтверджених кожною компанією. У випадку Ox Alpha анонімне прев’ю справді принесло масштабне використання, технічне розслідування та увагу розробників у всьому світі, після чого Z.ai пов’язала модель із брендом GLM.
8
9
10
Висновок: головна новина — не анонімність, а спосіб запуску
Історія Ox Alpha має два етапи. Спочатку це була безкоштовна, довгоконтекстна мультимодальна модель із невідомим походженням. Потім вона стала офіційним продуктом Z.ai — GLM-5.3-Flash.
2
10
Результат 80% у ранньому тесті DeepSWE показав конкурентоспроможність моделі на одній серії реальних інженерних завдань. Але малий розмір вибірки та неповні дані про подальше оцінювання вимагають обережності.
Для розробників практичний висновок простий: перевіряти модель потрібно на власному коді, у власному ланцюжку інструментів і з урахуванням вимог до даних, а не покладатися лише на один рейтинг чи вірусний результат.
Для індустрії важливіше інше. Анонімне прев’ю перетворюється на відкритий полігон, де одночасно тестують модель, серверну інфраструктуру та інтерес розробників. А історія Ox Alpha показала, що технічні «відбитки» можуть досить точно вказати на виробника — хоча навіть дуже сильну зовнішню гіпотезу слід відділяти від офіційного підтвердження.