Ox Alpha була анонімною попередньою версією GLM 5.3 Flash від Z.ai — компанія підтвердила це 26 серпня 2026 року. Модель мала контекстне вікно на 1 048 576 токенів, підтримувала текст, зображення, відео, виклик інструментів і під час тестового періоду була безкоштовною.
Research answer

Create a landscape editorial hero image for this Studio Global article: What is the anonymous AI model “Ox Alpha” (or “Niu Lai”), launched quietly on OpenRouter and OpenCode on August 20, 2026 and offered free fo. Article summary: Ox Alpha was a short anonymous “stealth” preview, not a still-unidentified new lab model: Z.ai subsequently identified it as GLM-5.3-Flash, a GLM-family model. Its strong early agentic-coding showing and unusually genero. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
Ox Alpha була короткочасною анонімною попередньою версією GLM-5.3-Flash — моделі з лінійки GLM від Z.ai. Вона з’явилася 20 серпня 2026 року на OpenRouter і OpenCode під назвою провайдера «Stealth». Модель пропонувала контекстне вікно на 1 048 576 токенів, приймала текст, зображення та відео, підтримувала виклик інструментів і під час тестування була безкоштовною. Згодом Z.ai підтвердила, що тестувала GLM-5.3-Flash анонімно під ідентифікатором ox-alpha, перш ніж представити її під власною назвою. 110
Ця історія стала показовим прикладом того, як поєднання доступності, незвично щедрих лімітів і можливостей для AI-агентів може перетворити модель на феномен ще до публікації традиційної технічної документації та повного набору бенчмарків.
Анонімний реліз позиціювали як модель для міркування, програмування, тривалої роботи AI-агентів і виробничих навантажень. Її ключові характеристики виглядали амбітно навіть для безкоштовного попереднього доступу:
stealth/ox-alphaOpenRouter і OpenCode по-різному описували тривалість безкоштовного доступу. OpenRouter вказував коротший період для свого маршруту, тоді як OpenCode обіцяв приблизно тиждень від 20 серпня. Тому орієнтовною межею для безкоштовних маршрутів були 24–27 серпня, а не одна спільна дата завершення. 2412
Мільйон токенів у контексті сам по собі не гарантує кращої якості. Проте він змінює спектр завдань, які розробники можуть доручити моделі. Кодинговий агент здатен утримувати в одному сеансі більшу частину репозиторію, результати викликів інструментів, журнали та візуальний контекст — без постійного стискання або видалення попередньої інформації. Підтримка відео також робить модель придатною для тестування інтерфейсів та інших сценаріїв, що виходять за межі текстової генерації коду. 343
Початкова привабливість Ox Alpha була передусім практичною. Розробники отримали можливість безплатно випробувати мультимодальну модель для програмування з довгим контекстом і доступом до інструментів. Це знизило поріг для експериментів із виправленням помилок у репозиторіях, взаємодією з браузером і тривалими завданнями програмної інженерії.
Популярність моделі зросла майже миттєво. Вона ненадовго перервала 56-денне лідерство DeepSeek у рейтингу OpenCode, а також привернула надзвичайно великий одноденний попит. Водночас заяви про масштаб використання та кількість оброблених токенів, які ширилися під час запуску, не були повністю незалежно перевірені. Їх коректніше сприймати як свідчення ажіотажу, а не як точні вимірювання виробничого навантаження. 114
Це важливе уточнення: популярність під час безкоштовного тесту відображає не лише можливості моделі, а й новизну, ціну та доступність. Вона сама по собі не доводить, що система є найсильнішою загалом.
Найчастіше поширювали результат 80% у DeepSWE — 8 успішно виконаних завдань із 10. Це обнадійливий сигнал, однак вибірка з десяти завдань надто мала, щоб на її основі будувати стабільний рейтинг. У масштабнішому тестуванні результат оцінювали приблизно у 63%, а офіційний показник Z.ai для GLM-5.3-Flash становить 63,4% у DeepSWE v1.1. 7634
Інші повні прогони дали нижчі результати — зокрема повідомлялося про 58,4% на 113 завданнях. У цьому оцінюванні значна частина невдач була пов’язана з форматом відповіді та особливостями реалізації. Це добре показує, наскільки результати агентських бенчмарків залежать від конфігурації тестового середовища, доступних інструментів, часових обмежень і критеріїв успіху. 4142
Найобережніший висновок звучить так: Ox Alpha продемонструвала сильні можливості в програмуванні за участю агентів і в окремих тестах наблизилася до провідних закритих моделей. Але наявні дані не доводять, що вона стабільно перевершувала Claude Fable 5 або всі інші передові системи.
У різних оцінюваннях використовувалися різні підмножини завдань, агентські оболонки та умови запуску. Ранній тест на десяти завданнях міг дати 80%, але не бути репрезентативним для всього бенчмарку. Результат близько 63% розповідає вже іншу історію, а показник 58,4% міг додатково враховувати помилки формату або поведінку тестової оболонки.
Згодом представники команди DeepSWE, за повідомленнями, оцінили загальні можливості моделі як приблизно співставні з Claude Opus 4.8, а не як переконливий доказ переваги над Claude Fable 5. 35 Тому результати DeepSWE варто подавати разом із поясненням масштабу та умов тесту, а не перетворювати їх на взаємозамінні цифри одного «чистого» рейтингу.
Позитивні відгуки від помітних користувачів відповідали профілю моделі. Патрік Коллісон назвав Ox Alpha «дуже вражаючою» після використання через агентську оболонку, а засновник HermesAgent заявив, що модель перевершила кілька внутрішніх стандартів оцінювання команди. 3335
Такі реакції важливі як свідчення практичної користі в реальних робочих процесах, особливо під час програмування та роботи агентів. Але вони не є тим самим, що контрольований міжбенчмарковий висновок про універсальну перевагу Ox Alpha. Модель може бути особливо зручною для конкретного сценарію завдяки довжині контексту, поведінці під час виклику інструментів, швидкості, підтримці різних типів даних або низькій вартості — навіть якщо її позиція в сукупному рейтингу залишається невизначеною.
До офіційного розкриття дослідники порівнювали спостережувану поведінку Ox Alpha з потенційними моделями команд Xiaomi MiMo, Google DeepMind і Zhipu AI.
Xiaomi вважали можливим кандидатом, зокрема тому, що команда MiMo раніше вже проводила анонімний тест під назвою «Hunter Alpha». Однак повідомлялося про невідповідність можливостей: моделі MiMo були пов’язані з підтримкою аудіо, тоді як Ox Alpha приймала текст, зображення та відео, але не аудіо. Тож Xiaomi залишалася цікавою гіпотезою, але не переконливою атрибуцією. 2229
Додаткові припущення спричинили натяки, пов’язані з Google, і публікації в соцмережах. Проте доступні ознаки не доводили, що саме DeepMind створила або обслуговувала цей endpoint. Вони залишалися непрямими свідченнями, а не ідентифікаційним доказом.
Найсильніша версія до офіційного оголошення вказувала на сімейство GLM від Zhipu. Тести спільноти показали, що підрахунок токенів Ox Alpha збігається з поведінкою GLM-5.3 на різних запитах, за винятком сталого зміщення приблизно на 75 токенів. Окремі випробування відео продемонстрували схожий із моделями GLM для роботи із зором характер споживання токенів за кількома параметрами кодування. 1821
Серед інших ознак називали:
reasoning_effort, схожу на відповідь API GLM;Кожна окрема ознака могла бути наслідком маршрутизації, обгортки API, спільної інфраструктури або імітації. Разом вони зробили версію про GLM дедалі переконливішою, але все одно не замінювали офіційної заяви. Вирішальним доказом стало підтвердження Z.ai: Ox Alpha була GLM-5.3-Flash, яку компанія представила під власною назвою. 1043
Після оголошення Ox Alpha перетворилася з загадкового endpoint на попередній реліз конкретного продукту. Документація Z.ai описує GLM-5.3-Flash як гібридну модель із 320 млрд параметрів загалом і 18 млрд активних параметрів, а також із нативними візуальними можливостями: модель може спостерігати за інтерфейсами, аналізувати результати рендерингу та зворотний зв’язок від взаємодії. 43
Іменований реліз також усунув головний недолік анонімного endpoint — невизначеність щодо його майбутнього. За повідомленнями, GLM-5.3-Flash випустили під ліцензією MIT, а ваги стали доступними розробникам, які хочуть отримати більше контролю над розгортанням. 1950
Втім, це не означає, що будь-яке розгортання автоматично буде безпечним або дешевим. Командам потрібно окремо оцінити вимоги до обладнання, швидкість інференсу, умови API, роботу з приватними даними, обмеження частоти запитів, надійність виклику інструментів і стабільність результатів.
Безкоштовний попередній доступ привернув увагу, але подальше поширення моделі залежатиме від стійкіших продуктовых факторів:
Головний урок Ox Alpha полягає не в тому, що анонімна модель ненадовго випередила відомого конкурента. Важливіше інше: модель із переконливо продуманим робочим процесом може стрімко поширитися, якщо розробники отримують можливість масштабно її тестувати. Бенчмаркова історія виявилася складнішою за перші вірусні заголовки, але поєднання довгого контексту, мультимодальності, роботи з інструментами, агентського програмування та низької вартості справді виправдовувало інтерес. Тепер, коли особу моделі встановлено, наступна перевірка — чи залишиться це поєднання корисним після завершення періоду новизни та безкоштовного доступу.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Ox Alpha була анонімною попередньою версією GLM 5.3 Flash від Z.ai — компанія підтвердила це 26 серпня 2026 року.
Ox Alpha була анонімною попередньою версією GLM 5.3 Flash від Z.ai — компанія підтвердила це 26 серпня 2026 року. Модель мала контекстне вікно на 1 048 576 токенів, підтримувала текст, зображення, відео, виклик інструментів і під час тестового періоду була безкоштовною.
Перший результат DeepSWE — 80% на 8 із 10 завдань — виявився занадто малим для надійного висновку; повніші оцінювання дали приблизно 58,4–63%, що радше відповідає рівню Claude Opus 4.8, а не доводить беззаперечну пере...