Ox Alpha была анонимной тестовой версией GLM 5.3 Flash от Z.ai; компания подтвердила это 26 августа 2026 года. Модель получила контекстное окно на 1 048 576 токенов, поддержку текста, изображений и видео, вызов инструментов и бесплатный доступ во время предварительного запуска.
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What is the anonymous AI model “Ox Alpha” (or “Niu Lai”), launched quietly on OpenRouter and OpenCode on August 20, 2026 and offered free fo. Article summary: Ox Alpha was a short anonymous “stealth” preview, not a still-unidentified new lab model: Z.ai subsequently identified it as GLM-5.3-Flash, a GLM-family model. Its strong early agentic-coding showing and unusually genero. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
Ox Alpha была не новым загадочным ИИ-стартапом, а анонимной предварительной версией GLM-5.3-Flash из линейки Z.ai. Модель появилась 20 августа 2026 года на OpenRouter и OpenCode под именем провайдера «Stealth». Ей приписывали контекстное окно на 1 048 576 токенов, поддержку текста, изображений и видео, вызов инструментов и нулевую цену за токены на период тестирования. Позднее Z.ai подтвердила, что до официального релиза тестировала GLM-5.3-Flash анонимно под идентификатором ox-alpha. 110
Эта история стала показательным примером того, как удачное сочетание дистрибуции, щедрого бесплатного доступа и возможностей для ИИ-агентов может превратить модель в технологическую сенсацию ещё до публикации полноценной документации и официальных бенчмарков.
Анонимная модель позиционировалась как система рассуждений для программирования, длительной агентной работы и производственных нагрузок. Для бесплатного превью её характеристики выглядели необычно масштабными:
stealth/ox-alpha;OpenRouter и OpenCode по-разному описывали продолжительность бесплатного доступа. OpenRouter указывала более короткий срок для своего маршрута, а OpenCode обещала примерно неделю с 20 августа. Поэтому ориентировочная граница для бесплатных вариантов приходилась на 24–27 августа, а не на одну общую дату для всех пользователей. 2412
Большое контекстное окно само по себе не делает модель умнее. Но оно расширяет круг задач, которые можно выполнять за один сеанс. Агент для программирования способен удерживать в контексте больше файлов репозитория, результатов вызова инструментов, журналов и визуальной информации, не пересказывая их постоянно заново. Поддержка видео также сделала Ox Alpha интересной для тестирования интерфейсов и других сценариев, выходящих за рамки текстовой генерации кода. 343
Главное преимущество Ox Alpha было не в загадочном происхождении, а в практической доступности. Разработчики получили возможность бесплатно проверять модель с контекстом на миллион токенов, мультимодальным вводом и инструментами при относительно щедрых лимитах. Это снизило порог для экспериментов с исправлением ошибок в репозиториях, браузерным взаимодействием и продолжительными инженерными задачами.
Популярность модели росла практически сразу. На OpenCode она ненадолго прервала 56-дневную серию DeepSeek на вершине рейтинга, а сообщения о спросе указывали на необычный однодневный скачок использования. При этом распространявшиеся во время запуска заявления о гигантской пропускной способности и объёмах обработанных токенов не были полностью независимо проверены. Их разумнее считать свидетельством высокого интереса, а не точным измерением производственного масштаба. 114
Это важная оговорка: популярность бесплатной модели отражает одновременно её возможности, новизну, цену и доступность. Сам по себе всплеск использования не доказывает, что система в целом сильнее всех конкурентов.
Самым вирусным стал результат 80% в DeepSWE — восемь успешно решённых задач из десяти. Это обнадёживающий сигнал, однако выборка из 10 задач слишком мала для устойчивого места в рейтинге. В более крупном прогоне сообщалось примерно о 63%, а позднее Z.ai указала для GLM-5.3-Flash официальный результат 63,4% в DeepSWE v1.1. 7634
Другие полные оценки дали более низкий показатель — в частности, сообщалось о 58,4% на 113 задачах. В этой проверке значительная доля неудач была связана с форматом ответа и особенностями реализации. Это показывает, насколько агентные бенчмарки зависят от конфигурации тестового контура, набора инструментов, ограничений по времени и критериев успеха. 4142
Поэтому наиболее аккуратный вывод звучит уже не так громко, как первый заголовок: Ox Alpha продемонстрировала сильные способности в задачах для программирующих агентов и в отдельных проверках приблизилась к ведущим закрытым моделям. Но имеющиеся данные не доказывают, что она стабильно превосходила Claude Fable 5 или любую другую передовую систему.
Разные оценки использовали разные подмножества задач, агентные оболочки и условия запуска. Тест на 10 задачах вполне мог дать 80%, не будучи репрезентативным для всего набора. Прогон на полном бенчмарке с результатом около 63% уже описывает другую картину, а показатель 58,4% мог дополнительно учитывать ошибки формата и поведения тестовой оболочки.
Позднее представители команды DeepSWE, как сообщалось, оценили общий уровень модели как примерно сопоставимый с Claude Opus 4.8, а не как убедительное доказательство превосходства над Claude Fable 5. 35 Поэтому показатели DeepSWE следует приводить вместе с описанием их масштаба и условий, а не складывать в один безоговорочный рейтинг.
Положительные отзывы хорошо соответствовали рабочему профилю Ox Alpha. Патрик Коллисон назвал модель «очень впечатляющей» после использования через агентную оболочку, а основатель HermesAgent заявил, что она превысила несколько внутренних критериев оценки команды. 3335
Такие отзывы важны как свидетельства практической пользы в конкретных рабочих процессах — прежде всего в программировании и агентных сценариях. Но они не равнозначны контролируемому межбенчмарковому выводу о безусловном превосходстве.
Модель может особенно хорошо подходить для определённого процесса благодаря длине контекста, поведению при вызове инструментов, скорости, поддержке разных модальностей или низкой стоимости, даже если её итоговое положение в сводных рейтингах остаётся неопределённым.
До официального раскрытия исследователи сопоставляли наблюдаемое поведение Ox Alpha с возможными системами Xiaomi MiMo, Google DeepMind и Zhipu AI.
Xiaomi казалась возможным кандидатом хотя бы потому, что команда MiMo ранее уже проводила анонимное тестирование модели Hunter Alpha. Однако затем разработчики обратили внимание на несоответствие возможностей: модели MiMo связывали с поддержкой аудио, тогда как Ox Alpha принимала текст, изображения и видео, но не аудио. Это сделало Xiaomi интересной гипотезой, но не убедительной атрибуцией. 2229
Дополнительные догадки породили намёки и публикации, связанные с Google. Но доступные признаки не подтверждали, что именно DeepMind создала или обслуживала конечную точку. Они оставались косвенными и не позволяли установить авторство.
Самые сильные признаки до официального объявления указывали на семейство GLM от Zhipu AI. В тестах сообщества количество токенов в Ox Alpha совпадало с поведением GLM-5.3 на разных запросах, за исключением постоянного смещения примерно на 75 токенов — вероятного следа скрытой системной инструкции или маршрутизирующей оболочки. Отдельные проверки видео показали совпадение с визуальными моделями GLM по нескольким характеристикам кодирования. 1821
Также сообщалось о следующих признаках:
reasoning_effort, похожей на ответ API GLM;Каждый из этих признаков по отдельности мог быть следствием маршрутизации, общей инфраструктуры, особенностей оболочки или имитации. Вместе они сделали версию о GLM всё более убедительной, но не заменяли официального заявления. Решающее подтверждение появилось, когда Z.ai назвала Ox Alpha моделью GLM-5.3-Flash и опубликовала документацию о релизе. 1043
После объявления Ox Alpha перестала быть загадкой об авторстве и превратилась в публичное превью продукта. Согласно документации Z.ai, GLM-5.3-Flash — гибридная модель с 320 млрд параметров всего и 18 млрд активных параметров, оснащённая нативными визуальными возможностями. Она может наблюдать интерфейсы, анализировать результат рендеринга и учитывать обратную связь от взаимодействия, создавая замкнутый цикл между кодом, браузером и графическим интерфейсом. 43
Именованный релиз также устранил главный недостаток анонимной конечной точки — неопределённость относительно её дальнейшей судьбы. GLM-5.3-Flash была представлена под лицензией MIT, а веса стали доступны разработчикам, которым нужен больший контроль над размещением и эксплуатацией модели. 1950
Впрочем, это не означает, что любое развёртывание автоматически будет безопасным или дешёвым. Командам по-прежнему предстоит оценить требования к оборудованию, скорость инференса, условия API, работу с приватными данными, ограничения запросов, надёжность вызова инструментов и стабильность ответов в собственных сценариях.
Бесплатное превью привлекло внимание, но долгосрочное использование определяется более устойчивыми факторами:
Главный урок Ox Alpha не в том, что неизвестная модель якобы на короткое время победила знаменитого конкурента. Он в том, что удачно спроектированный рабочий инструмент способен быстро распространиться, если разработчикам разрешают масштабно и почти без ограничений его тестировать.
История с бенчмарками оказалась сложнее первых заголовков, но сочетание длинного контекста, мультимодальности, инструментов, агентного программирования и низкой стоимости действительно оправдало интерес. Теперь, когда личность модели раскрыта и за ней закреплено имя GLM-5.3-Flash, главный тест впереди: останется ли это сочетание столь же полезным, когда новизна и бесплатный доступ перестанут работать как главные драйверы.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Ox Alpha была анонимной тестовой версией GLM 5.3 Flash от Z.ai; компания подтвердила это 26 августа 2026 года.
Ox Alpha была анонимной тестовой версией GLM 5.3 Flash от Z.ai; компания подтвердила это 26 августа 2026 года. Модель получила контекстное окно на 1 048 576 токенов, поддержку текста, изображений и видео, вызов инструментов и бесплатный доступ во время предварительного запуска.
Результат 80% в DeepSWE оказался показателем лишь на 10 задачах; на полном наборе оценки находились примерно в диапазоне 58,4–63,4%, что скорее указывает на уровень, сопоставимый с Claude Opus 4.8, чем на безусловное...