26 августа 2026 года Z.ai подтвердила, что бесплатная анонимная модель Ox Alpha была превью версией GLM 5.3 Flash — мультимодальной MoE модели на 320 млрд параметров, из которых на каждом шаге активны 18 млрд. GLM 5.3 Flash принимает текст, изображения и видео, рассчитана примерно на миллион токенов контекста и стои...
ОпубликовалОтредактировано с помощью GPT-5.6 LunaИзображения созданы с помощью GPT Image 1.5
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did Z.ai, the Chinese AI company formerly known as Zhipu AI, reveal about the anonymous “Ox Alpha” model that appeared free and without. Article summary: Z.ai disclosed on August 26 that the previously anonymous, free “Ox Alpha” preview was **GLM-5.3-Flash**—the first natively multimodal GLM-5 model. It is an open-weight, low-cost coding and agent model whose stealth rele. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
26 августа 2026 года Z.ai раскрыла интригу: модель Ox Alpha, которую без указания разработчика предлагали через OpenRouter и OpenCode, оказалась GLM-5.3-Flash. Компания представила её как первую нативно мультимодальную модель семейства GLM-5 — с открытыми весами, контекстом примерно на миллион токенов и ориентацией на программирование и длительные задачи ИИ-агентов. 15
40
Но важна не только личность модели. Ox Alpha сочетала бесплатный анонимный доступ с реальными нагрузками от разработчиков, а затем превратилась в официально названный и доступный для скачивания продукт. Для Z.ai это был одновременно масштабный тест инфраструктуры и способ подогреть интерес к релизу.
GLM-5.3-Flash — это модель архитектуры mixture of experts (MoE, «смесь экспертов») с 320 млрд параметров, из которых при обработке каждого токена активируются 18 млрд. Она изначально работает с текстом, изображениями и видео, а генерирует текст. Заявленная ёмкость контекста составляет около миллиона токенов: в документации Z.ai указано 1 048 576 токенов, а OpenRouter отображает лимит 1 310 720 токенов. 1
2
3
40
Веса модели опубликованы под лицензией MIT, поэтому её можно использовать и разворачивать значительно свободнее, чем обычный закрытый API-сервис. После завершения анонимного превью модель появилась на OpenRouter под своим официальным названием. 3
4
8
GLM-5.3-Flash не следует путать с более крупной GLM-5.3, представленной ранее в августе. Судя по сообщениям о релизе, Flash — отдельный и более доступный продукт формата 320B-A18B, а не то же самое, что крупная модель линейки GLM-5.3. 10
Z.ai заявляет, что GLM-5.3-Flash превосходит GLM-5.2 и при этом обходится дешевле в обслуживании. В результатах, опубликованных вокруг запуска, модель получила 63,4 балла в DeepSWE v1.1 против 46,2 у GLM-5.2. На внутреннем тесте программирования Z.ai сообщила о результате 29,0, тогда как для Claude Opus 4.8 приводится показатель 29,5. 3
16
Эти цифры показывают, как Z.ai позиционирует новинку, но не являются независимым подтверждением равенства с моделью Anthropic. Для корректного сравнения важны методика теста, настройки оценки, формулировки запросов и возможность воспроизвести результат. Осторожный вывод таков: Z.ai заявляет о сильных навыках программирования и работе с агентами при существенно меньшей стоимости. Доказательств того, что GLM-5.3-Flash в целом превзошла закрытые флагманские модели, эти данные не дают.
Самой заметной особенностью Ox Alpha был бесплатный доступ во время анонимного тестирования. После раскрытия названия этот режим завершился. Официальный тариф Z.ai составил $0,15 за миллион входных токенов и $0,50 за миллион выходных. 1
3
На старте OpenRouter показывал более низкую промоцену — $0,075 за миллион входных и $0,25 за миллион выходных токенов. Поэтому важно не смешивать три разных условия: бесплатное превью, базовый тариф Z.ai и временную скидку конкретной платформы. 2
Даже при официальной цене экономика остаётся главным аргументом модели. Программные агенты способны расходовать большие объёмы контекста и генерируемого текста, поэтому стоимость токенов иногда влияет на выбор модели не меньше, чем небольшая разница в результатах бенчмарков.
Z.ai заявила, что GLM-5.3-Flash полностью работает на ускорителях искусственного интеллекта китайского производства. 15 В описаниях серверной системы упоминается специализированный стек на базе SGLang, в котором используются квантизация, тензорный параллелизм, смешанные форматы кэша, разделение слоёв и раздельная архитектура encode–prefill–decode. Последняя отделяет мультимодальное кодирование, обработку входного контекста и поэтапную генерацию токенов, чтобы эффективнее масштабировать разные части системы.
25
Этот подход продолжает более раннюю историю семейства GLM: Z.ai заявляла, что обучала модели GLM-5 на процессорах Huawei Ascend без оборудования Nvidia. В то же время включение Z.ai в американский список Entity List ограничивает доступ компании к ускорителям Nvidia H100, H200 и B200. 26
Стратегическое значение заявления велико, однако его не стоит воспринимать как полностью независимый аудит производительности оборудования. Наиболее надёжный вывод заключается в том, что Z.ai демонстрирует возможность обслуживать крупную мультимодальную модель без опоры на передовые серверные GPU Nvidia.
Сценарий Ox Alpha похож на продуманный «стелс»-запуск: сначала предложить способную модель без бренда, дать разработчикам бесплатный доступ через популярные инструменты для программирования, посмотреть на реальные сценарии использования и только потом раскрыть продукт. Ранее с Z.ai связывали похожий эксперимент под названием Pony Alpha, а участники сообщества пытались вычислить происхождение Ox Alpha по особенностям токенизатора, обработке видео и характерным ошибкам API. 7
11
13
Некоторые публикации периода запуска также сообщали о необычно больших объёмах использования и высокой активности разработчиков. Однако доступные материалы не позволяют независимо подтвердить каждую приведённую цифру или цитату. Такие сведения следует считать сообщениями о запуске, а не проверенной статистикой внедрения. 14
В этом и состоит практический смысл стратегии: модель получила нагрузку, близкую к производственной, ещё до официального объявления. Z.ai смогла проверить работу сервисов на больших объёмах запросов, собрать обратную связь и одновременно превратить попытки сообщества раскрыть тайну в дополнительное внимание к релизу.
GLM-5.3-Flash не доказывает, что Z.ai обошла OpenAI или Anthropic по всему спектру возможностей передовых моделей. Зато релиз объединяет несколько факторов, которые редко встречаются вместе: мультимодальный ввод, очень длинный контекст, открытые веса под лицензией MIT, специализацию на программных агентах и низкую цену API. 15
40
Для разработчиков это снижает издержки перехода между поставщиками и делает более реалистичными самостоятельное развёртывание и использование нескольких провайдеров. Для создателей закрытых моделей это означает дополнительное давление на цены и маржу — особенно в задачах программирования, где важны не только места в рейтингах, но и объём токенов, задержка ответа, контроль над развёртыванием и доступность весов.
Главный урок запуска Ox Alpha не в том, что анонимная модель внезапно победила всех конкурентов. Он в том, что дешёвая открытая модель может сначала доказать свою ценность в реальной работе, а уже затем получить имя, документацию и официальный статус.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
26 августа 2026 года Z.ai подтвердила, что бесплатная анонимная модель Ox Alpha была превью версией GLM 5.3 Flash — мультимодальной MoE модели на 320 млрд параметров, из которых на каждом шаге активны 18 млрд.
26 августа 2026 года Z.ai подтвердила, что бесплатная анонимная модель Ox Alpha была превью версией GLM 5.3 Flash — мультимодальной MoE модели на 320 млрд параметров, из которых на каждом шаге активны 18 млрд. GLM 5.3 Flash принимает текст, изображения и видео, рассчитана примерно на миллион токенов контекста и стоит по официальному тарифу Z.ai $0,15 за миллион входных токенов и $0,50 за миллион выходных.
Скрытое тестирование позволило Z.ai проверить производительность инфраструктуры на реальных нагрузках разработчиков, собрать обратную связь и превратить анонимное превью в заметный запуск продукта.
26 августа 2026 года Z.ai подтвердила, что бесплатная анонимная модель Ox Alpha была превью версией GLM 5.3 Flash — мультимодальной MoE модели на 320 млрд параметров, из которых на каждом шаге активны 18 млрд. GLM 5.3 Flash принимает текст, изображения и видео, рассчитана примерно на миллион токенов контекста и стои...
ОпубликовалОтредактировано с помощью GPT-5.6 LunaИзображения созданы с помощью GPT Image 1.5
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did Z.ai, the Chinese AI company formerly known as Zhipu AI, reveal about the anonymous “Ox Alpha” model that appeared free and without. Article summary: Z.ai disclosed on August 26 that the previously anonymous, free “Ox Alpha” preview was **GLM-5.3-Flash**—the first natively multimodal GLM-5 model. It is an open-weight, low-cost coding and agent model whose stealth rele. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
26 августа 2026 года Z.ai раскрыла интригу: модель Ox Alpha, которую без указания разработчика предлагали через OpenRouter и OpenCode, оказалась GLM-5.3-Flash. Компания представила её как первую нативно мультимодальную модель семейства GLM-5 — с открытыми весами, контекстом примерно на миллион токенов и ориентацией на программирование и длительные задачи ИИ-агентов. 15
40
Но важна не только личность модели. Ox Alpha сочетала бесплатный анонимный доступ с реальными нагрузками от разработчиков, а затем превратилась в официально названный и доступный для скачивания продукт. Для Z.ai это был одновременно масштабный тест инфраструктуры и способ подогреть интерес к релизу.
GLM-5.3-Flash — это модель архитектуры mixture of experts (MoE, «смесь экспертов») с 320 млрд параметров, из которых при обработке каждого токена активируются 18 млрд. Она изначально работает с текстом, изображениями и видео, а генерирует текст. Заявленная ёмкость контекста составляет около миллиона токенов: в документации Z.ai указано 1 048 576 токенов, а OpenRouter отображает лимит 1 310 720 токенов. 1
2
3
40
Веса модели опубликованы под лицензией MIT, поэтому её можно использовать и разворачивать значительно свободнее, чем обычный закрытый API-сервис. После завершения анонимного превью модель появилась на OpenRouter под своим официальным названием. 3
4
8
GLM-5.3-Flash не следует путать с более крупной GLM-5.3, представленной ранее в августе. Судя по сообщениям о релизе, Flash — отдельный и более доступный продукт формата 320B-A18B, а не то же самое, что крупная модель линейки GLM-5.3. 10
Z.ai заявляет, что GLM-5.3-Flash превосходит GLM-5.2 и при этом обходится дешевле в обслуживании. В результатах, опубликованных вокруг запуска, модель получила 63,4 балла в DeepSWE v1.1 против 46,2 у GLM-5.2. На внутреннем тесте программирования Z.ai сообщила о результате 29,0, тогда как для Claude Opus 4.8 приводится показатель 29,5. 3
16
Эти цифры показывают, как Z.ai позиционирует новинку, но не являются независимым подтверждением равенства с моделью Anthropic. Для корректного сравнения важны методика теста, настройки оценки, формулировки запросов и возможность воспроизвести результат. Осторожный вывод таков: Z.ai заявляет о сильных навыках программирования и работе с агентами при существенно меньшей стоимости. Доказательств того, что GLM-5.3-Flash в целом превзошла закрытые флагманские модели, эти данные не дают.
Самой заметной особенностью Ox Alpha был бесплатный доступ во время анонимного тестирования. После раскрытия названия этот режим завершился. Официальный тариф Z.ai составил $0,15 за миллион входных токенов и $0,50 за миллион выходных. 1
3
На старте OpenRouter показывал более низкую промоцену — $0,075 за миллион входных и $0,25 за миллион выходных токенов. Поэтому важно не смешивать три разных условия: бесплатное превью, базовый тариф Z.ai и временную скидку конкретной платформы. 2
Даже при официальной цене экономика остаётся главным аргументом модели. Программные агенты способны расходовать большие объёмы контекста и генерируемого текста, поэтому стоимость токенов иногда влияет на выбор модели не меньше, чем небольшая разница в результатах бенчмарков.
Z.ai заявила, что GLM-5.3-Flash полностью работает на ускорителях искусственного интеллекта китайского производства. 15 В описаниях серверной системы упоминается специализированный стек на базе SGLang, в котором используются квантизация, тензорный параллелизм, смешанные форматы кэша, разделение слоёв и раздельная архитектура encode–prefill–decode. Последняя отделяет мультимодальное кодирование, обработку входного контекста и поэтапную генерацию токенов, чтобы эффективнее масштабировать разные части системы.
25
Этот подход продолжает более раннюю историю семейства GLM: Z.ai заявляла, что обучала модели GLM-5 на процессорах Huawei Ascend без оборудования Nvidia. В то же время включение Z.ai в американский список Entity List ограничивает доступ компании к ускорителям Nvidia H100, H200 и B200. 26
Стратегическое значение заявления велико, однако его не стоит воспринимать как полностью независимый аудит производительности оборудования. Наиболее надёжный вывод заключается в том, что Z.ai демонстрирует возможность обслуживать крупную мультимодальную модель без опоры на передовые серверные GPU Nvidia.
Сценарий Ox Alpha похож на продуманный «стелс»-запуск: сначала предложить способную модель без бренда, дать разработчикам бесплатный доступ через популярные инструменты для программирования, посмотреть на реальные сценарии использования и только потом раскрыть продукт. Ранее с Z.ai связывали похожий эксперимент под названием Pony Alpha, а участники сообщества пытались вычислить происхождение Ox Alpha по особенностям токенизатора, обработке видео и характерным ошибкам API. 7
11
13
Некоторые публикации периода запуска также сообщали о необычно больших объёмах использования и высокой активности разработчиков. Однако доступные материалы не позволяют независимо подтвердить каждую приведённую цифру или цитату. Такие сведения следует считать сообщениями о запуске, а не проверенной статистикой внедрения. 14
В этом и состоит практический смысл стратегии: модель получила нагрузку, близкую к производственной, ещё до официального объявления. Z.ai смогла проверить работу сервисов на больших объёмах запросов, собрать обратную связь и одновременно превратить попытки сообщества раскрыть тайну в дополнительное внимание к релизу.
GLM-5.3-Flash не доказывает, что Z.ai обошла OpenAI или Anthropic по всему спектру возможностей передовых моделей. Зато релиз объединяет несколько факторов, которые редко встречаются вместе: мультимодальный ввод, очень длинный контекст, открытые веса под лицензией MIT, специализацию на программных агентах и низкую цену API. 15
40
Для разработчиков это снижает издержки перехода между поставщиками и делает более реалистичными самостоятельное развёртывание и использование нескольких провайдеров. Для создателей закрытых моделей это означает дополнительное давление на цены и маржу — особенно в задачах программирования, где важны не только места в рейтингах, но и объём токенов, задержка ответа, контроль над развёртыванием и доступность весов.
Главный урок запуска Ox Alpha не в том, что анонимная модель внезапно победила всех конкурентов. Он в том, что дешёвая открытая модель может сначала доказать свою ценность в реальной работе, а уже затем получить имя, документацию и официальный статус.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
26 августа 2026 года Z.ai подтвердила, что бесплатная анонимная модель Ox Alpha была превью версией GLM 5.3 Flash — мультимодальной MoE модели на 320 млрд параметров, из которых на каждом шаге активны 18 млрд.
26 августа 2026 года Z.ai подтвердила, что бесплатная анонимная модель Ox Alpha была превью версией GLM 5.3 Flash — мультимодальной MoE модели на 320 млрд параметров, из которых на каждом шаге активны 18 млрд. GLM 5.3 Flash принимает текст, изображения и видео, рассчитана примерно на миллион токенов контекста и стоит по официальному тарифу Z.ai $0,15 за миллион входных токенов и $0,50 за миллион выходных.
Скрытое тестирование позволило Z.ai проверить производительность инфраструктуры на реальных нагрузках разработчиков, собрать обратную связь и превратить анонимное превью в заметный запуск продукта.