Частное облако Featherless для GLM 5.2 стоит $7,500 в месяц с безлимитными токенами на 4× AMD Instinct MI325X GPU. Модель 744B MoE обходит GPT 5.5 на бенчмарке SWE bench Pro (62.1% против 58.6%), при этом стоимость за токен примерно в 6 раз ниже, чем у GPT 5.5 и Claude Opus 4.8.
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What is Featherless's new fixed-fee private cloud service for GLM 5.2, including its pricing, har. Article summary: Featherless's new service offers a **$7,500/month flat-fee private cloud** for GLM 5.2 on 4× AMD MI325X GPUs, claiming **94% cost savings** over proprietary APIs for high-volume agentic usage. The 744B MoE model beats GP. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
Featherless запустил выделенное частное облачное развертывание модели GLM 5.2 с открытыми весами от Z.ai. Услуга предоставляется по фиксированной ежемесячной плате $7,500 без поминутной оплаты за токены. Сервис оптимизирован для работы на GPU AMD Instinct MI325X, и компания утверждает, что это позволяет сократить расходы на инференс на 94% по сравнению с закрытыми аналогами, такими как GPT-5.5 и Claude Opus 4.8 IF. Вот всё, что нужно знать о сервисе, модели и её позиционировании относительно проприетарных альтернатив.
Featherless запустил выделенное частное облачное развертывание модели GLM 5.2 от Z.ai, оптимизированное для работы нативно на GPU AMD Instinct MI325X IF. Featherless утверждает, что это единственная платформа, которая оптимизировала GLM 5.2 для работы на AMD-оборудовании в частном облаке I. Такой подход позволяет клиентам отказаться от биллинга на основе токенов и вместо этого платить фиксированную годовую сумму в $90,000 за полностью загруженную команду разработчиков I.
Как считаются цифры: GLM 5.2 на публичном API стоит примерно в 1/5–1/6 цены за токен по сравнению с GPT-5.5 или Claude Opus 4.8 GD. По выходным токенам GLM-5.2 по $4.40 за миллион против $30 у GPT-5.5 — это примерно 1/6.8 стоимости OF. Кэшированный ввод падает до $0.26 за миллион токенов GF.
Каждый экземпляр частного облака работает на 4 × AMD Instinct MI325X GPU FO. Микроархитектура MI325X включает:
Это заметно отличается от распространенных развертываний на NVIDIA H100/H200, и Featherless позиционирует это как способ избежать проблем с поставками чипов NVIDIA I.
| Характеристика | Детали |
|---|---|
| Архитектура | 744B параметров, Mixture-of-Experts (MoE) с ~40B активных на токен GS |
| Контекстное окно | До 256K токенов в публичном облаке; до 1 млн токенов в частном облаке FI |
| Квантование | FP8 по умолчанию (~750 ГБ VRAM для весов) FOR |
| Открытые веса | Да — Z.ai выпустил GLM 5.2 с открытыми весами под лицензией MIT IDA |
| Фокус обучения | Кодинг; специализация на задачах программной инженерии GDS |
При квантовании FP8 веса модели занимают около 750 ГБ VRAM, что с запасом укладывается в 1 ТБ общей VRAM 4× GPU MI325X (4 × 256 ГБ), оставляя место для KV-кэша при расширенной длине контекста OR.
SWE-bench Pro (реальные задачи программной инженерии):
Terminal-Bench 2.1 (агентные задачи кодинга):
По данным Featherless, GLM 5.2 занимает #2 в рейтинге Arena WebDev по кодингу F.
Преимущество в стоимости — главный козырь GLM 5.2. По официальным тарифам API Z.ai:
| Модель | Ввод (за 1 млн токенов) | Вывод (за 1 млн токенов) |
|---|---|---|
| GLM 5.2 | $1.40 | $4.40 |
| GPT-5.5 | ~$5.00 | ~$30.00 |
| Claude Opus 4.8 | ~$8.00 | ~$40.00 |
При реалистичном соотношении выходных и входных токенов 3:1 GLM-5.2 выходит около $3.65 за миллион токенов против примерно $23.75 у GPT-5.5 — соотношение около 1/6.5 O. Независимые трекеры указывают более низкие средние цены среди провайдеров, обслуживающих открытые веса (около $0.55 за ввод и $1.85 за вывод) DD.
Частное облако Featherless для GLM 5.2 наиболее привлекательно для:
Featherless также предлагает тарифы с фиксированной ставкой от $25/месяц для serverless-доступа к меньшим моделям, но выделенный узел за $7,500/месяц предназначен именно для команд, которым требуется постоянный высокообъемный инференс на полной модели GLM 5.2 F.
Новый сервис Featherless предлагает частное облако GLM 5.2 на 4× AMD MI325X GPU за $7,500/месяц с фиксированной платой, заявляя об экономии 94% по сравнению с проприетарными API при высоких агентных нагрузках. Модель 744B MoE превосходит GPT-5.5 на SWE-bench Pro при стоимости за токен примерно в шесть раз ниже, что делает её убедительной альтернативой с открытыми весами для организаций с тяжелыми нагрузками по кодингу и агентному инференсу. Хотя Claude Opus 4.8 все еще лидирует по некоторым бенчмаркам, ценовое преимущество комбинации GLM 5.2 + Featherless достаточно велико, чтобы считать её серьезным вариантом для бюджетных команд, не желающих жертвовать производительностью.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Частное облако Featherless для GLM 5.2 стоит $7,500 в месяц с безлимитными токенами на 4× AMD Instinct MI325X GPU.
Частное облако Featherless для GLM 5.2 стоит $7,500 в месяц с безлимитными токенами на 4× AMD Instinct MI325X GPU. Модель 744B MoE обходит GPT 5.5 на бенчмарке SWE bench Pro (62.1% против 58.6%), при этом стоимость за токен примерно в 6 раз ниже, чем у GPT 5.5 и Claude Opus 4.8.
GLM 5.2 поддерживает контекст до 1 млн токенов в частном облаке и работает в квантовании FP8, что делает её конкурентоспособной альтернативой с открытым весом для кодинга и агентных задач.