С 00:00 17 августа 2026 года по пекинскому времени DeepSeek перевёл V4 Flash и V4 Pro с фиксированных тарифов на пиковую и внепиковую оплату: вне пиковых интервалов цены вдвое ниже. В часы пик вывод стоит ¥9 за миллион токенов для V4 Flash и ¥27 для V4 Pro; обработка кэшированного ввода остаётся значительно дешевле...
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What changed when DeepSeek’s new API pricing for DeepSeek-V4-Flash and DeepSeek-V4-Pro took effect at midnight on August 17, 2026—including. Article summary: At 00:00 Beijing time on August 17 (16:00 UTC on August 16), DeepSeek replaced flat V4 API pricing with time-of-use pricing: off-peak rates are exactly half peak rates. Peak is 09:00–12:00 and 14:00–18:00 Beijing time da. Topic tags: general, news, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, waterm
С 00:00 17 августа 2026 года по пекинскому времени DeepSeek отказался от единой сетки цен для API V4. Теперь стоимость запроса зависит от времени его получения платформой: вне пиковых периодов тариф составляет ровно половину пикового. В пересчёте на всемирное время переход произошёл 16 августа в 16:00 UTC. 1
2
Новые правила действуют для DeepSeek-V4-Flash и DeepSeek-V4-Pro. Пиковыми считаются два ежедневных интервала по пекинскому времени:
Все остальные часы относятся к внепиковым. Для отдельного запроса учитывается момент, когда сервер платформы его получил, а не время завершения обработки. Поэтому при планировании очередей разработчикам важно ориентироваться именно на время Пекина. 2
7
Иными словами, один и тот же вызов модели может стоить в два раза дороже или дешевле в зависимости от часа отправки. Это не просто равномерное повышение цен, а переход к тарифам, чувствительным к загрузке инфраструктуры.
Все суммы ниже указаны в юанях за 1 млн токенов. Попадание в кэш означает, что входная часть запроса использует ранее сохранённый префикс промпта. При промахе кэша ввод обрабатывается по более высокой ставке.
| Модель и тип токенов | Прежний тариф | Вне пика | Изменение | В часы пик | Изменение |
|---|---|---|---|---|---|
| V4-Flash, ввод с попаданием в кэш | ¥0,02 | ¥0,05 | +150% | ¥0,10 | +400% |
| V4-Flash, ввод без попадания в кэш | ¥1,00 | ¥1,50 | +50% | ¥3,00 | +200% |
| V4-Flash, вывод | ¥2,00 | ¥4,50 | +125% | ¥9,00 | +350% |
| V4-Pro, ввод с попаданием в кэш | ¥0,025 | ¥0,15 | +500% | ¥0,30 | +1 100% |
| V4-Pro, ввод без попадания в кэш | ¥3,00 | ¥4,50 | +50% | ¥9,00 | +200% |
| V4-Pro, вывод | ¥6,00 | ¥13,50 | +125% | ¥27,00 | +350% |
Для V4-Flash документация отдельно подтверждает тарифы ¥0,05, ¥1,50 и ¥4,50 вне пиковых часов и ¥0,10, ¥3 и ¥9 в часы пик — соответственно для кэшированного ввода, ввода без кэширования и вывода. 2 В целом новые ставки DeepSeek выросли на 50–1 100% в зависимости от модели, типа токенов и времени использования.
1
8
Оценку моделей, индексацию документов, массовую обработку данных, генерацию синтетических наборов и другие несрочные операции можно поставить в очередь на внепиковое время. Поскольку тариф там вдвое ниже, одно только расписание способно заметно сократить расходы на гибких нагрузках. 2
Для AI-инфраструктуры часовой пояс становится такой же операционной переменной, как объём токенов или выбор модели. Планировщик может учитывать дедлайн и пекинское время тарификации, откладывая выполнение задач без уменьшения контекстного окна или бюджета токенов.
Чат поддержки, помощники для программирования и агенты реального времени работают тогда, когда активны пользователи. Им чаще придётся оплачивать пиковые ставки. Снизить расходы всё же можно за счёт повторного использования промптов, более эффективного кэширования, ограничения длины ответа и автоматического выбора модели.
Кэш особенно важен: на обеих моделях обработанный кэшем ввод намного дешевле ввода без попадания в кэш. Для систем, которые постоянно отправляют одни и те же инструкции, описания инструментов или фрагменты документов, повышение доли cache hit может дать больший эффект, чем небольшое сокращение числа запросов.
Сильнее всего в денежном выражении новая схема затрагивает приложения, генерирующие длинные рассуждения, отчёты и программный код. В часы пик миллион выходных токенов стоит ¥9 у Flash и ¥27 у Pro. Разработчикам стоит ограничивать максимальную длину ответа, использовать Flash для типовых операций и оставлять Pro для задач, где его дополнительные возможности оправдывают более высокую цену. 1
2
Пиковая цена кэшированного ввода V4-Pro в 12 раз выше прежнего фиксированного тарифа — это максимальный относительный рост в новой таблице. В абсолютных юанях ставка остаётся небольшой по сравнению с необработанным вводом и выводом, однако для сервисов с огромным объёмом повторяющихся промптов изменение может быть существенным. 1
19
Изменение цен последовало за переводом DeepSeek-V4-Pro-0813 в общий доступ через эндпоинт deepseek-v4-pro в августе. Согласно опубликованным характеристикам, это текстовая модель с контекстным окном на 1 млн токенов, максимальным объёмом вывода 384 000 токенов и архитектурой mixture of experts примерно на 1,6 трлн общих параметров, из которых около 49 млрд активируются для каждого токена. 29
33
Документированные ограничения параллельных запросов на аккаунт также различаются:
Слот занят до полного завершения запроса, включая потоковую передачу ответа. 28
Вместе цены и лимиты указывают на разделение ролей: Flash лучше подходит для большого потока типовых запросов, а Pro выглядит как более ограниченный по пропускной способности уровень для сложного рассуждения и работы с длинным контекстом. Это вывод из опубликованных экономических условий и лимитов, а не прямое заявление DeepSeek о каждом сценарии использования. 2
28
Новая модель напоминает управление спросом на GPU-инференс. Нагрузка на вычислительные мощности особенно концентрируется в часы, когда пользователи активно работают с интерактивными сервисами. Пакетные задания зачастую можно отложить. Более высокая цена в периоды дефицита мощности и скидка в остальное время создают стимул распределять вычисления равномернее.
Для разработчиков это меняет саму задачу оптимизации расходов. Теперь нужно учитывать не только модель и количество токенов, но и:
Более широкий сигнал — отход от простой ценовой конкуренции вокруг единого тарифа к оплате, зависящей от дефицита вычислительных мощностей. DeepSeek сохраняет более дешёвый вариант для гибкого спроса, но делает стоимость высокопроизводительного инференса чувствительной ко времени запуска. Reuters описывал изменение как существенное повышение, различающееся по моделям, категориям токенов и периодам использования, а не как единую надбавку для всех запросов. 1
Практический вывод для команд, использующих DeepSeek V4, прост: расписание, кэширование, маршрутизация запросов и ограничение вывода теперь являются частью расчёта стоимости API. Нагрузку, которую нельзя перенести по времени, возможно, придётся направить на другую модель или ограничить по токенам. А задачи, способные подождать, могут сохранить значительную часть прежней экономичности за счёт запуска вне пиковых часов.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
С 00:00 17 августа 2026 года по пекинскому времени DeepSeek перевёл V4 Flash и V4 Pro с фиксированных тарифов на пиковую и внепиковую оплату: вне пиковых интервалов цены вдвое ниже.
С 00:00 17 августа 2026 года по пекинскому времени DeepSeek перевёл V4 Flash и V4 Pro с фиксированных тарифов на пиковую и внепиковую оплату: вне пиковых интервалов цены вдвое ниже. В часы пик вывод стоит ¥9 за миллион токенов для V4 Flash и ¥27 для V4 Pro; обработка кэшированного ввода остаётся значительно дешевле ввода без попадания в кэш.
Планирование задач, повторное использование промптов и выбор между Flash и Pro теперь становятся частью единой стратегии управления расходами на API.