DeepSeek V4 Flash занял первое место в недельном рейтинге OpenRouter за 27 июля — 2 августа с 7,22 трлн обработанных токенов, однако этот период частично пришёлся на прежнюю preview версию модели. Маршрут DeepSeek V4 Flash 0731 на OpenRouter указан по цене $0,05 за 1 млн входных и $0,16 за 1 млн выходных токенов — э...
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: How did DeepSeek V4-Flash, launched in public API beta on July 31, 2026, become OpenRouter’s most-used model within four days—reaching 7.1 t. Article summary: The reported surge is best explained by an unusually strong cost–capability–context combination, amplified by OpenRouter’s low-friction routing and likely substantial trial traffic—not by architecture alone. But several . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
DeepSeek-V4-Flash-0731 стал наглядным примером того, как быстро может измениться «модель по умолчанию» для разработчиков. Когда одновременно появляются очень низкие тарифы, огромный контекст и доступ через API-агрегатор, новая модель получает шанс мгновенно собрать огромный объём тестового трафика.
По данным TechNode, DeepSeek V4 Flash занял первое место в недельном рейтинге использования моделей OpenRouter за период с 27 июля по 2 августа, обработав 7,22 трлн токенов. 5 Однако интерпретировать этот результат как чистый эффект четырёхдневного запуска было бы неверно.
Версия от 31 июля — это разреженная модель типа MoE (mixture of experts, «смесь экспертов»): всего у неё 284 млрд параметров, но на каждый токен активируются 13 млрд. OpenRouter указывает контекстное окно в 1 310 720 токенов и позиционирует модель для программирования, рассуждений и агентных процессов. 1
Для команд, которые считают расходы на миллионы и миллиарды токенов, это сочетание выглядит особенно интересно:
Сама по себе MoE-архитектура не доказывает ни более высокое качество, ни гарантированно низкую итоговую цену. Её экономический смысл в другом: на токен задействуется лишь часть общей модели, поэтому вычислительная нагрузка может быть ниже, чем у плотной модели сопоставимого полного размера. Но итог для конкретного приложения зависит также от задержек, доступной мощности провайдера, маршрутизации, структуры промптов и длины ответов.
TechNode сообщает, что за неделю с 27 июля по 2 августа DeepSeek V4 Flash обработал на OpenRouter 7,22 трлн токенов. В том же материале сказано, что китайские модели заняли первые четыре позиции, а DeepSeek V4 Flash 0731 и V4 Pro вошли в первую шестёрку. 5
Но неделя началась до публичного бета-релиза 31 июля 2026 года. До этого V4 Flash уже существовал как preview-маршрут, а релиз 0731 заменил эту предварительную версию на API-эндпоинте deepseek-v4-flash. 3 Следовательно, нельзя утверждать, что все 7,22 трлн токенов были созданы исключительно новой версией 0731.
Есть и второй важный фактор — бесплатный доступ. По данным того же TechNode, 1 августа модель обработала в OpenCode 8 трлн токенов: 5 трлн пришлись на бесплатные тесты, ещё 3 трлн оплатили разработчики. 5 Пробный трафик важен: он снижает порог входа и позволяет быстро познакомить разработчиков с моделью. Но его нельзя приравнивать к устойчивому платному использованию в продакшене.
Более аккуратный вывод такой: V4-Flash очень быстро получил широкое распространение и огромный объём экспериментов. Имеющихся данных недостаточно, чтобы доказать, что весь ранний рост был следствием платных миграций или длительного промышленного использования.
Тарифы зависят от провайдера, конкретного маршрута, скидок, кеширования и даты проверки. В публикациях о релизе 31 июля упоминалась официальная цена $0,14 за 1 млн некешированных входных токенов и $0,28 за 1 млн выходных; в начале августа OpenRouter показывал иные ставки для отдельных маршрутов. 3
В более поздней карточке OpenRouter для маршрута deepseek-v4-flash-0731 указаны $0,05 за 1 млн входных токенов, $0,16 за 1 млн выходных и $0,013 за 1 млн токенов чтения из кеша. 1
При этих ставках разница с приведёнными тарифами конкурентов выглядит очень большой:
| Модель | Указанная цена за 1 млн входных / выходных токенов | Относительно V4-Flash по $0,05 / $0,16 |
|---|---|---|
| DeepSeek V4-Flash-0731 | $0,05 / $0,16 |
Базовый уровень |
| Kimi K3 | $3 / $15 |
примерно в 60 / 94 раза дороже |
| GPT-5.6 Sol | $5 / $30 |
примерно в 100 / 188 раз дороже |
| Claude Fable 5 | $10 / $50 |
примерно в 200 / 313 раз дороже |
Это арифметическое сравнение опубликованных прайс-листов, а не доказательство равенства моделей по качеству, скорости, надёжности инструментов, безопасности или доступности сервиса. Нельзя вывести из него и универсальную «стоимость задачи»: счёт зависит от объёма ввода и вывода, кеширования, повторных попыток, вызовов инструментов, выбранного провайдера и того, как часто система переключает задачу на более дорогую модель.
Эти модели не стоит считать взаимозаменяемыми только потому, что все они рассчитаны в том числе на сложное программирование и агентные сценарии. В использованном сравнении Kimi K3 описана как MoE-модель с 2,8 трлн параметров и контекстом в 1 млн токенов; для GPT-5.6 Sol указано 1,05 млн токенов контекста, для Claude Fable 5 — 1 млн. 17
Для покупателя важнее не идеология модели, а практическая роль в рабочем процессе:
Открытые бенчмарки полезны для первичного отбора, но один показатель не определяет модель для продакшена. Утверждение о результате 25,2 против 25,7 в сравнении «Agent Ultimate» не было независимо подтверждено представленными первичными источниками, поэтому использовать его как доказательство почти полной эквивалентности нельзя. В материалах DeepSeek приведены, например, 82,7 на Terminal Bench 2.1 и 54,2 на NL2Repo, но и эти результаты требуют проверки на реальных задачах конкретной команды. 10
Для средней команды разработки вопрос обычно звучит не так: «Какая модель выше в лидерборде?» Гораздо полезнее другой: достаточно ли модель надёжна на наших задачах, чтобы экономия пережила стоимость ошибок, повторов и переключений?
Практичный план проверки выглядит так:
Именно поэтому взлёт V4-Flash важен даже при возможном влиянии бесплатных тестов. Агрегатор моделей дал разработчикам возможность практически без трения проверить очень дешёвый вариант с длинным контекстом. Если он показывает приемлемый результат на внутренних продакшен-оценках, часть рутинного трафика действительно может уйти от более дорогих моделей по умолчанию.
Имеющиеся материалы подтверждают лидерство с 7,22 трлн токенов за неделю на OpenRouter, пересечение отчётного периода с эпохой preview-версии и заявленную значительную долю бесплатного тестового трафика в OpenCode. 3
5
Но они недостаточны для утверждений, что китайские модели заняли девять из десяти первых мест, четырнадцать недель подряд превосходили США по числу вызовов, вызвали масштабную миграцию разработчиков из США и Европы, обеспечили фактическое сокращение стоимости инференса на 60–85% или вынудили GPT-5.6 Luna снизить цену на 80%.
Для таких выводов нужны прямые данные панели OpenRouter, архивы тарифов провайдеров либо воспроизводимые исследования реальных рабочих нагрузок. Пока наиболее обоснованный итог скромнее: DeepSeek V4-Flash соединил крайне низкие заявленные цены на отдельных маршрутах, большой контекст и широкий доступ именно в момент, когда разработчики активно искали более дешёвые модели для кода и агентов. Этого достаточно для быстрого всплеска использования — но недостаточно, чтобы объявить долгосрочную перестройку рынка доказанным фактом.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
DeepSeek V4 Flash занял первое место в недельном рейтинге OpenRouter за 27 июля — 2 августа с 7,22 трлн обработанных токенов, однако этот период частично пришёлся на прежнюю preview версию модели.
DeepSeek V4 Flash занял первое место в недельном рейтинге OpenRouter за 27 июля — 2 августа с 7,22 трлн обработанных токенов, однако этот период частично пришёлся на прежнюю preview версию модели. Маршрут DeepSeek V4 Flash 0731 на OpenRouter указан по цене $0,05 за 1 млн входных и $0,16 за 1 млн выходных токенов — это особенно привлекательно для массовых задач с кодом, документами и агентными сценариями.
Ранний объём нельзя автоматически считать устойчивым платным спросом: 5 трлн из 8 трлн токенов, обработанных моделью в OpenCode 1 августа, по сообщению TechNode, пришлись на бесплатные тесты.