Бета DeepSeek V4.1 Flash стартовала 8 сентября 2026 года и была рассчитана примерно на два дня; 10 сентября модель официально вышла под API именем deepseek flash. Ключевое изменение — нативная мультимодальность: работа с изображениями встроена в архитектуру модели, а не вынесена в отдельный экспериментальный vision...
ОпубликовалОтредактировано с помощью GPT-5.6 TerraИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What is DeepSeek V4.1 Flash, and what are the key details of its September 2026 time-limited internal beta—including its new native multimod. Article summary: DeepSeek V4.1 Flash was initially a short, evaluation-oriented API beta of an intermediate Flash-tier model. It launched on September 8, 2026 with a new architecture and native visual understanding, unlike the earlier V4. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
В сентябре 2026 года DeepSeek V4.1 Flash прошла необычно короткий путь: 8 сентября появилась как временная бета для API, а уже 10 сентября стала официальной моделью. Главное для разработчиков сейчас: экспериментальный ID больше не нужен — в запросах следует указывать deepseek-flash. Модель получила нативную мультимодальность, то есть может обрабатывать текст и изображения в рамках одной архитектуры. 5
9
Во время короткого теста, проходившего примерно с 8 по 10 сентября, модель вызывалась так:
deepseek-v4.1-flash-expires-on-0910
Само имя содержало дату окончания работы и подчёркивало временный характер маршрута. У разработчиков не менялся базовый URL API: достаточно было заменить параметр модели. 7
20
После официального релиза 10 сентября актуальный идентификатор выглядит так:
deepseek-flash
Именно это имя DeepSeek указывает в документации API для V4.1 Flash с нативной мультимодальной поддержкой. 9
Главное изменение — не просто отдельный режим распознавания изображений. DeepSeek называет V4.1 Flash моделью новой архитектурной линейки с нативным визуальным пониманием. Иными словами, мультимодальная работа является частью самой модели.
Это отличает её от прежнего экспериментального маршрута deepseek-v4-flash-vision-exp, существовавшего рядом с V4 Flash. Для совместимости запросы к deepseek-v4-flash и deepseek-v4-flash-vision-exp временно направляются на V4.1 Flash. 5
Компания также раскрыла базовые параметры архитектуры: это Mixture-of-Experts-модель (MoE) на 552 млрд параметров с архитектурой Causal Encoder–Decoder. При обработке входа активны 8 млрд параметров, при генерации ответа — 16 млрд. 5
На практике для API это означает, что текст и изображения можно использовать через одну официальную модель, а не выбирать старый экспериментальный vision-вариант.
В период тестирования действовали следующие условия:
deepseek-v4.1-flash-expires-on-0910;base_url, авторизация и общий способ вызова API сохранялись;Такая конфигурация подходила для сравнения моделей, проверки интеграции и первых тестов работы с изображениями. Но временный идентификатор и ограничение конкурентности делали бету неподходящей основой для критичной production-инфраструктуры.
В первые дни тестировщики публиковали результаты порядка 300–500 выходных токенов в секунду; в одном из сообщений упоминалось значение выше 500 токенов в секунду. Это пользовательские наблюдения, а не официальный SLA, опубликованный DeepSeek, и не единый стандартизированный бенчмарк. 15
Фактическая производительность зависит, в частности, от длины входного запроса и ответа, региона, параллельной нагрузки, параметров модели и конкретной реализации клиента. Поэтому такие цифры можно рассматривать как ранний сигнал о высокой скорости в отдельных условиях, но не как гарантированную пропускную способность для генерации кода, прототипирования интерфейсов или других задач.
В первоначальном анонсе DeepSeek сообщала о плане с 14 сентября перенаправлять запросы к deepseek-v4-pro на V4.1 Flash по тарифам Flash — до выхода будущей V4.1 Pro. Компания также заявляла о превосходстве V4.1 Flash над флагманскими моделями в опубликованных ею сравнениях. 5
Однако более поздняя запись в журнале изменений API уточняет: DeepSeek решила сохранить API-сервис V4 Pro после 14 сентября, без изменения биллинга. Для текущих интеграций это более актуальная официальная информация. 9
Вывод для команд разработки прост: не стоит полагаться на старые сообщения о маршрутизации как на постоянное правило. Проверяйте changelog API, фиксируйте в тестах документированное имя модели и проводите регрессионные проверки перед сменой модели или использованием алиаса.
| Краткая бета 8–10 сентября | Официальная версия |
|---|---|
deepseek-v4.1-flash-expires-on-0910 |
deepseek-flash |
| Временный маршрут для оценки | Документированная модель API |
| Тарифы, сопоставимые с V4 Flash | Действуют условия релизной версии |
| До 20 одновременных запросов на аккаунт | Актуальные лимиты следует проверять в документации API |
История V4.1 Flash важна не из-за двухдневного тестового endpoint. Существеннее то, что DeepSeek выпустила Flash-модель с нативной мультимодальностью, постоянным API-именем и раскрытыми на высоком уровне сведениями об архитектуре. 5
9
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Бета DeepSeek V4.1 Flash стартовала 8 сентября 2026 года и была рассчитана примерно на два дня; 10 сентября модель официально вышла под API именем deepseek flash.
Бета DeepSeek V4.1 Flash стартовала 8 сентября 2026 года и была рассчитана примерно на два дня; 10 сентября модель официально вышла под API именем deepseek flash. Ключевое изменение — нативная мультимодальность: работа с изображениями встроена в архитектуру модели, а не вынесена в отдельный экспериментальный vision вариант.
В бете сохранялись прежний base url, тарифы уровня V4 Flash и лимит в 20 одновременных запросов на аккаунт.