DeepSeek V4.1 Flash dilancarkan pada 10 September 2026 sebagai model Flash semasa DeepSeek dengan sokongan multimodal asli. V4 Flash dan V4 Flash Vision Exp telah ditamatkan; ID lama masih diterima buat sementara waktu tetapi dilayan oleh V4.1 Flash pada kadar Flash.
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What are DeepSeek V4.1 Flash’s launch date, global OpenRouter adoption, relationship to the earlier V4 Flash, V4 Flash Vision, and V4 Pro of. Article summary: DeepSeek-V4.1-Flash launched on September 10, 2026. It is an open-weight, multimodal successor to the V4 Flash line that prioritizes long-context and inference efficiency; however, several claims about its market adoptio. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
DeepSeek-V4.1-Flash ialah model terbuka berwajaran (open-weight) dan multimodal yang dilancarkan pada 10 September 2026. Tarikan utamanya bukan sekadar saiz: DeepSeek menggabungkan sistem mixture-of-experts (MoE) 552 bilion parameter, pengaktifan jarang (sparse activation) dan cache KV yang jauh lebih kecil untuk menjadikan inferens dengan konteks amat panjang lebih praktikal. 17
35
Bagi pembangun yang menggunakan API DeepSeek, V4.1 Flash ialah penawaran Flash semasa dan dipanggil menggunakan nama model deepseek-flash. Tidak seperti V4 Flash asal, ia menyokong kefahaman visual multimodal secara asli di samping input teks. 15
17
Model lama V4 Flash dan V4 Flash Vision Exp telah ditamatkan. DeepSeek menyatakan pengecam lama deepseek-v4-flash dan deepseek-v4-flash-vision-exp masih diterima untuk sementara waktu, tetapi permintaan tersebut sebenarnya akan dilayan oleh V4.1 Flash dan dicaj pada kadar Flash. 15
23
V4 Pro pula tidak sama statusnya. Laporan awal mengenai peralihan menyatakan trafiknya akan dialihkan kepada V4.1 Flash sementara menunggu V4.1 Pro. Namun, log perubahan API rasmi DeepSeek yang lebih baharu menyebut bahawa perkhidmatan API V4 Pro akan diteruskan selepas 14 September 2026 atas permintaan pengguna, dengan kaedah pengebilan tidak berubah. 15
23
Maksudnya, pasukan yang memerlukan hasil yang boleh diulang secara konsisten tidak patut menganggap laluan model lama sentiasa menuju ke V4.1 Flash. Gunakan ID model yang didokumenkan ketika ini dan jalankan ujian regresi sebelum berhijrah.
V4.1 Flash ialah model Mixture-of-Experts (MoE) dengan 552 bilion parameter asas. Dalam seni bina MoE, model hanya memilih sebahagian pakar atau parameter untuk memproses sesuatu token, bukannya mengaktifkan keseluruhan model pada setiap langkah.
DeepSeek melaporkan bahawa V4.1 Flash mengaktifkan 8B parameter semasa pemprosesan input (prefill) dan 16B parameter ketika menjana output (decoding). Ia menggunakan seni bina yang dinamakan Causal Encoder–Decoder. Perbezaan antara dua fasa ini penting kerana kos bagi membaca arahan atau dokumen panjang tidak sama dengan kos menghasilkan jawapan panjang. 17
35
Pengaktifan jarang tidak menjamin model akan sentiasa murah atau pantas dalam setiap keadaan. Kelajuan sebenar turut bergantung pada perkakasan, pengelompokan permintaan (batching), kuantisasi, perisian penyajian, panjang konteks dan corak trafik. Namun, ia ialah asas kepada sasaran kecekapan V4.1 Flash.
V4.1 Flash menyokong konteks sehingga satu juta token. 35
Cabaran besar bagi konteks panjang ialah cache key-value (KV), iaitu keadaan perhatian yang disimpan oleh model ketika menjana token seterusnya. Semakin panjang dokumen dan respons, semakin besar tekanan terhadap memori pelayan.
Menurut kad model DeepSeek, reka bentuk Causal Encoder–Decoder memproyeksikan cache KV global penyahkod daripada keadaan tersembunyi akhir pengekod, dan bukannya membinanya secara berasingan daripada setiap lapisan penyahkod. Keluaran ini turut menggabungkan Compressed Sparse Attention 2 dengan cache KV FP4. Hasil gabungan tersebut, DeepSeek melaporkan jejak cache KV global sekitar 890 bait bagi setiap token—kira-kira satu perempat daripada jejak sepadan pada DeepSeek V4 Flash. 35
39
Ini tidak bermaksud setiap tugasan dengan satu juta token akan menjadi murah atau tepat. Kapasiti konteks bukan jaminan bahawa model boleh mencari maklumat, menaakul atau mengikuti arahan dengan andal merentas keseluruhan input. Pasukan yang bekerja dengan pangkalan kod besar, koleksi dokumen atau sejarah ejen AI perlu menguji kadar ingatan semula, kependaman dan kos menggunakan beban kerja sebenar mereka.
DeepSeek menerbitkan wajaran V4.1 Flash di Hugging Face di bawah lesen MIT. Kad model itu menerangkan keluaran tersebut sebagai wajaran terbuka, membolehkan organisasi memuat turun dan menggunakan model tertakluk pada syarat lesen berkenaan. 35
Ini memberi pilihan yang berbeza daripada model API sahaja: organisasi boleh menilai model pada infrastruktur sendiri serta mengawal susunan penyajian mereka. Namun, hos sendiri masih rumit—terutama bagi model dengan asas 552B parameter—walaupun tidak semua parameter diaktifkan pada setiap token.
DeepSeek menyatakan kaedah pralatihan baharu dan pascalatihan pembelajaran pengukuhan pada skala lebih besar menghasilkan keputusan penanda aras yang mengatasi model perdana, termasuk V4 Pro. Syarikat itu juga merujuk ujian oleh beberapa pihak yang dikatakan meletakkan V4.1 Flash di hadapan V4 Pro dari segi prestasi, kos, kelajuan dan jumlah masa pelaksanaan. 17
Itu ialah dakwaan yang penting, tetapi bukan keputusan muktamad untuk semua kegunaan. Keputusan penanda aras boleh berubah mengikut pemilihan tugasan, reka bentuk arahan, konfigurasi alat, kaedah pemarkahan dan versi model yang diuji. Sebelum memindahkan aliran kerja produksi, bandingkan kedua-dua model pada metrik yang benar-benar penting: penaakulan sukar, kadar penerimaan kod, penggunaan alat, ketepatan multimodal, kebolehpercayaan, kawalan keselamatan, kependaman dan kos keseluruhan.
V4.1 Flash memasuki pasaran ketika DeepSeek dan penyedia model China lain sudah mempunyai penggunaan besar melalui platform penghalaan. OpenRouter menyusun kedudukan model berdasarkan token arahan dan token pelengkapan yang diproses menerusi API platform itu sendiri.
Dalam kedudukan 13 September, OpenRouter menyenaraikan DeepSeek V4.1 Flash pada 4.94T token, dengan tanda model baharu. Dalam senarai sama, DeepSeek V4 Flash 0731 mencatat 11.6T token, V4 Flash 0423 sebanyak 4.36T token, manakala Xiaomi MiMo-V2.5 pada 7.77T token. 57
Data terdahulu juga menunjukkan kedudukan penggunaan boleh berubah pantas: satu gambaran pada Ogos meletakkan V4 Flash pada 7.1T token mingguan dan melaporkan sembilan daripada 10 model paling banyak digunakan dalam kedudukan itu ialah model dari China. 50
Perlu ditekankan skopnya: kiraan token OpenRouter mewakili trafik yang melalui OpenRouter sahaja, bukan penggunaan AI di seluruh dunia, penerimaan perusahaan, hasil pendapatan atau kualiti mutlak model. Ia berguna sebagai petunjuk permintaan dalam kalangan pembangun di platform itu, tetapi bukan bukti bahawa sesuatu model sudah memenangi pasaran AI secara menyeluruh.
Sebab paling kukuh untuk menilai V4.1 Flash ialah gabungan multimodal asli, konteks satu juta token, wajaran terbuka dan seni bina yang direka untuk mengurangkan kos memori inferens jangka panjang. 17
35
Laluan migrasi yang munasabah ialah:
deepseek-flash untuk integrasi Flash baharu.Dakwaan teknikal V4.1 Flash memang besar, khususnya angka 890 bait bagi cache KV global dan reka bentuk pengaktifan jarang. Nilai sebenar model ini akhirnya bergantung pada sama ada kelebihan tersebut menghasilkan prestasi yang andal dan mampu dibiayai untuk beban kerja yang benar-benar dijalankan oleh pembangun.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeek V4.1 Flash dilancarkan pada 10 September 2026 sebagai model Flash semasa DeepSeek dengan sokongan multimodal asli.
DeepSeek V4.1 Flash dilancarkan pada 10 September 2026 sebagai model Flash semasa DeepSeek dengan sokongan multimodal asli. V4 Flash dan V4 Flash Vision Exp telah ditamatkan; ID lama masih diterima buat sementara waktu tetapi dilayan oleh V4.1 Flash pada kadar Flash.
OpenRouter menyenaraikan V4.1 Flash dengan 4.94 trilion token diproses pada 13 September, namun angka itu hanya mencerminkan trafik melalui OpenRouter.