DeepSeek melancarkan V4.1 Flash pada 10 September 2026 sebagai model multimodal natif dalam keluarga seni bina baharu syarikat itu. Permintaan API V4 Pro akan dialihkan secara automatik ke V4.1 Flash mulai 14 September, dan dicaj mengikut kadar Flash sehingga V4.1 Pro tersedia.
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Chinese AI startup DeepSeek announce with the launch of its V4.1 Flash model on September 11, 2026, including how the slimmed-down. Article summary: DeepSeek launched V4.1-Flash on September 10, not September 11. It positioned the smaller, open-weight model as a new-architecture successor that combines native visual understanding with lower-cost, faster inference—and. Topic tags: general, news, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermark
DeepSeek melancarkan DeepSeek-V4.1-Flash pada 10 September 2026, bukannya 11 September. Syarikat itu meletakkannya sebagai model multimodal natif yang lebih murah untuk digunakan melalui API, dan sebagai pengganti sementara kepada V4-Pro. Pelancaran ini penting bukan sekadar kerana model baharu, tetapi kerana pengguna API V4-Pro akan dipindahkan kepada V4.1-Flash secara automatik. 1
3
10
DeepSeek menyifatkan V4.1-Flash sebagai model paling kecil dalam keluarga seni bina baharunya. Menurut syarikat itu, seni bina ini direka untuk keupayaan yang lebih tinggi, inferens lebih pantas, daya pemprosesan lebih besar dan penskalaan kepada model yang lebih besar. Ia turut mempunyai kefahaman visual multimodal secara natif, iaitu imej dan teks diproses oleh model teras yang sama, bukan melalui komponen penglihatan berasingan. 10
16
Model ini boleh digunakan melalui API DeepSeek dengan nama deepseek-flash. Pada masa yang sama, DeepSeek menghentikan model generasi terdahulu, iaitu V4-Flash dan V4-Flash-Vision-Exp. 10
16
Menurut pengumuman DeepSeek dan laporan mengenai pelancaran itu, V4.1-Flash ialah model mixture-of-experts (MoE) dengan 552 bilion parameter serta reka bentuk causal encoder-decoder. Sebanyak 8 bilion parameter aktif digunakan ketika memproses input, manakala 16 bilion aktif bagi menjana output. Laporan juga menyatakan pemberat model dikeluarkan di bawah lesen MIT. 16
DeepSeek menyatakan reka bentuk baharu itu meningkatkan keupayaan, kelajuan inferens dan daya pemprosesan. Laporan pelancaran pula menggambarkan V4.1-Flash sebagai lebih baik daripada V4-Pro bagi tugasan pengekodan dan ejen AI, pada kos operasi yang lebih rendah. 1
Namun, ini masih merupakan tuntutan DeepSeek dan laporan berdasarkan pelancaran, bukan pengesahan daripada ujian bebas yang membuktikan V4.1-Flash sentiasa lebih pantas atau lebih baik daripada V4-Pro dan model pesaing bagi semua jenis kerja. Keputusan sebenar boleh berubah mengikut arahan yang diberikan, jenis tugasan, perkakasan, tahap penggunaan serentak dan konfigurasi penggunaan alat.
Bagi pembangun, kedudukan produk ini jelas: V4.1-Flash wajar diuji untuk aplikasi multimodal, aliran kerja pengekodan dan tugasan berasaskan ejen AI apabila kos inferens serta daya pemprosesan menjadi pertimbangan utama.
DeepSeek menurunkan harga Flash berkuat kuasa 10 September. Pada waktu luar puncak, kadar yang diterbitkan ialah:
Harga pada waktu puncak adalah dua kali ganda berbanding kadar luar puncak. 15
Syarikat itu juga sedang menyederhanakan barisan produknya. Mulai 04:00 UTC pada 14 September — bersamaan 12:00 tengah hari waktu Beijing — permintaan V4-Pro dijadualkan dialihkan secara automatik kepada V4.1-Flash. Permintaan tersebut akan dicaj mengikut kadar Flash sehingga V4.1-Pro dilancarkan. 3
Ini menjadikan pelancaran tersebut lebih besar daripada kemunculan model biasa. Pasukan yang masih menggunakan titik akhir V4-Pro perlu menjangka perubahan model walaupun mereka tidak menukar titik akhir API. Bagi penggunaan kritikal dalam persekitaran produksi, pembangun patut membandingkan output, kependaman dan tingkah laku panggilan alat sebelum bergantung sepenuhnya pada peralihan itu.
Kadar token rendah ini menonjolkan strategi DeepSeek: bersaing bukan hanya pada kemampuan model, tetapi juga pada kos penggunaan. Harga inferens yang lebih rendah boleh membantu pembangun menjalankan lebih banyak panggilan ejen, interaksi konteks panjang atau permintaan multimodal dengan perbelanjaan yang lebih terkawal.
Pada masa sama, harga agresif membawa dilema kepada penyedia AI. Ia mungkin meningkatkan penggunaan dan bahagian pasaran, tetapi turut menekan hasil bagi setiap token serta margin keuntungan. Bahan sumber yang diberikan tidak menyokong kesan harga saham semasa yang khusus ke atas syarikat seperti MiniMax, Z.AI atau Alibaba; oleh itu, dakwaan kesan pasaran langsung perlu dinilai dengan berhati-hati.
Pelancaran ini berlaku tidak lama selepas Reuters melaporkan bahawa DeepSeek telah mendapatkan CITIC Securities untuk membuat persediaan bagi kemungkinan tawaran awam permulaan domestik di STAR Market Shanghai, iaitu pasaran yang memberi tumpuan kepada syarikat teknologi. Sumber Reuters berkata syarikat itu menyasarkan untuk memulakan proses penyenaraian pada 2026, tetapi masa dan saiz tawaran masih belum jelas.
Model baharu yang menggabungkan pemberat terbuka, sokongan multimodal dan kos API rendah boleh mengukuhkan naratif produk DeepSeek menjelang kemungkinan penyenaraian. Namun, itu ialah inferens dan bukan alasan yang dinyatakan syarikat untuk pelancaran ini. Strategi harga rendah yang sama juga menimbulkan persoalan perniagaan utama: sama ada peningkatan permintaan mampu menampung hasil yang lebih rendah bagi setiap unit inferens.
Beberapa hari sebelum pelancaran V4.1-Flash, nasihat bersama kerajaan Amerika Syarikat mendakwa DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun dan Z.AI menjalankan pengekstrakan keupayaan model AI peneraju dari AS secara sistematik dan pada skala industri melalui penyulingan pengetahuan (knowledge distillation). Nasihat itu mendakwa berbilion token diekstrak menerusi jutaan permintaan daripada model termasuk Claude, GPT, Gemini dan Grok, kemungkinan dengan pengetahuan kerajaan China. 17
Ini ialah dakwaan kerajaan AS, bukannya dapatan mahkamah. China menolak tuduhan itu sebagai tidak berasas dan berhujah bahawa tindakan AS bertujuan mengekalkan monopoli industri AI. Pegawai China juga menekankan kepentingan berdikari dalam teknologi, sambil tidak menutup ruang dialog.
Pertembungan antara pelancaran model besar dari China dan pertikaian ini memperlihatkan dua kuasa yang membentuk pasaran AI: persaingan pantas dalam teknologi serta harga di satu pihak, dan penelitian yang semakin ketat terhadap akses model, data latihan serta aliran teknologi rentas sempadan di pihak lain.
V4.1-Flash ialah usaha DeepSeek menjadikan model yang lebih kecil dalam keluarga seni bina baharunya sebagai pilihan lalai bagi lebih ramai pengguna API. Sokongan multimodal natif, pemberat terbuka, tuntutan kecekapan dan jadual harga kos rendah merupakan teras penawarannya. 10
15
16
Bagi pengguna V4-Pro, perubahan paling nyata ialah migrasi automatik yang dijadualkan pada 14 September. Sementara itu, dakwaan kepimpinan prestasi model masih memerlukan penilaian bebas, manakala strategi harga DeepSeek dan pertikaian dasar AS-China akan menentukan sejauh mana besar kesan pelancaran ini. 3
17
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeek melancarkan V4.1 Flash pada 10 September 2026 sebagai model multimodal natif dalam keluarga seni bina baharu syarikat itu.
DeepSeek melancarkan V4.1 Flash pada 10 September 2026 sebagai model multimodal natif dalam keluarga seni bina baharu syarikat itu. Permintaan API V4 Pro akan dialihkan secara automatik ke V4.1 Flash mulai 14 September, dan dicaj mengikut kadar Flash sehingga V4.1 Pro tersedia.
DeepSeek mendakwa model baharu ini lebih pantas dan cekap, tetapi perbandingan prestasinya dengan V4 Pro serta pesaing masih belum disahkan secara bebas.