DeepSeek merilis V4.1 Flash pada 10 September 2026 sebagai model terkecil dalam keluarga arsitektur barunya, dengan pemahaman visual multimodal bawaan. Mulai 14 September pukul 04.00 UTC atau 12.00 waktu Beijing, permintaan ke V4 Pro akan dialihkan otomatis ke V4.1 Flash dan ditagih dengan tarif Flash sampai V4.1 Pr...
Diterbitkan olehDiedit dengan GPT-5.6 TerraGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What did Chinese AI startup DeepSeek announce with the launch of its V4.1 Flash model on September 11, 2026, including how the slimmed-down. Article summary: DeepSeek launched V4.1-Flash on September 10, not September 11. It positioned the smaller, open-weight model as a new-architecture successor that combines native visual understanding with lower-cost, faster inference—and. Topic tags: general, news, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermark
DeepSeek resmi merilis DeepSeek-V4.1-Flash pada 10 September 2026, bukan 11 September. Bagi pengguna API, perubahan terbesarnya bukan sekadar model baru: trafik V4-Pro akan dialihkan otomatis ke V4.1-Flash mulai 14 September dan dikenai harga Flash hingga V4.1-Pro dirilis. 1
3
10
DeepSeek menyebut V4.1-Flash sebagai model terkecil dalam keluarga arsitektur barunya. Model ini memiliki pemahaman visual bawaan (native multimodal visual understanding), sehingga input gambar dan teks ditangani langsung oleh model inti, bukan melalui tambahan modul visi terpisah. 10
16
Menurut DeepSeek, arsitektur tersebut ditujukan untuk meningkatkan batas kemampuan model, mempercepat inferensi, menaikkan throughput, serta dapat diskalakan ke model yang lebih besar. Modelnya kini tersedia lewat API DeepSeek dengan nama deepseek-flash. Sementara itu, model generasi sebelumnya, V4-Flash dan V4-Flash-Vision-Exp, telah dipensiunkan. 10
16
Materi peluncuran menyebut V4.1-Flash sebagai model mixture-of-experts (MoE) berisi 552 miliar parameter dengan desain causal encoder-decoder. Dari jumlah itu, 8 miliar parameter aktif saat memproses input dan 16 miliar parameter aktif saat menghasilkan output. Bobot model dilaporkan dirilis dengan lisensi MIT. 16
Pelaporan seputar peluncuran menyebut DeepSeek mengklaim V4.1-Flash unggul atas V4-Pro untuk tugas pemrograman dan agen AI, dengan biaya operasional lebih rendah. 1
Namun, ini tetap perlu dibaca sebagai klaim dari pihak DeepSeek, bukan kesimpulan dari pengujian independen yang menyeluruh. Hasil di lingkungan produksi dapat berbeda bergantung pada jenis tugas, rancangan prompt, perangkat keras, tingkat permintaan bersamaan, dan penggunaan alat eksternal oleh agen AI.
Bagi pengembang, V4.1-Flash layak diuji terutama untuk aplikasi multimodal, alur kerja coding, dan sistem agen yang membutuhkan kombinasi kualitas keluaran, throughput, serta biaya inferensi yang rendah.
DeepSeek mengubah harga seri Flash efektif 10 September. Pada periode luar jam sibuk, tarif yang dipublikasikan adalah:
Pada jam sibuk, harga menjadi dua kali lipat dari tarif luar jam sibuk. 15
Perubahan yang paling perlu diperhatikan pengguna V4-Pro terjadi pada 14 September pukul 04.00 UTC, atau 12.00 waktu Beijing. Sejak waktu tersebut, permintaan ke V4-Pro dijadwalkan dirutekan otomatis ke V4.1-Flash. Permintaan itu akan ditagih menggunakan tarif Flash sampai DeepSeek merilis V4.1-Pro. 3
Artinya, tim yang masih mengandalkan endpoint V4-Pro tidak cukup hanya mempertahankan integrasi lama. Untuk penggunaan penting di produksi, sebaiknya mereka membandingkan kualitas jawaban, latensi, dan perilaku pemanggilan alat sebelum pengalihan tersebut menjadi bagian dari operasi harian.
Tarif token yang sangat rendah menunjukkan strategi DeepSeek untuk bersaing bukan hanya lewat kemampuan model, tetapi juga biaya penggunaan. Harga inferensi yang lebih murah berpotensi membantu pengembang menjalankan lebih banyak panggilan agen AI, percakapan berkonteks panjang, maupun permintaan multimodal.
Di sisi lain, harga agresif menciptakan dilema bisnis bagi penyedia AI. Tarif rendah dapat menarik penggunaan dan pangsa pasar, tetapi juga menekan pendapatan per token serta margin. Materi yang tersedia tidak cukup untuk membuktikan dampak harga saham secara langsung dan terkini terhadap perusahaan seperti MiniMax, Z.AI, atau Alibaba. Karena itu, klaim soal efek pasar spesifik perlu disikapi hati-hati.
Peluncuran V4.1-Flash datang setelah Reuters melaporkan DeepSeek telah menunjuk CITIC Securities untuk mempersiapkan kemungkinan penawaran umum perdana atau IPO domestik di STAR Market Shanghai, papan bursa yang berfokus pada perusahaan teknologi. Menurut sumber Reuters, perusahaan itu menargetkan mulai menjalankan proses pencatatan pada 2026, meski jadwal dan nilai penawaran belum jelas.
Kombinasi bobot terbuka, dukungan multimodal, dan biaya API rendah dapat memperkuat narasi produk DeepSeek menjelang kemungkinan IPO. Namun, itu adalah analisis, bukan alasan peluncuran yang dinyatakan oleh perusahaan. Strategi harga murah tersebut juga memunculkan pertanyaan bisnis penting: apakah peningkatan permintaan akan cukup untuk menutup pendapatan yang lebih rendah per unit inferensi.
Beberapa hari sebelum V4.1-Flash dirilis, sebuah peringatan bersama pemerintah Amerika Serikat menuduh DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun, dan Z.AI melakukan ekstraksi kemampuan dari model AI terdepan AS secara sistematis melalui kampanye knowledge distillation dalam skala industri. Peringatan itu menuduh miliaran token diekstraksi lewat jutaan permintaan dari model seperti Claude, GPT, Gemini, dan Grok, kemungkinan dengan sepengetahuan pemerintah China. 17
Tuduhan tersebut merupakan klaim pemerintah AS, bukan putusan pengadilan. China menolak tuduhan itu sebagai tidak berdasar dan menilai langkah AS bertujuan mempertahankan monopoli industri AI. Pejabat China juga menekankan kemandirian teknologi, sambil tetap membuka kemungkinan dialog.
Pertemuan antara peluncuran model baru besar dari China dan perselisihan ini menyoroti dua kekuatan yang kini membentuk pasar AI: persaingan teknologi serta harga yang makin cepat, dan pengawasan yang makin ketat atas akses model, data pelatihan, dan arus teknologi lintas negara.
V4.1-Flash adalah upaya DeepSeek menjadikan model yang lebih kecil dalam keluarga arsitektur barunya sebagai pilihan utama bagi lebih banyak pengguna API. Penawaran utamanya mencakup multimodal bawaan, bobot terbuka, klaim efisiensi, dan tarif API rendah. 10
15
16
Perubahan paling nyata dalam waktu dekat adalah pengalihan V4-Pro pada 14 September. Sementara itu, klaim kepemimpinan performa V4.1-Flash tetap memerlukan evaluasi independen, sedangkan strategi harga dan meningkatnya ketegangan kebijakan AS–China akan memengaruhi seberapa besar dampak peluncuran ini bagi industri. 3
17
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
DeepSeek merilis V4.1 Flash pada 10 September 2026 sebagai model terkecil dalam keluarga arsitektur barunya, dengan pemahaman visual multimodal bawaan.
DeepSeek merilis V4.1 Flash pada 10 September 2026 sebagai model terkecil dalam keluarga arsitektur barunya, dengan pemahaman visual multimodal bawaan. Mulai 14 September pukul 04.00 UTC atau 12.00 waktu Beijing, permintaan ke V4 Pro akan dialihkan otomatis ke V4.1 Flash dan ditagih dengan tarif Flash sampai V4.1 Pro hadir.
Tarif luar jam sibuk ditetapkan sebesar US$0,003 untuk satu juta token input cache hit, US$0,15 untuk input tanpa cache, dan US$0,60 untuk output; tarif jam sibuk dua kali lipat.