| Jenis Token | Harga Semasa | Luar Puncak Baru | Puncak Baru |
|---|---|---|---|
| Input (cache miss) | $0.435 | ~$0.44–$0.49 (ang.) | ~$0.87–$0.98 (ang.) |
| Output | $0.87 | $1.98 | $3.96 |
| Jenis Token | Harga Semasa | Luar Puncak Baru | Puncak Baru |
|---|---|---|---|
| Input (cache miss) | $0.14 | ~$0.21 (ang.) | ~$0.42 (ang.) |
| Output | $0.28 | $0.63 | $1.26 |
(Harga input cache-miss untuk tier baru dianggarkan daripada pengganda output yang disahkan. Lonjakan output disahkan oleh pelbagai sumber .)
Token input yang dicache kekal jauh lebih murah. Untuk V4-Pro, input cache-hit kekal pada kira-kira $0.004 setiap 1M token, diskaun 100x yang mendorong pembangun untuk mengoptimumkan strategi caching mereka .
Kedua-dua model V4 adalah teks sahaja, seni bina Mixture-of-Experts (MoE) yang dikeluarkan di bawah lesen MIT, menjadikannya berat terbuka sepenuhnya dan boleh dihos sendiri .
| Spesifikasi | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| Jumlah parameter | 1.6 trilion | 284 bilion |
| Parameter aktif setiap token | ~49 bilion | ~13 bilion |
| Tetingkap konteks | 1,000,000 token | 1,000,000 token |
| Maksimum output | 384,000 token | 384,000 token |
| Lesen | MIT | MIT |
Kedua-dua model menyokong tiga mod penaakulan: Non-think (pantas, intuitif), Think High (analisis logik dengan rantaian pemikiran), dan Think Max (penaakulan mendalam) .
Harga baru membentuk semula kedudukan kompetitif DeepSeek. Perbandingan di bawah menggunakan kadar API konteks pendek standard setiap 1M token untuk semua penyedia.
| Model | Input (setiap 1M) | Output (setiap 1M) |
|---|---|---|
| DeepSeek V4-Pro (puncak) | ~$0.87–$0.98 | $3.96 |
| DeepSeek V4-Flash (puncak) | ~$0.42 | $1.26 |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 |
| Anthropic Claude Fable 5 | $10.00 | $50.00 |
OpenAI memotong harga GPT-5.6 Luna sebanyak 80% pada 30 Julai 2026, kepada $0.20 input dan $1.20 output setiap 1M token . Gambaran persaingan berubah secara dramatik:
Di mana DeepSeek dahulunya pilihan bajet yang jelas, kini ia berdepan peneraju harga dalam tier paling mampu milik OpenAI .
Model penaakulan utama Anthropic berharga $10 input dan $50 output setiap 1M token . Pada tahap itu, DeepSeek masih menjadi pilihan nilai:
Walaupun pada kadar baru yang lebih tinggi, kedua-dua model DeepSeek kekal jauh lebih mampu milik berbanding tier teratas Anthropic .
Harga xAI Grok 4.6 tidak tersedia daripada sumber yang disediakan, jadi perbandingan langsung tidak dapat dibuat.
DeepSeek menyebut permintaan yang melonjak menekan kapasiti inferens sebagai sebab utama kenaikan . Model V4 mendapat penerimaan yang besar selepas pelancaran pratonton pada April 2026, mewujudkan kekangan kapasiti GPU yang tidak dapat ditampung oleh syarikat pada kadar ultra-rendah sebelumnya
.
Beberapa kuasa pasaran bertumpu:
Kenaikan harga DeepSeek menandakan berakhirnya era sebagai penyedia API AI termurah. Syarikat kini lebih dekat dengan model termurah OpenAI pada beberapa dimensi sambil masih mengalahkan tier premium Anthropic dengan margin yang besar. Bagi pembangun, gabungan harga puncak/luar puncak, diskaun caching yang dalam, dan berat terbuka lesen MIT bermakna seni bina beban kerja — bukannya pilihan model mentah — akan semakin menentukan bil API akhir.