Pada 13 Agustus 2026, DeepSeek mengumumkan kenaikan harga API sebesar 50%–1.100% untuk model V4 Pro dan V4 Flash, dengan sistem tagihan peak/off peak baru yang berlaku mulai pukul 16:00 UTC pada 16 Agustus 2026 [17][19]. Kedua model V4 memiliki jendela konteks 1 juta token, lisensi MIT, dan maksimal 384 ribu token o...
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What new API pricing did DeepSeek announce for its V4 models, when does it take effect, and what are the key details about the models' conte. Article summary: On August 13, 2026, DeepSeek announced major API price increases for its V4-Pro and V4-Flash models, with new peak/off-peak billing tiers taking effect at **16:00 UTC on August 16, 2026** [1][4]. The increases range from. Topic tags: general, academic, documentation, general web, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
Pada 13 Agustus 2026, DeepSeek mengumumkan kenaikan harga API besar-besaran untuk model V4-Pro dan V4-Flash, dengan memperkenalkan sistem tarif peak/off-peak (jam sibuk / sepi) yang mulai berlaku pada pukul 16:00 UTC, 16 Agustus 2026 . Kenaikan harga berkisar antara 50% hingga 1.100% dari tarif saat ini, tergantung pada model, jenis token, dan waktu penggunaan
. Langkah ini menandai perubahan signifikan bagi perusahaan yang selama ini dikenal dengan harga API yang sangat agresif dan murah.
DeepSeek menjadi penyedia API AI besar pertama yang menerapkan harga lonjakan berdasarkan waktu (time-of-day surge pricing), mengadopsi model tagihan listrik peak/off-peak . Tarif off-peak ditetapkan sebesar 50% dari tarif peak, artinya biaya panggilan API di jam sibuk menjadi dua kali lipat
. Jam sibuk (dalam UTC) dilaporkan pada pukul 01:00–04:00 dan 06:00–10:00
.
| Tipe Token | Harga Saat Ini | Off-Peak Baru | Peak Baru |
|---|---|---|---|
| Input (cache miss) | $0,435 | ~$0,44–$0,49 (est.) | ~$0,87–$0,98 (est.) |
| Output | $0,87 | $1,98 | $3,96 |
| Tipe Token | Harga Saat Ini | Off-Peak Baru | Peak Baru |
|---|---|---|---|
| Input (cache miss) | $0,14 | ~$0,21 (est.) | ~$0,42 (est.) |
| Output | $0,28 | $0,63 | $1,26 |
(Harga input cache-miss untuk tier baru diperkirakan dari pengganda output yang dikonfirmasi. Lonjakan output dikonfirmasi oleh berbagai sumber .)
Token input yang di-cache (cache hit) tetap jauh lebih murah. Untuk V4-Pro, input cache-hit masih sekitar $0,004 per 1 juta token, diskon 100x yang dirancang untuk mendorong developer mengoptimalkan strategi caching mereka .
Kedua model V4 adalah model teks-saja dengan arsitektur Mixture-of-Experts (MoE) yang dirilis di bawah lisensi MIT, sehingga sepenuhnya open-weight dan bisa dihosting sendiri (self-host) .
| Spesifikasi | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| Total parameter | 1,6 triliun | 284 miliar |
| Parameter aktif per token | ~49 miliar | ~13 miliar |
| Jendela konteks | 1.000.000 token | 1.000.000 token |
| Panjang output maksimal | 384.000 token | 384.000 token |
| Lisensi | MIT | MIT |
Kedua model mendukung tiga mode penalaran: Non-think (cepat, intuitif), Think High (analisis logis dengan rantai pemikiran), dan Think Max (penalaran mendalam) .
Harga baru ini mengubah posisi kompetitif DeepSeek secara drastis. Perbandingan di bawah ini menggunakan tarif API standar konteks pendek per 1 juta token untuk semua penyedia.
| Model | Input (per 1M) | Output (per 1M) |
|---|---|---|
| DeepSeek V4-Pro (peak) | ~$0,87–$0,98 | $3,96 |
| DeepSeek V4-Flash (peak) | ~$0,42 | $1,26 |
| OpenAI GPT-5.6 Luna | $0,20 | $1,20 |
| Anthropic Claude Fable 5 | $10,00 | $50,00 |
(Sumber: DeepSeek , OpenAI
, Anthropic
)
OpenAI memotong harga GPT-5.6 Luna sebesar 80% pada 30 Juli 2026, menjadi $0,20 untuk input dan $1,20 untuk output per 1 juta token . Peta persaingan pun berbalik drastis:
Jika dulu DeepSeek adalah pilihan termurah, kini mereka harus bersaing dengan pemimpin harga di tier termurah OpenAI .
Model andalan Anthropic dibanderol $10 untuk input dan $50 untuk output per 1 juta token . Di level harga tersebut, DeepSeek masih menjadi pilihan yang jauh lebih terjangkau:
Meskipun harga naik, kedua model DeepSeek tetap jauh lebih murah dibandingkan penawaran tier atas Anthropic .
Harga xAI Grok 4.6 tidak tersedia dari sumber yang diberikan, sehingga perbandingan langsung tidak dapat dilakukan.
DeepSeek menyebut lonjakan permintaan yang membebani kapasitas inferensi sebagai alasan utama kenaikan harga . Model V4 mendapatkan adopsi massal setelah peluncuran pratinjau pada April 2026, menciptakan hambatan kapasitas GPU yang tidak bisa lagi ditanggung perusahaan dengan harga ultra-rendah sebelumnya
.
Beberapa kekuatan pasar yang bertemu:
Kenaikan harga DeepSeek menandai berakhirnya era mereka sebagai penyedia API frontier yang sangat murah. Perusahaan kini mendekati posisi setara dengan model termurah OpenAI di beberapa dimensi, sambil masih jauh di bawah harga tier premium Anthropic. Bagi developer, kombinasi harga peak/off-peak, diskon caching besar-besaran, dan bobot open-weight berlisensi MIT berarti bahwa arsitektur beban kerja—bukan sekadar pilihan model mentah—akan semakin menentukan tagihan API akhir.
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Pada 13 Agustus 2026, DeepSeek mengumumkan kenaikan harga API sebesar 50%–1.100% untuk model V4 Pro dan V4 Flash, dengan sistem tagihan peak/off peak baru yang berlaku mulai pukul 16:00 UTC pada 16 Agustus 2026 [17][19].
Pada 13 Agustus 2026, DeepSeek mengumumkan kenaikan harga API sebesar 50%–1.100% untuk model V4 Pro dan V4 Flash, dengan sistem tagihan peak/off peak baru yang berlaku mulai pukul 16:00 UTC pada 16 Agustus 2026 [17][19]. Kedua model V4 memiliki jendela konteks 1 juta token, lisensi MIT, dan maksimal 384 ribu token output.
DeepSeek beralasan kenaikan ini karena lonjakan permintaan yang membebani kapasitas infrastruktur GPU, dan menjadi penyedia API AI besar pertama yang menerapkan harga lonjakan berbasis waktu [1][22].