DeepSeek, V4 Flash ve V4 Pro için 17 Ağustos 2026'da saat bazlı fiyatlandırmaya geçti; yoğun olmayan saatlerdeki ücretler, yoğun saatlerin tam yarısı. Pekin saatiyle 09.00–12.00 ve 14.00–18.00 arasındaki yoğun dönemlerde çıktı tokenlarının ücreti V4 Flash'te milyon token başına 9 yuan, V4 Pro'da 27 yuan'a kadar çıkı...
Research answer

Create a landscape editorial hero image for this Studio Global article: What changed when DeepSeek’s new API pricing for DeepSeek-V4-Flash and DeepSeek-V4-Pro took effect at midnight on August 17, 2026—including. Article summary: At 00:00 Beijing time on August 17 (16:00 UTC on August 16), DeepSeek replaced flat V4 API pricing with time-of-use pricing: off-peak rates are exactly half peak rates. Peak is 09:00–12:00 and 14:00–18:00 Beijing time da. Topic tags: general, news, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, waterm
DeepSeek, V4 API'sindeki sabit fiyatlandırma modelini 17 Ağustos 2026'da Pekin saatiyle 00.00'da değiştirdi. Yeni düzende DeepSeek-V4-Flash ve DeepSeek-V4-Pro için ücret, isteğin platforma ulaştığı saate göre belirleniyor. Yoğun olmayan saatlerin tarifesi, yoğun saatlerin tam yarısı. Değişiklik 16 Ağustos'ta 16.00 UTC'de yürürlüğe girdi. 1
2
Türkiye saatiyle yoğun dönemler 04.00–07.00 ve 09.00–13.00 aralıklarına denk geliyor. Bir isteğin hangi tarifeden ücretlendirileceğini, işlemin tamamlanma süresi değil, sunucunun isteği aldığı an belirliyor. 2
7
Pekin saatiyle günlük yoğun saatler şöyle:
Günün geri kalanında yoğun olmayan tarife uygulanıyor. Aynı model çağrısı, yalnızca gönderildiği saate bağlı olarak iki kat farklı ücretlendirilmiş oluyor. Bu nedenle yeni sistem, basit bir fiyat artışından çok, işlem kapasitesinin zamana göre fiyatlandırılması anlamına geliyor.
Aşağıdaki tutarlar milyon token başına Çin yuanı cinsindendir. Önbellek isabeti, daha önce saklanan bir istem ön ekinin yeniden kullanılabildiği durumu; önbellek isabetsizliği ise girdinin daha yüksek standart ücretle yeniden işlendiği durumu ifade eder.
| Model ve token türü | Önceki sabit ücret | Yoğun olmayan saat | Önceki ücrete göre değişim | Yoğun saat | Önceki ücrete göre değişim |
|---|---|---|---|---|---|
| V4-Flash, önbellek isabetli giriş | ¥0,02 | ¥0,05 | +%150 | ¥0,10 | +%400 |
| V4-Flash, önbellek isabetsiz giriş | ¥1,00 | ¥1,50 | +%50 | ¥3,00 | +%200 |
| V4-Flash, çıktı | ¥2,00 | ¥4,50 | +%125 | ¥9,00 | +%350 |
| V4-Pro, önbellek isabetli giriş | ¥0,025 | ¥0,15 | +%500 | ¥0,30 | +%1.100 |
| V4-Pro, önbellek isabetsiz giriş | ¥3,00 | ¥4,50 | +%50 | ¥9,00 | +%200 |
| V4-Pro, çıktı | ¥6,00 | ¥13,50 | +%125 | ¥27,00 | +%350 |
V4-Flash için belgelenen tarife, yoğun olmayan saatlerde önbellek isabetli girişte ¥0,05, önbellek isabetsiz girişte ¥1,50 ve çıktıda ¥4,50; yoğun saatlerde ise sırasıyla ¥0,10, ¥3 ve ¥9 olarak veriliyor. 2 Genel V4 fiyat değişikliğinde artış oranlarının model, token türü ve kullanım saatine bağlı olarak %50 ile %1.100 arasında değiştiği bildirildi.
1
8
Değerlendirme çalıştırmaları, belge indeksleme, geçmiş verilerin yeniden işlenmesi, sentetik veri üretimi ve acil olmayan ajan görevleri yoğun saatlerin dışına alınabilir. Yoğun olmayan tarifenin yoğun saat ücretinin yarısı olması, zaman açısından esnek işlerde planlama yoluyla kayda değer tasarruf sağlayabilir. 2
Bu gelişmeyle birlikte saat dilimi, yapay zekâ altyapısında yeni bir işletim değişkenine dönüşüyor. İş kuyruğu, hem son teslim tarihini hem de Pekin saatine göre faturalandırma penceresini dikkate alarak işi model değişikliği yapmadan erteleyebilir.
Müşteri destek sistemleri, kodlama asistanları ve gerçek zamanlı ajanlar genellikle kullanıcıların aktif olduğu saatlerde çalışır. Bu uygulamalar yoğun saat ücretlerini doğrudan karşılamak zorunda kalabilir. Yine de istemlerin tekrar kullanılması, önbellek dostu istek tasarımı, daha kısa yanıtlar ve uygun model yönlendirmesi maliyeti düşürebilir.
Önbellekleme burada özellikle önemli. Her iki modelde de önbellek isabetli giriş, önbellek isabetsiz girişten çok daha ucuz kalıyor. Aynı talimatları, araç tanımlarını veya belge bağlamını tekrar tekrar gönderen yüksek hacimli sistemlerde, önbellek isabet oranını artırmak küçük bir trafik azaltımından daha etkili olabilir.
Uzun akıl yürütme izleri, kapsamlı raporlar ve büyük kod yanıtları çıktı tokenı tüketir. Yoğun saatlerde bir milyon çıktı tokenı V4-Flash için ¥9, V4-Pro için ¥27 tutuyor. Geliştiriciler çıktı sınırlarını daraltabilir, rutin isteklerde Flash kullanabilir ve Pro'yu ek kapasitesinin maliyeti haklı çıkardığı görevlere ayırabilir. 1
2
V4-Pro'nun yoğun saatlerdeki önbellek isabetli giriş ücreti, önceki sabit fiyatın 12 katına çıktı. Mutlak tutar, önbellek isabetsiz giriş ve çıktı ücretlerine kıyasla hâlâ düşük olsa da, çok büyük hacimlerde tekrarlanan ve önbellekten yararlanan istemleri işleyen uygulamalar için artış önem taşıyor. 1
19
Fiyat değişikliği, DeepSeek-V4-Pro-0813 sürümünün ağustos ayında deepseek-v4-pro uç noktası üzerinden genel kullanıma açılmasının ardından geldi. Bildirilen teknik özelliklere göre bu, bir milyon tokenlık bağlam penceresine ve en fazla 384.000 tokenlık çıktıya sahip bir metin modeli. Mixture-of-Experts (MoE) mimarisi yaklaşık 1,6 trilyon toplam parametre ve token başına 49 milyar etkin parametre içeriyor. 29
33
DeepSeek'in hesap düzeyindeki eşzamanlılık sınırları da iki model arasında ayrım yapıyor:
Bir istek, akışlı yanıtlar da dahil olmak üzere işlem tamamlanana kadar bir eşzamanlılık yuvasını meşgul ediyor. 28
Fiyatlandırma ve eşzamanlılık limitleri birlikte değerlendirildiğinde Flash, yüksek hacimli ve rutin trafik için; Pro ise daha zor akıl yürütme ve geniş bağlam gerektiren, kapasitesi daha sınırlı işler için konumlanıyor gibi görünüyor. Bu, yayımlanan ekonomik yapı ve limitlerden çıkarılan bir değerlendirmedir; her kullanım senaryosu için doğrudan bir şirket açıklaması değildir. 2
28
DeepSeek'in hamlesi, GPU çıkarım kapasitesini talebe göre şekillendirme yaklaşımına benziyor. Sağlayıcılar, etkileşimli kullanıcıların çevrim içi olduğu saatlerde yoğunlaşan talebi yönetmek zorunda. Toplu işler ise çoğu zaman bekleyebilir. Yoğun saatlerde daha yüksek, diğer saatlerde daha düşük ücret uygulamak; hesaplamanın gün içine yayılmasını teşvik ediyor.
Bu durum geliştiricilerin optimizasyon hesabını da değiştiriyor. Maliyet kontrolü artık yalnızca model seçmekten ve token saymaktan ibaret değil. Üretim ekiplerinin şu kararları da vermesi gerekiyor:
Daha geniş açıdan bakıldığında bu değişiklik, büyük model rekabetindeki sabit ve düşük fiyat yarışından kapasite kıtlığına dayalı fiyatlandırmaya doğru bir kaymaya işaret ediyor. DeepSeek, zaman açısından esnek talepler için daha ucuz bir kanal sunmayı sürdürürken, üst seviye çıkarım kapasitesinin her saatte sınırsızmış gibi fiyatlandırılmadığını gösteriyor. Reuters da değişikliği tek tip bir ek ücret değil, model, token kategorisi ve kullanım dönemine göre değişen kapsamlı bir artış olarak niteledi. 1
DeepSeek V4 kullanan ekipler için pratik sonuç net: iş planlama, önbellekleme, model yönlendirme ve çıktı sınırları API maliyet modelinin ayrılmaz parçaları hâline geldi. Zamanlaması değiştirilemeyen bir iş, farklı bir modele veya daha sıkı bir token bütçesine ihtiyaç duyabilir. Bekleyebilen işler ise yoğun olmayan saatlerde çalıştırılarak maliyet avantajının önemli bölümünü koruyabilir.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeek, V4 Flash ve V4 Pro için 17 Ağustos 2026'da saat bazlı fiyatlandırmaya geçti; yoğun olmayan saatlerdeki ücretler, yoğun saatlerin tam yarısı.
DeepSeek, V4 Flash ve V4 Pro için 17 Ağustos 2026'da saat bazlı fiyatlandırmaya geçti; yoğun olmayan saatlerdeki ücretler, yoğun saatlerin tam yarısı. Pekin saatiyle 09.00–12.00 ve 14.00–18.00 arasındaki yoğun dönemlerde çıktı tokenlarının ücreti V4 Flash'te milyon token başına 9 yuan, V4 Pro'da 27 yuan'a kadar çıkıyor.
Yeni sistem, model seçimi, istem önbellekleme, çıktı uzunluğu ve işlerin hangi saatte çalıştırılacağı kararlarını tek bir maliyet hesabında birleştiriyor.