| Önbelleksiz giriş |
|---|
| Çıktı |
|---|
| V4-Flash | Yoğun olmayan saat | $0,007 | $0,22 | $0,66 |
| V4-Flash | Yoğun saat | $0,014 | $0,44 | $1,32 |
| V4-Pro | Yoğun olmayan saat | $0,022 | $0,66 | $1,98 |
| V4-Pro | Yoğun saat | $0,044 | $1,32 | $3,96 |
Artış oranı modele, token türüne, önbellek durumuna ve günün hangi saatinde kullanım yapıldığına göre değişiyor. Reuters, toplam değişimin eski fiyatlara kıyasla yüzde 50 ila yüzde 1.100 arasında olduğunu bildirdi.
En belirgin etki, yoğun saatlerde büyük miktarda çıktı üreten uygulamalarda görülüyor. V4-Pro’nun çıktı fiyatı, 1 milyon token başına önceki $0,87 seviyesinden yoğun olmayan saatlerde $1,98’e, yoğun saatlerde ise $3,96’ya yükseldi.
Ayda 10 milyon çıktı tokeni üreten bir kodlama aracısı, yalnızca çıktı maliyeti açısından eski tarifede yaklaşık $8,70 öderdi. Tüm üretim yoğun olmayan saatlere denk gelirse maliyet yaklaşık $19,80, yoğun saatlere denk gelirse yaklaşık $39,60 olur. Bu hesaplamaya giriş tokenleri dahil değil.
DeepSeek’in yeni tarifesi, API maliyet yönetimine zaman planlamasını da ekliyor. Toplu işler, kodlama aracısı süreçleri, değerlendirmeler ve acil olmayan diğer görevler yoğun olmayan 17 saate taşınabilir.
Ancak kullanıcıların anlık yanıt beklediği uygulamalarda bu esneklik daha sınırlı. Sohbet botları, gerçek zamanlı kodlama araçları ve etkileşimli kurumsal uygulamalar, isteklerin geldiği saatlerde çalışmak zorunda kalabilir.
Önbellekleme ve istek yönlendirme de daha önemli hâle geliyor. Önbellek isabet oranını artıran, rutin işleri V4-Flash’e yönlendiren veya bazı istekleri başka bir sağlayıcıya aktaran sistemler yeni fiyatlara maruz kalmayı azaltabilir.
Bu nedenle kurumsal ekipler için model seçimi, yalnızca bir kez yapılan performans karşılaştırması olmaktan çıkıp operasyonel bir karara dönüşüyor. Model kalitesinin yanında gecikme süresi, önbellek davranışı, saat bazlı fiyatlandırma ve sağlayıcı değiştirme maliyeti de hesaba katılmalı.
Fiyat artışı DeepSeek’in maliyet avantajını tamamen ortadan kaldırmıyor; ancak son derece ucuz çıkarımın yarattığı farkı daraltıyor. Yoğun saat tarifesi, şirketin talebi yönetmeye ve sınırlı işlem kapasitesinden daha fazla değer elde etmeye çalıştığına işaret ediyor. Mevcut kaynaklar DeepSeek’in kârlılığa ulaştığını veya buna giden yolu kesin biçimde ortaya koymuyor. Bu nedenle fiyat artışını doğrudan kârlılık kanıtı olarak yorumlamak mümkün değil.
OpenAI ise farklı bir yol izledi. Şirket 6 Ağustos’ta GPT-5.6 Luna’nın ChatGPT Free ve Go kullanıcıları için varsayılan model olacağını, GPT-5.5’in yerini alacağını açıkladı. Bu kullanıcılar, kötüye kullanımı önlemeye yönelik korumalar çerçevesinde günlük metin sohbetlerine sınırsız erişim ve daha zor sorular için yeni bir Think seçeneği elde edecek.
Ancak “sınırsız” ifadesinin kapsamı dar. Sınırsızlık temel metin sohbetleri için geçerli; dosya yükleme, görsel üretimi ve diğer araçlarda ayrı kullanım limitleri devam ediyor. Free ve Go kullanıcıları GPT-5.6 ailesinin üst seviye modeli GPT-5.6 Sol’a erişemiyor. Bu paketlerde varsayılan deneyimi Luna sağlıyor ve Think özelliği de Luna tarafından destekleniyor.
Luna, GPT-5.6 ailesinin amiral gemisi Sol’dan ziyade daha ekonomik ve geniş erişime uygun üyesi olarak konumlandırılıyor. Üçüncü taraf kaynaklar Luna API’si için 1 milyon giriş tokeni başına $0,20 ve 1 milyon çıktı tokeni başına $1,20 fiyat bildiriyor; ancak bu rakamlar, burada sunulan en yüksek otoriteli kaynaklar tarafından doğrulanmış değil.
Stratejik açıdan daha önemli ayrım şu: Luna, ChatGPT Free ve Go içinde metin kullanımı için fiilen ücretsizken API erişimi ayrı ve ücretli bir ürün olmaya devam ediyor.
Bu kararlar, Çinli modellerin geliştirici trafiğinde güçlü bir yükseliş yaşadığı dönemde geldi. Bloomberg’e göre Çinli modeller, haziran ayında OpenRouter’da ABD platformlarını kullanım açısından geride bıraktı ve takip eden ayda token payının yüzde 60’ından fazlasını aldı.
OpenRouter, geliştiricilerin yüzlerce model arasından seçim yapmasını ve isteklerini farklı sağlayıcılara yönlendirmesini sağlayan bir platform. Bu nedenle verileri geliştiricilerin model yönlendirme davranışı için önemli bir gösterge olsa da küresel yapay zekâ kullanımının tamamını temsil etmiyor.
Temmuz ayı OpenRouter sıralamasında token hacmi bakımından ilk beş sıranın tamamında Çin’de geliştirilen modeller yer aldı: Xiaomi’nin MiMo-V2.5’i, DeepSeek, MiniMax, Alibaba’nın Qwen ailesi ve Moonshot’ın Kimi modeli.
Başka analizlerde DeepSeek, haziran sıralamalarından birinde platformdaki en büyük tekil sağlayıcı olarak yüzde 17,6 payla gösterildi. Bu tablo, artan kullanımın yalnızca DeepSeek’ten kaynaklanmadığını; Çinli model ekosisteminin daha geniş bir ivme kazandığını ortaya koyuyor.
DeepSeek ve OpenAI, aynı pazar baskısının farklı yönleriyle mücadele ediyor:
Bu nedenle bazı fiyatlar yükselse bile yapay zekâ fiyat savaşı sona ermiyor. Rekabet farklı katmanlara ayrılıyor: Bir tarafta düşük maliyetli çıkarım ve açık ağırlıklı modeller, diğer tarafta tüketici erişimi, ürün entegrasyonu, premium yetenekler ve kurumsal kontroller bulunuyor.
DeepSeek’in zam kararı, düşük API fiyatlarının büyük kullanım hacmi yaratabileceğini ancak maliyetlerin sonsuza kadar düşük kalacağını garanti etmediğini gösteriyor. OpenAI’nin Luna hamlesi ise farklı bir bahis: Şirket geniş bir tüketici deneyimini sübvanse ederek dağıtım gücünü ve kullanıcı alışkanlığını korumaya çalışıyor; ardından model katmanları ve metin dışı özelliklerle ayrışıyor.
Geliştiriciler ve kurumsal alıcılar için pratik ders açık: Hiçbir fiyat listesi veya kıyaslama sonucu kalıcı kabul edilmemeli. Maliyetler talebe, model seviyesine, önbellek durumuna ve kullanım saatine göre değişebilir.
Daha dayanıklı bir yapay zekâ mimarisi; gerçek iş yüklerini ölçen, farklı sağlayıcılara yönlendirme seçeneklerini açık tutan ve her görevi iş riskiyle maliyetine uygun model ve erişim katmanıyla eşleştiren mimari olacaktır.