21 Ağustos 2026’da yayımlanan DeepSeek V4 Flash Vision Exp, V4 Flash’a görsel anlama yeteneği ekliyor; görseller en fazla 384 giriş token’ı olarak hesaplanıyor ve mevcut Flash tarifesiyle ücretlendiriliyor. Geliştiriciler görselleri Base64, herkese açık URL veya tekrar kullanılabilen Files API referanslarıyla gönder...
Research answer

Create a landscape editorial hero image for this Studio Global article: What did DeepSeek’s August 21, 2026 launch of the V4-Flash-Vision-Exp multimodal vision API introduce, including its image-input methods, pr. Article summary: DeepSeek’s August 21 launch added experimental image understanding to its low-cost V4-Flash API, aiming to make DeepSeek agents able to perceive and act on screenshots and other visual state—not merely process text. It p. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
DeepSeek, 21 Ağustos 2026’da API platformunda deneysel deepseek-v4-flash-vision-exp modelini kullanıma sundu. Yeni model, V4-Flash’ın metin üretimi, araç kullanımı ve ajan altyapısına görsel anlama ekliyor. Böylece geliştiriciler ekran görüntülerini, kullanıcı arayüzlerini, grafikleri ve diğer görsel durumları metinle birlikte modele gönderebiliyor. 114
Bu lansmanın en dikkat çekici tarafı yalnızca görsel destek değil, fiyatlandırma yaklaşımı. DeepSeek, her görseli faturalandırma için en fazla 384 giriş token’ı olarak dönüştürüyor ve görsel girdiler için ayrıca bir vision ücreti almıyor. Görseller, V4-Flash’ın normal token tarifesi üzerinden ücretlendiriliyor. 319
Model, API’de deepseek-v4-flash-vision-exp kimliğiyle çağrılıyor. Metin ve görsel girdilerini birlikte işleyebilen model; Chat Completions, Messages ve Responses tabanlı API yüzeylerini destekliyor. Bu yapı, mevcut araç çağırma ve ajan iş akışlarına görsel girdinin eklenmesini kolaylaştırıyor. 412
Dolayısıyla özellik yalnızca tek seferlik görsel açıklamalarından ibaret değil. Bir ajan, örneğin ekran görüntüsünü inceleyip arayüzdeki sonraki adımı belirleyebilir, bir araç çağırabilir ve işlem sonrasında oluşan yeni ekranı tekrar analiz edebilir. Paylaşılan örneklerde ekran görüntülerinden çalıştırılabilir kod üretme ve görsel girdilerle oyun geliştirme akışları da yer aldı. 510
Geliştiriciler modele görselleri üç farklı yöntemle iletebiliyor:
data: URL’si olarak gömmek.file_id değeriyle referans göstermek. 6714Files API’nin kullanımı ücretsiz. Özellikle aynı ekran görüntüsünün veya görsel durumun tekrar tekrar incelendiği ajan senaryolarında pratik bir seçenek sunuyor. Görsel verisini her istekte yeniden yüklemek yerine dosya referansı kullanılabildiği için tekrarlanan veri aktarımı azalıyor. 112
DeepSeek’in açıklamasına göre her görsel, faturalandırma açısından en fazla 384 giriş token’ı tüketiyor. Bu token’lar, V4-Flash’ın standart giriş fiyatından ücretlendiriliyor; görsel anlama için ayrı bir premium katman bulunmuyor. 3614
Yayımlanan fiyat tablolarından birinde görsel model için yoğun saatlerde önbelleğe alınmamış giriş token’larının fiyatı 1 milyon token başına 0,44 dolar, çıkış token’larının fiyatı ise 1 milyon token başına 1,32 dolar olarak listeleniyor. Aynı tabloda 1 milyon token’lık bağlam penceresi ve en fazla 384.000 token çıkış kapasitesi yer alıyor. 1
Bazı raporlar, 384 token sınırının kimi GPT ve Claude karşılaştırmalarındaki görsel token kullanımının yarısından az olduğunu belirtiyor. Ancak bu karşılaştırmalarda kullanılan model sürümleri, görsel çözünürlükleri ve faturalandırma varsayımları tamamen aynı değil. Bu nedenle söz konusu rakam, kesin bir platformlar arası kıyaslamadan çok yön gösterici bir verimlilik iddiası olarak okunmalı. 327
Pratik açıdan önemli nokta daha net: Çok sayıda ekran görüntüsünü düzenli olarak kontrol eden görsel ajanlar, her gözlem için premium bir çok modlu model kullanmak zorunda kalmadan daha öngörülebilir bir görsel giriş maliyetine sahip olabilir.
DeepSeek, yeni modelin V4-Flash’ın metin yeteneklerini; akıl yürütme, dünya bilgisi ve ajan işlevleri dahil olmak üzere koruduğunu açıkladı. Buna görsel girdi ve çok modlu ajan yetenekleri ekleniyor. 626
Şirket ayrıca çok modlu ajan testlerinde önemli bir ilerleme kaydedildiğini ve performansın Anthropic’in Claude Opus 4.8 modeline yaklaştığını bildirdi. Bazı yayımlanmış karşılaştırmalar seçili görevlerde V4-Flash-Vision-Exp’i Opus 4.8’e yakın gösterse de sonuçlar testten teste değişiyor. 4192123
Buradaki ayrım önemli: “Opus 4.8’e yakın” ifadesi şu aşamada DeepSeek’in kendi değerlendirme sonuçlarına dayanan bir şirket iddiası. Bu ifade, iki modelin gerçek dünyadaki tüm görsel ajan görevlerinde eşdeğer olduğunu kanıtlamıyor. Güvenilirlik, görsel doğruluk ve araç kullanımı performansını değerlendirmek için bağımsız testlere ihtiyaç var.
Geliştiricilerin modeli üretim ortamındaki görsel ajan döngülerine almadan önce akıl yürütme ayarlarını test etmesi gerekiyor. Raporlanan bir uygulamalı testte, düşünme token’larının tüm tamamlama bütçesini tükettiği ve kullanıcıya gösterilecek yanıt için hiç alan bırakmadığı görüldü. İlgili rapor, görsel görevlerde düşünme özelliğinin kapatılmasını veya modelin yanıt üretebilmesi için max_tokens değerinin artırılmasını öneriyor. 27
Bu durum modelin genel kapasitesine ilişkin bir hükümden çok, uygulama seviyesinde bir entegrasyon uyarısı. Akıl yürütme etkinleştirilecekse uygulamalar hem iç düşünme süreci hem de kullanıcıya dönecek yanıt için yeterli çıktı kapasitesi ayırmalı. Belirli bir ayara güvenmeden önce DeepSeek’in güncel API belgelerinde ilgili parametre adları ve davranışlar doğrulanmalı.
DeepSeek, eldeki kaynaklarda bu lansmana ilişkin resmî bir stratejik açıklama paylaşmış değil. Ancak ürün tasarımı belirgin bir kullanım alanına işaret ediyor: Görsel algıyı, ajanların tekrar tekrar kullanabileceği kadar düşük maliyetli hâle getirmek.
Ekran görüntüleri, oyun kareleri, panolar ve uygulama durumları; bir ajan bunları düzenli aralıklarla inceleyemediği sürece sınırlı değer taşıyor. Görsel yeteneğin Flash varyantında sunulması, geliştiricilerin mevcut düşük maliyetli ajan ve araç çağırma iş akışlarına görüntü girdisi eklemesine olanak tanıyor. Böylece tüm uygulamayı ayrı ve daha pahalı bir çok modlu model katmanına taşımak gerekmiyor.
Bu nedenle sürüm özellikle ekranla çalışan ajanlar, ekran görüntüsünden kod üreten araçlar ve sık görsel geri bildirim gerektiren uygulamalar için dikkat çekici. DeepSeek V4-Flash-Vision-Exp; görsel başına 384 token’lık düşük üst sınır ve esnek veri aktarım yöntemleri sunuyor. Buna karşılık benchmark liderliği ve üretim ortamındaki davranışı henüz doğrulanmayı bekliyor. Geliştiriciler için en sağlıklı başlangıç; gerçekçi ekran görüntüleriyle kontrollü testler yapmak, çıktı bütçesini açıkça belirlemek ve kaliteyi bağımsız kontrollerle ölçmek.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
21 Ağustos 2026’da yayımlanan DeepSeek V4 Flash Vision Exp, V4 Flash’a görsel anlama yeteneği ekliyor; görseller en fazla 384 giriş token’ı olarak hesaplanıyor ve mevcut Flash tarifesiyle ücretlendiriliyor.
21 Ağustos 2026’da yayımlanan DeepSeek V4 Flash Vision Exp, V4 Flash’a görsel anlama yeteneği ekliyor; görseller en fazla 384 giriş token’ı olarak hesaplanıyor ve mevcut Flash tarifesiyle ücretlendiriliyor. Geliştiriciler görselleri Base64, herkese açık URL veya tekrar kullanılabilen Files API referanslarıyla gönderebiliyor.
Model, V4 Flash’ın metin, akıl yürütme ve ajan yeteneklerini koruduğunu belirtiyor; ancak görsel entegrasyonlarda çıktı token’ları dikkatle planlanmalı, çünkü raporlanan testlerde düşünme süreci tüm yanıt bütçesini tü...