Yaklaşık 9 milyar parametreli ZDTaichu5.0 9B; metin, görüntü ve video girdileriyle mekânsal akıl yürütme ve fiziksel dünyayla etkileşen yapay zekâ araştırmaları için sunuluyor. TaichuAI’nin yayımladığı test puanları bağımsız olarak doğrulanmış değil.
YayımlayanGPT-6 Sol ile düzenlendiGörseller GPT Image 2 ile oluşturuldu
Research answer

Create a landscape editorial hero image for this Studio Global article: What is TaichuAI’s open-sourced ZDTaichu5.0-9B model, and how do its architecture, supported inputs and context length, adaptive reasoning a. Article summary: ZDTaichu5.0-9B is TaichuAI’s open-sourced, roughly 9-billion-parameter vision-language model aimed at visual understanding, spatial reasoning, tool-using agents, and embodied-AI research. Its value is as a downloadable m. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Bir robotun farklı açılardan gördüğü nesnelerin birbirine göre nerede olduğunu anlaması, görüntüdeki nesneleri adlandırmasından daha zor bir araştırma sorusu. TaichuAI’nin indirilebilir görsel-dil modeli ZDTaichu5.0-9B, sahne yorumlama, mekânsal akıl yürütme ve araç kullanabilen yapay zekâ ajanlarıyla deneyler için bu noktaya odaklanıyor. Fakat bir sahne hakkında doğru yanıt vermesi, o sahnede güvenle hareket edebileceği anlamına gelmiyor. 2
20
ZDTaichu5.0-9B, Qwen3.5-9B dil çözücüsünü C-RADIOv4-H görüntü kodlayıcısıyla birleştiriyor. TaichuAI’ye göre metin, tek görüntü, birden fazla görüntü ve video girdi olarak kullanılabiliyor; görsel girdiler farklı çözünürlüklerde işlenebiliyor. Belirtilen bağlam uzunluğu 128 bin tokena kadar. Bu özellikler, aynı sahnenin birden fazla görünümünü birlikte inceleyen deneylere imkân tanıyor; her girdi boyutunda aynı performansı garanti etmiyor. 2
TaichuAI’nin entropi kapılı uyarlanabilir döngüsel akıl yürütme adını verdiği yaklaşımda, model daha zorlayıcı tokenlar için iç işlem sırasında ek iyileştirme adımları kullanabiliyor. Amaç, ek hesaplamayı her adıma eşit dağıtmak yerine ihtiyaç duyulan noktalara yöneltmek. Görüş açısı değiştiğinde bir nesnenin konumunu izleme veya nesneler arasındaki fiziksel ilişkiyi yorumlama gibi sorular, bu yaklaşımın sınanabileceği alanlar arasında. Bu, baştan sona doğrulanmış bir robot kontrol sistemi olduğu anlamına gelmiyor. 20
2
TaichuAI’nin benzer büyüklükteki genel amaçlı görsel-dil modelleriyle karşılaştırmalarında bildirdiği puanlar şöyle: ViewSpatial 62,50; MindCube-tiny 78,27; MMSI-Bench 47,20; ERQA 48,00; RoboSpatial 56,00. Şirket, karşılaştırdığı modeller arasında mekânsal performansta öne çıktığını söylüyor. Bunlar burada bağımsız olarak tekrarlanmış sonuçlar değil; araştırmacının kendi görüntülerinde, ajan düzeninde ve fiziksel ortamında ayrıca sınanmalı. 1
20
Ana model Hugging Face’te yayımlanıyor; TaichuAI ayrıca FP8 ve NVFP4 sürümlerini ve vLLM ile spekülatif kod çözme için tasarlanmış DSpark yardımcı modelini sunuyor. Modeli servis olarak çalıştırmak isteyenler için modele özel bir vLLM Docker imajı ve değiştirilmiş bir vLLM dalı belgelenmiş durumda. Bu nedenle standart bir vLLM kurulumunun aynı şekilde çalışacağını varsaymak yerine yayımlanan talimatlardan başlamak daha yerinde. 2
4
5
3
17
Yeniden kullanımdan önce iki ayrıntıyı kontrol edin. Birincisi lisans: Üçüncü taraf bir GGUF dönüşümü Apache-2.0 olarak etiketlenirken başka bir model kaydı farklı lisans koşulları belirtiyor. Dönüştürülmüş dosyanın etiketi, ana modelin ve bileşenlerinin kullanım şartlarını tek başına açıklığa kavuşturmuyor. 8
6 İkincisi bağlam sınırı: Örnek vLLM komutunda
--max-model-len 220000 yazıyor, ancak modelin teknik özelliklerinde sınır 128 bin tokena kadar olarak belirtiliyor. Sunucu ayarı, 220 bin tokenlık etkin bağlamın doğrulandığına kanıt sayılmamalı. 17
2
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Yaklaşık 9 milyar parametreli ZDTaichu5.0 9B; metin, görüntü ve video girdileriyle mekânsal akıl yürütme ve fiziksel dünyayla etkileşen yapay zekâ araştırmaları için sunuluyor.
Yaklaşık 9 milyar parametreli ZDTaichu5.0 9B; metin, görüntü ve video girdileriyle mekânsal akıl yürütme ve fiziksel dünyayla etkileşen yapay zekâ araştırmaları için sunuluyor. TaichuAI’nin yayımladığı test puanları bağımsız olarak doğrulanmış değil. Yeniden kullanmadan önce lisans koşullarını ve kendi ortamınızdaki performansı kontrol etmek gerekiyor.