ZhiJing; sosyal zekâyı ölçme, model içinde kalıcılaştırma ve çalışma anında bağlama dayandırma adımlarını birleştiren bir çerçeve. SoMBench, 3 ana boyut, 17 alt boyut, 71 görev ve uzmanlarca doğrulanmış 3.481 örnekle modellerin sosyal muhakeme açıklarını teşhis etmeyi amaçlıyor.
YayımlayanGPT-5.6 Terra ile düzenlendiGörseller GPT Image 2 ile oluşturuldu
Research answer

Create a landscape editorial hero image for this Studio Global article: What is the Chinese Academy of Sciences Institute of Computing Technology’s ZhiJing social intelligence system, released on July 24, 2026, a. Article summary: ZhiJing is CAS ICT’s integrated “social mind” framework: it combines measurement, model training, and deployment time grounding so LLMs can infer mental states, relationships, norms, and context rather than merely produc. Topic tags: general web, openai, llm, agents, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Büyük dil modelleri akıcı metin üretebilse de, bir kişinin gerçeği değil yanlış inancı üzerinden hareket ettiğini, söylenmeyen bir niyeti, değişen duyguyu ya da ilişki ve sosyal normların getirdiği sınırları anlamakta zorlanabiliyor. Çin Bilimler Akademisi Bilişim Teknolojisi Enstitüsü’nün (CAS ICT) ZhiJing sistemi, bu açığı hedefleyen bütünleşik bir “sosyal zihin” yaklaşımı.
Sistem üç hattı tek çerçevede topluyor: sosyal muhakemeyi ölçmek, bu beceriyi modelin eğitiminde içselleştirmek ve model gerçek kullanımdayken gerekli bağlamı temellendirmek. CAS ICT sistemi 24 Temmuz 2026’da kamuya tanıttı; teknik rapor ise 26 Temmuz’da arXiv’e gönderildi. Bu nedenle iki tarih birbiriyle çelişmiyor. 1
ZhiJing’in FLARE tarzı veri döngüsü, eğitim verisini rastgele büyütmek yerine hatadan hareket ediyor. Ölçütte başarısız olunan sosyal beceriler saptanıyor; bunlara dönük örnekler üretilip filtreleniyor, model eğitiliyor ve tekrar değerlendirmeye alınıyor. Teknik raporda bu süreç; sorunlu örneklerin çıkarılması, boyut bazında teşhis, zorluk ve cevaplanabilirlik kontrolleri, kestirme yol testleri, düzeltme ve seçme adımlarını içeren bir veri yineleme çerçevesi olarak anlatılıyor. 1
Eğitim iki aşamalı yürütülüyor:
Mixed-Reward GRPO yöntemi, sosyal muhakemeye yönelik ödül sinyalini OPD ile birleştiriyor. OPD’nin rolü, model sosyal beceriler için sonradan eğitilirken temel modelin yararlı genel yeteneklerini korumak; başka bir deyişle “katastrofik unutma” riskini azaltmak. GRPO ise hedeflenen sosyal görevlerde başarıyı artırmayı amaçlıyor. 1
CAS ICT’ye göre çok modlu Zing-27B, beş uluslararası sosyal biliş ölçütünün ortalama skorunda GPT-5.5’i geride bıraktı. 1
Geliştiricilerin paylaştığı rakamlarda Zing-27B’nin beş ölçütteki bileşik ortalaması %79,80, GPT-5.5’in ise %78,44 olarak veriliyor. Bu, 1,36 puanlık fark anlamına geliyor. Bildirilen görev bazlı üstünlükler, HiToM’da 4,08 puan ve EmoBench’te 5,62 puan. Bu değerler, araştırma ekibinin açıkladığı değerlendirme sonuçlarıdır; mevcut birincil rapor özeti bu dört sayıyı bağımsız olarak ayrıntılandırmadığından, bağımsız üçüncü taraf doğrulaması olarak görülmemeli. 1
ZhiJing’in asıl vurgusu, sosyal zekânın hâlâ modeller için zor bir alan olduğu. SoMBench’te değerlendirilen 20 temsili büyük dil modelinde en yüksek genel doğruluk yalnızca %72,08 oldu; 17 alt boyutun hiçbirinde raporun “neredeyse tavan” kabul ettiği %90 eşiğine ulaşılamadı. 1
Dolayısıyla Zing-27B’nin bildirilen sonuçları umut verici olsa da, bunlar yapay zekânın gerçek hayatta insanların niyetlerini veya duygularını güvenilir biçimde “anladığının” kanıtı değil. Çalışmanın daha temkinli çıkarımı şu: İnanç, duygu, ilişki ve norm gibi sosyal bağlam unsurları artık daha sistematik biçimde ölçülebilen, hedefli eğitime konu olan ve kullanım anında desteklenebilen bir mühendislik problemi hâline geliyor. 1
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
ZhiJing; sosyal zekâyı ölçme, model içinde kalıcılaştırma ve çalışma anında bağlama dayandırma adımlarını birleştiren bir çerçeve.
ZhiJing; sosyal zekâyı ölçme, model içinde kalıcılaştırma ve çalışma anında bağlama dayandırma adımlarını birleştiren bir çerçeve. SoMBench, 3 ana boyut, 17 alt boyut, 71 görev ve uzmanlarca doğrulanmış 3.481 örnekle modellerin sosyal muhakeme açıklarını teşhis etmeyi amaçlıyor.
Geliştiricilerin bildirdiği sonuçlara göre çok modlu Zing 27B, beş sosyal biliş testinin ortalamasında GPT 5.5’i geçti; ancak sonuçlar bağımsız tekrar çalışması değil.