O ZhiJing combina avaliação, treinamento e recursos de implantação para desenvolver em modelos de linguagem uma capacidade mais consistente de interpretar crenças, relações, normas e contexto social. O SoMBench reúne 3 dimensões principais, 17 subdimensões, 71 tarefas e 3.481 exemplos validados por especialistas par...
Publicado porEditado com GPT-5.6 TerraImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What is the Chinese Academy of Sciences Institute of Computing Technology’s ZhiJing social intelligence system, released on July 24, 2026, a. Article summary: ZhiJing is CAS ICT’s integrated “social mind” framework: it combines measurement, model training, and deployment time grounding so LLMs can infer mental states, relationships, norms, and context rather than merely produc. Topic tags: general web, openai, llm, agents, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
O ZhiJing é uma estrutura de “mente social” para modelos de linguagem desenvolvida pelo Instituto de Tecnologia da Computação da Academia Chinesa de Ciências (CAS ICT). A proposta não é apenas fazer a IA responder com fluência, mas ajudá-la a inferir estados mentais, relações entre pessoas, normas e o contexto de uma situação.
O sistema articula três etapas: medir as lacunas de raciocínio social, treinar o modelo para corrigi-las e dar suporte à aplicação em tempo de uso. A apresentação pública ocorreu em 24 de julho de 2026; o relatório técnico foi submetido ao arXiv em 26 de julho — datas diferentes, sem que isso represente necessariamente uma contradição. 1
O ponto de partida é o SoMBench, benchmark de diagnóstico fundamentado em psicologia. Ele divide a cognição social em 3 dimensões principais, 17 subdimensões e 71 paradigmas de tarefa. A avaliação usa 284 cenários compartilhados e 3.481 exemplos verificados por especialistas, controlando elementos como formato das perguntas, perspectiva narrativa e extensão do contexto. 1
Na prática, o teste busca identificar erros que avaliações comuns de perguntas e respostas frequentemente deixam passar, como:
As três grandes áreas avaliadas cobrem representação mental, interação social e internalização de normas. Em outras palavras, o objetivo é testar se o modelo consegue lidar com situações em que não basta repetir informação: é preciso perceber quem sabe o quê, o que alguém pode estar sentindo e quais regras sociais estão em jogo. 1
O Zing é a parte de treinamento do ZhiJing. A meta declarada é transformar o raciocínio social — que às vezes aparece apenas quando o prompt é muito bem formulado — em uma capacidade mais estável, incorporada aos parâmetros do modelo.
A equipe descreve um ciclo de dados orientado por diagnóstico, chamado de abordagem no estilo FLARE: falhas encontradas no SoMBench indicam quais habilidades sociais estão fracas; isso orienta a geração, filtragem, reparo, seleção e reavaliação de exemplos de treinamento. 1
O treinamento ocorre em duas fases:
Nessa etapa, o Mixed-Reward GRPO combina um sinal de recompensa voltado ao raciocínio social com a destilação on-policy (OPD). A função da OPD é preservar capacidades úteis do modelo-base durante o pós-treinamento especializado, reduzindo o chamado esquecimento catastrófico — quando o modelo melhora em uma habilidade nova, mas perde desempenho em outras. 1
O terceiro componente é o Actio, uma estrutura para implantação. Ela pode oferecer orientação procedural, acompanhamento de estados mentais atribuídos aos participantes, reutilização de experiências e busca controlada de conhecimento social ou normativo. 1
A CAS ICT informou que o modelo multimodal Zing-27B, com 27 bilhões de parâmetros, superou o GPT-5.5 na média de cinco benchmarks internacionais de cognição social. 1
De acordo com os números divulgados pela equipe, o Zing-27B alcançou 79,80%, contra 78,44% do GPT-5.5 — uma vantagem de 1,36 ponto percentual. Os ganhos reportados foram de 4,08 pontos percentuais no HiToM e de 5,62 pontos percentuais no EmoBench. 5
Há uma ressalva importante: o relatório primário confirma a alegação de liderança na média dos cinco benchmarks, mas o trecho disponível não expõe de forma independente todos esses valores específicos. Portanto, eles devem ser entendidos como resultados reportados pelos autores, e não como uma validação independente. 1
O próprio SoMBench indica que há uma distância considerável até um desempenho robusto em situações sociais reais. Na avaliação de 20 modelos de linguagem, o melhor resultado geral foi de 72,08% de acerto, e nenhuma das 17 subdimensões atingiu o limiar de 90% definido no relatório como próximo do teto. 1
Assim, o ZhiJing representa uma tentativa estruturada de tratar a inteligência social como problema de engenharia — com diagnóstico, treinamento e ferramentas de execução —, mas não demonstra que modelos de IA já compreendam pessoas com a confiabilidade exigida fora dos benchmarks.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
O ZhiJing combina avaliação, treinamento e recursos de implantação para desenvolver em modelos de linguagem uma capacidade mais consistente de interpretar crenças, relações, normas e contexto social.
O ZhiJing combina avaliação, treinamento e recursos de implantação para desenvolver em modelos de linguagem uma capacidade mais consistente de interpretar crenças, relações, normas e contexto social. O SoMBench reúne 3 dimensões principais, 17 subdimensões, 71 tarefas e 3.481 exemplos validados por especialistas para diagnosticar falhas de raciocínio social.
Segundo resultados divulgados pela equipe, o Zing 27B obteve média de 79,80% em cinco benchmarks, ante 78,44% do GPT 5.5; os números ainda não equivalem a uma replicação independente.