Anthropic이 30만 9815건의 실제 Claude.ai 대화를 분석하여 모델 버전(Sonnet 4.6, Opus 4.6, Opus 4.7)과 사용 언어에 따라 AI의 표현된 가치관이 체계적으로 달라진다는 사실을 확인했다 [3][10]. 연구팀은 3300개 이상의 가치관을 '순응 vs 신중', '온정 vs 엄밀', '심층 vs 간결', '솔직 vs 실행'이라는 4가지 핵심 축으로 압축했으며, 이 축들이 전체 변동의 약 15%를 설명한다 [5][7][10].
연구 답변

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What did Anthropic's July 2026 research reveal about how Claude's expressed values and personalit. Article summary: On July 13, 2026, Anthropic published research analyzing 309,815 real Claude.ai conversations across three models (Sonnet 4.6, Opus 4.6, Opus 4.7) and 20 languages, finding that Claude's expressed values shift measurably. Topic tags: general, academic, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
2026년 7월 13일, Anthropic이 발표한 대규모 연구에 따르면, AI 모델 Claude의 '성격'은 어떤 모델 버전을 사용하느냐, 어떤 언어로 대화하느냐에 따라 측정 가능한 수준으로 체계적으로 달라집니다 FDA. 이 연구는 30만 9815건의 실제 Claude.ai 비식별화 대화(conversations)를 분석하여 얻은 결과로, 많은 사용자가 'Claude가 매일 다르게 반응하는 것 같다'고 느끼는 현상이 실제 데이터로 확인된 셈입니다 DA.
Anthropic 연구진은 Claude의 출력에서 3300개 이상의 개별 가치관(values)을 식별한 뒤, 차원 축소(dimensionality reduction) 기법을 통해 이들을 4가지 핵심 행동 축으로 압축했습니다 BEA. 각 축은 서로 반대되는 두 성향 사이의 스펙트럼으로 구성됩니다 A. 이 네 축은 대화의 과제(task), 주제, 사용자의 가치관을 통제한 후에도 나타나는 Claude의 표현 가치관 변동 중 약 15%를 설명합니다 EGA.
각 Claude 모델은 사용자가 주관적으로 느끼는 톤(tone)과 행동 방식을 그대로 반영하는 뚜렷한 가치관 프로필을 보여줍니다 A.
4가지 축 중 온정(Warmth) vs 엄밀(Rigor) 축에서 언어 간 가장 큰 변동폭이 관찰되었습니다 EA.
추가로 보고된 언어별 패턴은 다음과 같습니다 FG. 네덜란드어에서는 Claude가 더 솔직한 경향(Candor)을, 인도네시아어에서는 작업을 직접적으로 처리하는 실행 중심(Execution) 경향을 보였습니다. 일본어의 경우, 다른 언어에 비해 상대적으로 이러한 축에서의 편향(bias)이 덜한 것으로 나타났습니다 GN.
이번 연구는 단순한 흥미로운 사실을 넘어, AI 사용자에게 명확한 실용적 지침을 제공합니다.
Anthropic은 이 연구가 '왜(why)' 가치관이 변하는지에 대한 답을 제시하기보다는, 그 질문을 던지기 위한 출발점이라고 명확히 밝히고 있습니다 A.
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
Anthropic이 30만 9815건의 실제 Claude.ai 대화를 분석하여 모델 버전(Sonnet 4.6, Opus 4.6, Opus 4.7)과 사용 언어에 따라 AI의 표현된 가치관이 체계적으로 달라진다는 사실을 확인했다 [3][10].
Anthropic이 30만 9815건의 실제 Claude.ai 대화를 분석하여 모델 버전(Sonnet 4.6, Opus 4.6, Opus 4.7)과 사용 언어에 따라 AI의 표현된 가치관이 체계적으로 달라진다는 사실을 확인했다 [3][10]. 연구팀은 3300개 이상의 가치관을 '순응 vs 신중', '온정 vs 엄밀', '심층 vs 간결', '솔직 vs 실행'이라는 4가지 핵심 축으로 압축했으며, 이 축들이 전체 변동의 약 15%를 설명한다 [5][7][10].
Sonnet 4.6은 사용자에게 순응적이고 온정적인 반면, Opus 4.7은 신중하고 엄밀하며 심층적인 분석과 솔직한 한계 인정을 보인다 [2][3][10].