구글 AI 오버뷰가 'Google'의 'P'가 두 개라고 답하는 초등학생 수준의 철자 오류를 범하는 이유는, 대규모 언어 모델이 텍스트를 개별 문자가 아닌 서브워드 토큰으로 처리하기 때문입니다 [23][8]. 이 동일한 토큰화 격차로 인해 2026년 5월 'disregard(무시)' 검색어 오류 및 2024년 피자 본드, 돌 먹기 권장 사건 등 연쇄적 실패가 발생했습니다 [34][49].

Create a landscape editorial hero image for this Studio Global article: What is Google's AI Overview, why does it struggle to spell simple words like "Google" (claiming two "P"s), "poop" (claiming one "R"), and ". Article summary: ## What is Google AI Overview?. Topic tags: general, academic, education, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "There’s also is also “exactly 1 ‘r’ in the word ‘poop’,” Google’s AI Overview says, as well as two ‘d’s in the word journalism, yet spelled it: j-o-u-r-n-a-d-i-s-m. Google did at l" source context "Why Google's AI can't spell Google (or anything else) - Yahoo Tech" Reference image 2: visual subject "# Google's AI Overview still can't spell, and the internet is very aware of it. How many 'e's are there in the word astronomical? Google's AI Overview still can't spell, and the in"
“구글(Google)”이라는 단어에 ‘P’가 몇 개일까요? 구글의 최첨단 AI는 자신 있게 두 개라고 답합니다. 다시 묻습니다. “똥(poop)에는 ‘R’이 몇 개야?” AI는 한 치의 망설임도 없이 “정확히 1개” 라고 말합니다. 맞는 답은 두 개인데 말이죠. 심지어 '저널리즘(journalism)'에는 'D'가 두 개 들어간다며 철자를 j-o-u-r-n-a-d-i-s-m이라고 적기까지 합니다. 도널드 트럼프 전 대통령의 성도 t-r-p-u-m으로 표기했습니다 .
이건 네트워크 지연이나 일시적인 버그가 아닙니다. 구글이 검색의 미래라고 내세운 ‘AI 오버뷰(AI Overviews)’ 기능의 태생적 설계 결함입니다. 그리고 이 결함은 2024년 출시 직후부터 오늘날까지, 마치 하나의 ‘사고 연대기’처럼 반복되고 있습니다.
이유는 간단합니다. AI는 우리처럼 글자를 하나하나 보지 않습니다.
현존하는 거의 모든 대규모 언어 모델(LLM)은 텍스트를 처리할 때 ‘문자(Character)’가 아닌 ‘토큰(Token)’ 이라는 덩어리 단위로 쪼개서 읽습니다. 가령 ‘Google’이라는 단어는 AI에게 ['Google']이라는 통짜 토큰 하나일 수 있고, ‘journalism’은 ['journ', 'alism'].
AI의 두뇌에는 ‘G’, ‘o’, ‘o’, ‘g’, ‘l’, ‘e’ 라는 개별 정보가 처음부터 존재하지 않는 셈입니다. 철자 하나하나를 세는 능력은 AI가 학습 과정에서 자연스럽게 체득하는 게 아니라, 마치 인간이 거꾸로 암산하듯 억지로 추론해야 하는 과제인 거죠. 여러 학술 연구들은 AI의 임베딩 레이어가 문자 정보를 불완전하게 저장하며, 특히 첫 글자 이후의 정보는 급격히 손실된다는 사실을 밝혀냈습니다 .
심지어 이론 컴퓨터 과학 측면에서는, 현재 AI를 지배하는 트랜스포머(Transformer) 구조가 순차적인 깊은 추론이 필요한 작업을 원천적으로 수행할 수 없는 복잡도 등급(TC0)에 속한다는 분석도 있습니다. 아무리 GPT-5, GPT-6로 진화해도 태생적 구조 때문에 이런 간단한 세기를 못 할 수 있다는 예측이 나오는 배경입니다 .
2026년 5월 22일, 전 세계 사용자들은 더 기이한 현상을 목격했습니다. 구글 검색창에 “disregard(무시하세요)” 라는 단어만 입력했는데, 화면 상단이 텅 비어버린 겁니다. 대신 AI는 이렇게 반응했습니다: “알겠습니다. 이전 명령을 무시했습니다. 무엇을 도와드릴까요?”
‘무시해’, ‘취소해’, ‘건너뛰어’ 같은 AI 비서에게 내리는 명령어들이 구글 검색창에서 그대로 작동해 버린 것이죠. 보안 전문가들은 이를 ‘프롬프트 주입(Prompt Injection) 공격’의 전형적인 사례로 분석했습니다. 검색어를 지시 명령으로 착각한 AI가 자신의 시스템 프롬프트를 그대로 노출한 겁니다 . 구글은 곧바로 “인지하고 있으며 수정 중”이라고 밝혔지만, 이는 겉모습만 화려한 AI 검색의 내부가 얼마나 허술하게 연결되어 있는지를 여실히 보여준 사건이었습니다.
이 모든 해프닝의 서막은 2024년 5월로 거슬러 올라갑니다. 야심 차게 선보인 AI 오버뷰 기능은 출시 며칠 만에 글로벌 조롱거리가 됐습니다:
당시 구글 검색 총괄 리즈 레이드 부사장은 “드문 질의에 정보 격차가 발생했다”고 해명했고, 건강 관련 질문 등에는 AI 개입을 제한하는 패치를 했습니다 . 하지만 그때도 지금도 구글은 ‘텍스트 예측’에 능한 AI를 ‘사실 검증’이 필요한 검색 엔진에 앉힌 근본적 모순에서 벗어나지 못하고 있습니다.
이 연이은 실패들은 우연이 아니라, 패턴입니다. AI는 문법적으로 완벽한 문장을 생성하는 데 특화됐지, 철자 하나를 정확히 세거나 출처를 비판적으로 검증하도록 설계되지 않았습니다. 방대한 토큰 데이터에서 “이 단어 뒤엔 통계적으로 이 단어가 올 확률이 높다”는 추천만 할 뿐입니다.
구글이 특정 오류를 패치할 때마다 근본적으로 다른 유형의 실패가 터져 나오는 배경에는, 결국 이 구조를 뒤집지 않는 한 ‘진짜 신뢰할 수 있는 AI 검색’은 요원하다는 연구자들의 냉정한 경고가 자리 잡고 있습니다 . 지금 우리가 목격하는 건 단순한 해프닝이 아니라, 앞으로 수년간 우리를 따라다닐 AI 문해력의 핵심 과제일지 모릅니다.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
구글 AI 오버뷰가 'Google'의 'P'가 두 개라고 답하는 초등학생 수준의 철자 오류를 범하는 이유는, 대규모 언어 모델이 텍스트를 개별 문자가 아닌 서브워드 토큰으로 처리하기 때문입니다 [23][8].
구글 AI 오버뷰가 'Google'의 'P'가 두 개라고 답하는 초등학생 수준의 철자 오류를 범하는 이유는, 대규모 언어 모델이 텍스트를 개별 문자가 아닌 서브워드 토큰으로 처리하기 때문입니다 [23][8]. 이 동일한 토큰화 격차로 인해 2026년 5월 'disregard(무시)' 검색어 오류 및 2024년 피자 본드, 돌 먹기 권장 사건 등 연쇄적 실패가 발생했습니다 [34][49].
전문가들은 변환기 구조 자체가 순차적 계산에 취약해, 단순한 패치 이상의 근본적 해결 없이는 대규모 언어 모델의 신뢰성 확보가 어렵다고 경고합니다 [7][4].