일론 머스크는 10월 7일 그록 봇이 “각 작업에 가장 적합한 백엔드 모델”을 사용하게 될 것이라고 밝혔습니다. 예시로 앤스로픽의 클로드 오퍼스 5.5와 이미지 생성 서비스 미드저니, 음악 생성 서비스 수노 등을 들었습니다. 목표는 어떤 서비스든 가장 좋은 결과를 낼 가능성이 높은 쪽을 선택하는 것이라는 설명입니다. 다만 이는 향후 방향을 알린 발언이지, 모든 연동이 이미 적용됐다는 확인은 아닙니다.
17
32
공개된 내용과 아직 모르는 것
머스크는 그록 봇이 자체 기술만 사용하는 대신 외부 AI 서비스도 활용할 수 있다는 구상을 밝혔습니다. 하지만 어떤 종류의 요청을 어느 서비스에 맡길지, 모델을 어떤 기준으로 선택할지, 언제 실제 제공을 시작할지는 설명하지 않았습니다. 비용을 어떻게 책정할지와 외부 서비스로 전달되는 사용자 데이터의 처리 방식도 공개되지 않았습니다.
23
25
26
따라서 서비스 이름이 언급됐다는 사실만으로 모든 연동이 완료됐거나 실제 작동 방식이 확인됐다고 보기는 어렵습니다.
AI를 직접 만드는 것만큼 중요한 ‘연결 창구’
그록 봇이 여러 AI 모델 가운데 하나를 골라 요청을 전달할 수 있다면, 그 역할은 그록 모델로 들어가는 통로를 넘어 다양한 업체의 AI를 연결하는 인터페이스로 넓어질 수 있습니다. 사용자는 한곳에서 요청을 입력하고, 실제 작업은 상황에 따라 외부 업체의 모델이나 서비스가 맡는 방식입니다.
이런 구조에서는 어떤 모델을 만들었는지뿐 아니라 사용자의 요청을 받아 적합한 모델을 고르고 결과를 전달하는 제품을 누가 장악하는지도 중요해질 수 있습니다. 다만 이는 발표가 시사하는 사업적 가능성이지, xAI가 자체 모델 개발을 중단한다는 뜻은 아닙니다.
앤스로픽에는 그록 봇이 실제로 클로드를 호출할 경우 API 사용량과 새로운 유통 경로를 얻을 기회가 생길 수 있습니다. 그러나 이익이 발생할지는 실제 이용 규모와 계약 조건에 달려 있으며, 머스크는 관련 내용을 공개하지 않았습니다.
25
26
벤치마크 점수는 참고 자료일 뿐
9월에 공개된 한 비교 자료에서 인텔리전스 인덱스 점수는 클로드 오퍼스 5가 51점, 그록 4.7이 46점이었습니다. 이는 해당 평가에서 두 모델이 어떤 결과를 냈는지 보여주는 하나의 비교 자료입니다. 모든 종류의 요청에서 어느 한 모델이 더 낫다는 뜻은 아닙니다. 특히 비교 대상은 머스크가 언급한 오퍼스 5.5가 아니라 오퍼스 5였습니다.
3
모델 선택 시스템이 성능이나 비용, 작업 종류를 고려할 가능성은 있지만, 머스크는 구체적인 선택 기준을 밝히지 않았습니다. 따라서 이 점수만으로 그록 봇의 실제 라우팅 방식을 알 수는 없습니다.
남은 질문들
외부 서비스가 실제로 언제부터 제공되는지, 모델 선택은 어떻게 이뤄지는지, 비용과 사용자 데이터는 어떤 방식으로 처리되는지 등 실무적인 질문은 여전히 남아 있습니다. 현재 확인할 수 있는 결론은 제한적입니다. 머스크는 그록 봇이 자체 기술뿐 아니라 외부 AI 서비스도 활용할 수 있다는 방향을 제시했지만, 구체적인 구현과 사업 모델은 아직 불분명합니다.
25
26