Grok 4.5는 2026년 6월 28일, 1.5조(1.5T) 파라미터의 V9 기반 모델로 SpaceX와 테슬라에서 비공개 베타 테스트를 시작했으며, 이 모델은 2026년 5월 26일에 사전 훈련을 완료했습니다. 이 모델은 7월 8일에 xAI API를 통해 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 6달러의 가격으로 제공되었습니다. Grok 4.6은 이전 모델 대비 33% 증가한 파라미터를 가지고 있으며, 1.5T에서 2T로 증가했습니다.
| 사양 | Grok 4.5 | Grok 4.6 |
|---|---|---|
| 파라미터 | 1.5조 개 | 2조 개 |
| 기반 모델 | V9 (2026년 5월 26일 훈련 완료) | 차세대 (아키텍처 세부 사항 미공개) |
| 상태 | 스페이스X & 테슬라에서 6월 28일부터 비공개 베타; 7월 8일 API 출시 | 이번 주 훈련 마무리; 8월 출시 예정 |
| API 가격 | 입력 $2/1M 토큰, 출력 $6/1M 토큰 | 미정 |
| 보고된 성능 | 클로드 오푸스에 근접/초월했다고 자체 보고; 독립 벤치마크 없음 | Grok 4.5 능가 주장; Kimi K3 추월 목표 |
중요한 주의사항: Grok 4.5에 대한 독립적인 제3자 벤치마크는 단 하나도 공개되지 않았습니다. 모든 성능 주장은 xAI 자체의 주장일 뿐입니다. 한 xAI 엔지니어는 Grok 4.5가 초기 훈련에 포함되지 않은 추가적인 "커서 데이터"(코딩 관련 데이터)를 사용했으며, 이는 "초기 훈련에 포함시키는 것만 못하다"고 언급했습니다.
머스크의 이번 발표 시점은 2026년 7월 16일 Moonshot AI가 Kimi K3를 출시한 것과 직접적으로 연결됩니다. Kimi K3는 2.8조(2.8T) 파라미터의 오픈 웨이트 혼합 전문가(MoE) 모델로, 100만 개 토큰의 컨텍스트 윈도우와 기본 컴퓨터 비전 기능을 갖추고 있어 역대 가장 큰 오픈 웨이트 AI 모델이자 최초의 '3T급' 모델입니다. 이 모델은 토큰당 896개의 전문가 중 16개만 활성화하여 컴퓨팅 비용을 줄이는 설계 방식을 채택했습니다.
머스크는 자신의 게시물에서 Grok 4.6을 이러한 경쟁에 대응하는 모델로 명시적으로 규정하며, Kimi K3의 성능을 능가하면서도 Grok의 속도와 효율성 이점을 유지하는 것을 목표로 한다고 밝혔습니다. 2T 파라미터의 Grok 4.6은 Kimi K3의 2.8T 파라미터보다 작기 때문에, xAI는 단순한 파라미터 수보다 아키텍처 효율성과 추론 최적화에 베팅하고 있습니다.
이 지점이 중요합니다: Grok 4.5에는 독립적인 벤치마크 점수가 전혀 없습니다. 모든 경쟁력 주장은 xAI의 자체 보고에 불과합니다. 반면, Kimi K3는 독립적으로 평가되어 종합 리더보드에서 전 세계 3위를 기록했으며, 이는 Anthropic의 Claude Fable 5와 OpenAI의 GPT-5.6 Sol에 이은 순위입니다. Kimi K3는 "미국 경쟁사들의 가장 강력한 독점 시스템과 어깨를 나란히 한다"는 평가를 받았으며, 특정 코딩 및 웹 개발 벤치마크에서는 Claude Fable 5를 능가하기도 했습니다.
가격 측면에서 Kimi K3의 API는 Claude Fable 5나 GPT-5.6 Sol 같은 경쟁 모델에 비해 약 절반 수준인 것으로 알려졌습니다. 정확한 토큰당 가격은 확인되지 않았습니다.
핵심 요점: Grok 모델과 Kimi K3 간의 직접적인 독립 벤치마크 비교는 존재하지 않습니다. 모든 xAI의 성능 관련 주장은 머스크가 소셜 미디어를 통해 한 검증되지 않은 주장입니다.
머스크의 7월 18일 발표는 훨씬 더 큰 계획의 일부입니다. xAI가 공개적으로 약속한 내용은 다음과 같습니다:
모델 경쟁과 함께, xAI는 2026년 7월 15~16일에 Grok Build를 Apache 2.0 라이선스로 오픈소스화하여 GitHub(xai-org/grok-build)에 Rust 기반 CLI 코딩 에이전트를 공개했습니다. Grok Build는 8개의 병렬 하위 에이전트, 계획 우선 워크플로우, 아레나 모드를 갖추고 있습니다. 이번 오픈소스화는 프라이버시 논란 이후에 이루어졌습니다. 보안 연구원들은 이전 버전이 사용자의 전체 작업 디렉토리를 xAI 서버로 업로드한다는 사실을 발견했습니다. 코드를 공개함으로써 xAI는 신뢰를 구축하고 커뮤니티 채택을 가속화하려는 목표를 가지고 있습니다.
머스크는 7월 8일에 xAI가 사용자 피드백에 따라 Grok Build를 매일 개선하고 있다고 별도로 확인했습니다. 이는 xAI가 Cursor 및 GitHub Copilot과 같은 코딩 에이전트 분야의 기존 강자들에게 직접 도전하는 위치를 확보하는 것입니다.
머스크의 7월 18일 Grok 4.6 발표는 불과 이틀 전에 출시된 Moonshot의 Kimi K3에 대한 명백한 경쟁적 반격입니다. xAI의 월간 출시 주기는 다른 어떤 프론티어 연구소보다 빠르며, Grok 5 로드맵은 훨씬 더 큰 모델이 앞으로 나올 것임을 시사합니다. 그러나 xAI 모델에 대한 독립적인 벤치마크의 부재는 모든 경쟁력 주장이 제3자 테스트 결과가 나올 때까지 검증되지 않은 상태로 남아 있음을 의미합니다. 규모만큼이나 투명성이 중요한 이 경쟁에서 이러한 격차는 중요한 의미를 갖습니다.