SpaceXAI(구 xAI)가 2026년 8월 12일, 차세대 추론 모델 'Grok 4.6'을 출시. AA 인텔리전스 지수 61점으로 GPT 5.6 Sol Max와 동률을 기록하며 프론티어 모델 대열에 합류했다. Grok 4.6의 가격은 기존과 동일한 입력 토큰당 2달러/출력 6달러.
연구 답변

Create a landscape editorial hero image for this Studio Global article: What did SpaceXAI's August 12, 2026 launch of Grok 4.6 entail in terms of pricing, benchmark performance, architectural approach, early inde. Article summary: ## Grok 4.6 Launch — August 12, 2026. Topic tags: general, news, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
2026년 8월 12일, SpaceXAI(2026년 2월 xAI에서 스페이스X로 합병)가 최신 추론 및 코딩 모델 'Grok 4.6'을 출시했다. 이는 불과 35일 전에 나온 Grok 4.5의 후속작이다 . 출시와 동시에 이 모델은 오픈AI나 앤트로픽의 경쟁 모델과 성능뿐 아니라 가격에서도 비교되며 업계의 이목을 집중시켰다. 그런데 그 다음 날, 구글이 'Gemini 3.7 Flash'를 발표하면서 2026년 AI 시장의 최대 격전지인 '개발자 지갑을 향한 가격 전쟁'은 더욱 뜨거워졌다.
Grok 4.6의 가격은 Grok 4.5와 동일하게 유지됐다. 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 6달러이며, 50만 개(500K) 토큰의 컨텍스트 윈도우와 텍스트 및 이미지 입력을 지원한다 . 고속 티어를 이용하면 두 배의 비용이 든다
. 이 가격은 GPT-5.6 Sol이나 클로드 오퍼스 5의 공시 가격보다 약 60% 저렴한 수준이다
.
반면, 8월 13일 출시된 구글의 Gemini 3.7 Flash는 입력 토큰 100만 개당 0.75달러, 출력 토큰 100만 개당 3.75달러라는 파격적인 가격을 제시했다. 이는 전작인 Gemini 3.6 Flash의 절반 가격이며, Grok 4.6의 약 3분의 1 수준이다 . 이 프로모션 가격은 올해 말까지만 적용되며, 2027년 1월 1일부터는 두 배로 인상될 예정이다
.
두 모델의 가격 대비 성능 전략은 극명하게 갈린다. Grok 4.6은 GPT-5.6 Sol이나 클로드 오퍼스 5와 같은 프론티어 모델과 지능(intelligence)으로 겨루면서도 더 낮은 가격을 내세운다. 반면, Gemini 3.7 Flash는 '일꾼(workhorse)' 등급의 모델로, 클로드 소네트 5나 GPT-5.6 Terra에 준하는 성능을 훨씬 낮은 가격에 제공하며 실용성을 강조한다 .
Grok 4.6은 9가지 평가를 종합한 AA(Artificial Analysis) 인텔리전스 지수에서 61점을 기록했다 . 이는 GPT-5.6 Sol Max와 동률이며, 클로드 페이블 5 Max(62점)에는 1점, 클로드 오퍼스 5 Max(63점)에는 2점 뒤진 수치다. 이로써 xAI(현 SpaceXAI) 모델이 처음으로 프론티어 모델 그룹에 진입했다는 평가를 받았다
.
| 벤치마크 | Grok 4.6 (High) | Grok 4.5 (High) | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| AA 인텔리전스 지수 | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 (Elo) | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| AA-Briefcase | 1577 | — | — | — |
SpaceXAI는 Grok 4.6이 CursorBench, FrontierCode, APEX-Agents, Terminal-Bench 등 모든 평가 항목에서 Grok 4.5 대비 향상되었다고 발표했다 . 독립 평가 기관인 Artificial Analysis 역시 이 주장을 확인했으며, 오차 범위는 0.08점에 불과했다
.
주목할 점은 Grok 4.6의 가장 강력한 독립 평가 결과가 지식 기반 업무(knowledge-work) 평가에서 나왔다는 것이다. GDPval-AA v2(1753 Elo), AA-Briefcase(1577), 그리고 Harvey 법률 벤치마크에서 선두를 기록하며, 전문 지식이 필요한 업무에 특히 적합한 모델임을 입증했다 . 하지만 에이전트형 코딩 모델로 마케팅된 것과 달리, CursorBench v3.2 점수(69.9%)는 페이블 5 Max(70.5%)에 소폭 뒤졌으나 GPT-5.6 Sol Max(67.2%)는 앞질렀다
.
한편, 구글 Gemini 3.7 Flash는 코딩 및 에이전트 벤치마크에서 큰 폭의 성능 향상을 보여줬다. 프로덕션 준비 코드 생성을 평가하는 FrontierCode v1.1에서 3.6 Flash의 34.4%에서 43.6%로 상승, 클로드 소네트 5(42.7%)와 GPT-5.6 Terra(41.3%)를 앞질렀다 . 또한 DeepSWE v1.1(49.0% → 65.3%)과 AutomationBench(17.0% → 30.4%)에서도 큰 발전을 이뤘다
.
Grok 4.6의 주요 아키텍처 변화는 새로운 xhigh 추론 수준이다. 이는 가장 어려운 에이전트 및 코딩 작업을 위해 설계된 집중 추론 모드다 . 모델은 **장시간 실행되는 에이전트의 지속성(durability)**을 위해 최적화됐다. SpaceXAI에 따르면, Grok 4.6은 클로드 오퍼스 5가 필요로 하는 절반 수준의 추론 단계(turns)로 작업을 해결하며, 명시된 가격 대비 약 4분의 1의 입력 토큰만 사용한다
. 이 효율성은 수시간에 걸친 코딩 세션을 운영하는 개발자에게 가장 강력한 판매 포인트로 작용한다
.
SpaceXAI는 이러한 성능 향상이 파라미터 수 증가가 아닌, 더 길어진 추가 학습(supplemental training), 향상된 지도 미세 조정(supervised fine-tuning), 그리고 강화 학습(RL) 덕분이라고 밝혔다 . 모델은 Grok 4.5와 동일한 1.5조(1.5 trillion) 파라미터 V9 기반을 유지한다
.
Gemini 3.7 Flash는 비용, 품질, 지연 시간을 제어할 수 있는 '커스터마이징 가능한 사고 설정'을 도입했으며, 구글 모델 중 최초로 에이전트형 비디오 처리를 지원한다 .
강점:
한계:
출시 이틀 후인 8월 14일, Grok 4.6은 깃허브 코파일럿(GitHub Copilot)에 통합되어 주요 개발 환경 전반에 걸쳐 사용 가능해졌다 :
깃허브는 공식 변경 로그에서 이 모델을 "에이전트형 코딩과 복잡한 다단계 워크플로우를 위해 설계되었다"고 설명했다 . 이렇게 빠른 통합은 개발자 플랫폼에서 이 모델에 대한 높은 수요를 의미한다 .
8월 12~13일의 연속 출시는 두 가지 뚜렷한 경쟁 전략을 보여준다:
Grok 4.6은 프론티어 급 성능을 할인된 가격에 제공하는 반면, Gemini 3.7 Flash는 워크호스 성능을 파격적인 가격에 제공한다. 구글이 전작 대비 절반 가격이라는 프로모션을 내걸고 플래그십 Pro 모델의 출시일을 공개하지 않은 것은 워크호스 시장에서의 점유율을 선점하기 위한 전략으로 풀이된다 .
Grok 4.6은 SpaceXAI를 프론티어 반열에 성공적으로 복귀시켰다. GPT-5.6 Sol과 동급의 지능을 훨씬 저렴한 비용으로, 게다가 에이전트 작업에서 뛰어난 효율성까지 제공한다. 단일 코딩 벤치마크에서 선두를 차지하지 못하고, 클로드 오퍼스 5에 종합 지수에서 밀리며, 가격을 동결했다는 점은 한계지만, 전체적인 성취를 깎아내리기는 어렵다.
구글은 단 24시간 만에 가격에 대한 모든 논의를 뒤집었다. Grok 4.6의 약 3분의 1 가격이라는 파격적인 조건에 강력한 코딩 및 에이전트 성능, 100만 토큰의 컨텍스트 윈도우까지 갖췄다. 경쟁 구도는 명확히 양분화됐다. '할인된 가격의 프론티어 지능(Grok 4.6)'과 '파격적인 가격의 워크호스 성능(Gemini 3.7 Flash)' 사이에서 개발자와 기업은 자신에게 맞는 가치를 선택해야 한다. 그리고 깃허브 코파일럿의 빠른 통합은 Grok 4.6이 최소한 하나의 확실한 팬층을 이미 확보했음을 시사한다.
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
SpaceXAI(구 xAI)가 2026년 8월 12일, 차세대 추론 모델 'Grok 4.6'을 출시. AA 인텔리전스 지수 61점으로 GPT 5.6 Sol Max와 동률을 기록하며 프론티어 모델 대열에 합류했다.
SpaceXAI(구 xAI)가 2026년 8월 12일, 차세대 추론 모델 'Grok 4.6'을 출시. AA 인텔리전스 지수 61점으로 GPT 5.6 Sol Max와 동률을 기록하며 프론티어 모델 대열에 합류했다. Grok 4.6의 가격은 기존과 동일한 입력 토큰당 2달러/출력 6달러. GPT 5.6 Sol이나 클로드 오퍼스 5 대비 약 60% 저렴하지만, 구글은 다음날 3분의 1 가격(0.75달러/3.75달러)의 Gemini 3.7 Flash를 선보이며 가격 경쟁에 불을 붙였다.
Grok 4.6은 지식 기반 업무에서 두각을 나타냈으며 출시 이틀 만에 깃허브 코파일럿에 통합되는 등 개발자들의 높은 관심을 입증했다. 반면 Gemini 3.7 Flash는 100만 토큰 컨텍스트 윈도우와 에이전트 비디오 처리 기능을 앞세워 실용성을 강조했다.