따라서 100만 입력 토큰당 2달러, 출력 토큰당 6달러라는 가격만 보고 예산을 잡아서는 안 된다. 대규모 저장소나 긴 문서를 한 번에 넣는 개발자는 장문 컨텍스트 요금인 4달러·12달러를 기준으로 비용을 계산하는 편이 안전하다.
Artificial Analysis는 Grok 4.6에 Intelligence Index 61점을 부여했다. 이 지수는 추론, 코딩, 도구 사용, 지식 작업 등을 포함한 여러 평가를 종합한 지표다. Grok 4.6은 GPT-5.6 Sol Max와 동률이며, Grok 4.5 High보다 5점 높다.
이는 최상위권에 해당하는 강한 결과지만, 모든 벤치마크에서 1위를 차지했다는 뜻은 아니다. 종합 지수에서는 더 높은 점수를 받은 모델들이 있고, 코딩·추론·지식 작업별 평가에서는 모델마다 승패가 엇갈린다.
Grok 4.6의 차별점으로 더 자주 언급되는 부분은 비용 효율이다. 인용된 비교에서 Grok 4.6의 표준 API 가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러다. 반면 GPT-5.6 Sol standard는 각각 5달러와 30달러다.
이 수치는 Grok 4.6을 가격 대비 성능이 뛰어난 경쟁 모델로 설명할 근거가 된다. 그러나 모든 작업에서 가장 뛰어난 모델이라고 단정할 근거는 아니다.
Grok 4.6은 xAI API와 자체 개발자 제품을 통해 출시됐다. 초기 지원 제품에는 Grok Build와 Cursor가 포함됐고, OpenRouter·Vercel·Cloudflare 같은 파트너를 통한 접근도 제공됐다.
이후 개발자 플랫폼으로 지원 범위가 넓어졌다.
이 같은 유통 방식은 xAI의 개발자 중심 전략을 잘 보여준다. Grok 4.6은 독립형 챗봇에만 머무르지 않고 코딩 도구, 클라우드 인프라와 에이전트 플랫폼 안으로 들어가고 있다.
8월 20일 전후로 grok.com의 Grok Lite 이용자 일부가 정상적인 답변 대신 길고 의미 없는 문장, 이른바 ‘단어 샐러드(word salad)’를 받았다고 보고했다. 문제는 웹사이트에서 직접 질문을 입력했을 때 나타난 것으로 알려졌으며, X에 통합된 Grok 경험은 영향을 받지 않은 것으로 보인다. 일부 이용자는 새로고침 후 정상으로 돌아왔다고 했지만, 여러 차례 새로고침해도 해결되지 않았다는 사례도 있었다.
Grok 공식 계정은 이를 “드물게 발생하는 일시적인 생성 오류”라고 설명했다. 당시 상태 페이지에는 광범위한 장애가 표시되지 않았으며, 공식 계정은 문제가 발생한 이용자에게 새 채팅을 시작하거나 답변을 다시 생성하라고 안내했다.
이번 일은 Grok 4.6 전체가 이용 불가능해졌다는 의미라기보다 일시적인 응답 생성 문제로 제시됐다. 그래도 AI 답변이 갑자기 앞뒤가 맞지 않게 변한다면 그대로 믿지 말고, 새 세션에서 다시 요청한 뒤 결과를 확인해야 한다는 점을 보여준다.
출시 방식과 가격, 유통 경로를 함께 보면 xAI의 경쟁 전략은 네 가지로 정리된다.
결론적으로 Grok 4.6은 모든 작업에서 최고인 모델이라기보다, 실제 서비스에 투입할 에이전트와 개발자 워크플로를 위한 경제적인 프런티어 모델로 포지셔닝되고 있다. 이는 xAI의 제품 설계, 가격과 유통 전략에서 도출되는 해석이며, 모든 실사용 작업에서 경쟁 모델을 능가한다는 증거는 아니다.