Grok 4.5 bắt đầu giai đoạn beta nội bộ tại SpaceX và Tesla vào ngày 28/6/2026, được hỗ trợ bởi mô hình nền tảng V9 với 1,5 nghìn tỷ tham số, hoàn thành tiền huấn luyện vào ngày 26/5/2026 . Mô hình này có sẵn qua API xAI từ ngày 8/7 với giá $2/1 triệu token đầu vào và $6/1 triệu token đầu ra . Grok 4.6 là bước nhảy vọt với mức tăng 33% tham số so với người tiền nhiệm, từ 1,5T lên 2T .
| Thông số | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Số tham số | 1,5 nghìn tỷ | 2 nghìn tỷ |
| Mô hình nền tảng | V9 (hoàn tất huấn luyện 26/5/2026) | Thế hệ mới (kiến trúc chưa được tiết lộ) |
| Trạng thái | Beta nội bộ tại SpaceX & Tesla từ 28/6; API ra mắt 8/7 | Huấn luyện kết thúc trong tuần này; ra mắt vào tháng 8 |
| Giá API | $2/1M token đầu vào, $6/1M token đầu ra | Chưa công bố |
| Hiệu suất được báo cáo | Tự báo cáo là ngang bằng/vượt Claude Opus; chưa có điểm chuẩn độc lập | Tuyên bố vượt xa Grok 4.5; đặt mục tiêu vượt qua Kimi K3 |
Một lưu ý quan trọng: Không có điểm chuẩn độc lập nào từ bên thứ ba được công bố cho Grok 4.5 – tất cả các tuyên bố về hiệu suất đều là của chính xAI . Một kỹ sư của xAI lưu ý rằng Grok 4.5 sử dụng dữ liệu bổ sung "Cursor" (dữ liệu tập trung vào lập trình) không có trong giai đoạn huấn luyện ban đầu, và điều này "không tốt bằng việc đưa nó vào huấn luyện ngay từ đầu" .
Thời điểm Musk đưa ra thông báo có liên quan trực tiếp đến việc Moonshot AI ra mắt Kimi K3 vào ngày 16/7/2026 . Kimi K3 là mô hình Hỗn hợp chuyên gia (MoE) mã nguồn mở với 2,8 nghìn tỷ tham số, sở hữu cửa sổ ngữ cảnh 1 triệu token và khả năng xử lý hình ảnh gốc. Đây là mô hình mã nguồn mở lớn nhất từng được phát hành và là mô hình đầu tiên thuộc "lớp 3 nghìn tỷ tham số" . Mỗi token, mô hình chỉ kích hoạt 16 trong số 896 chuyên gia, một thiết kế giúp giảm chi phí tính toán .
Các bài đăng của Musk công khai định vị Grok 4.6 là đòn đáp trả, với mục tiêu là vượt qua Kimi K3 về hiệu suất trong khi vẫn duy trì lợi thế về tốc độ và hiệu quả của Grok . Với 2 nghìn tỷ tham số, Grok 4.6 nhỏ hơn Kimi K3 (2,8 nghìn tỷ), vì vậy xAI đang đặt cược vào hiệu quả kiến trúc và tối ưu hóa suy luận thay vì chỉ dựa vào số lượng tham số thô .
Đây là điểm quan trọng: Grok 4.5 không có điểm chuẩn độc lập nào. Tất cả các tuyên bố về khả năng cạnh tranh của nó đều do chính xAI tự công bố. Ngược lại, Kimi K3 đã được đánh giá độc lập và xếp hạng #3 toàn cầu trên các bảng xếp hạng tổng hợp, chỉ đứng sau Anthropic Claude Fable 5 và OpenAI GPT-5.6 Sol . Mô hình này được mô tả là "cạnh tranh sòng phẳng với các hệ thống độc quyền mạnh nhất từ các đối thủ Mỹ" . K3 thậm chí còn vượt trội hơn Claude Fable 5 trong một số điểm chuẩn về lập trình và phát triển web .
Về giá API, Kimi K3 được báo cáo là rẻ hơn khoảng một nửa so với các mô hình tiên tiến khác như Claude Fable 5 và GPT-5.6 Sol .
Kết luận chính: Không có so sánh trực tiếp nào giữa bất kỳ mô hình Grok nào với Kimi K3 dựa trên các điểm chuẩn độc lập. Tất cả các tuyên bố về hiệu suất của xAI đều chưa được xác minh .
Thông báo ngày 18/7 của Musk nằm trong một kế hoạch lớn hơn nhiều. Dưới đây là những cam kết công khai của xAI:
Song song với cuộc đua mô hình, xAI đã mã nguồn mở Grok Build vào ngày 15-16/7/2026 theo giấy phép Apache 2.0, công bố tác nhân lập trình CLI viết bằng Rust của mình trên GitHub tại xai-org/grok-build . Grok Build có 8 tác nhân phụ song song, quy trình ưu tiên lập kế hoạch và Chế độ Arena. Việc mã nguồn mở diễn ra sau một vụ bê bối về quyền riêng tư: các nhà nghiên cứu bảo mật phát hiện ra rằng một phiên bản trước đó đã tải lên toàn bộ thư mục làm việc của người dùng lên máy chủ của xAI . Bằng cách mở mã nguồn, xAI muốn xây dựng lại lòng tin và thúc đẩy sự chấp nhận của cộng đồng.
Musk xác nhận riêng vào ngày 8/7 rằng xAI đang thực hiện các cải tiến hàng ngày cho Grok Build dựa trên phản hồi của người dùng . Điều này định vị xAI để thách thức trực tiếp các tác nhân lập trình hiện có như Cursor và GitHub Copilot.
Thông báo về Grok 4.6 vào ngày 18/7 của Musk là một đòn đáp trả cạnh tranh rõ ràng nhắm vào việc ra mắt Kimi K3 của Moonshot chỉ hai ngày trước đó. Nhịp độ phát hành mô hình hàng tháng của xAI nhanh hơn bất kỳ phòng thí nghiệm tiên tiến nào khác, và lộ trình Grok 5 báo hiệu những mô hình lớn hơn nhiều ở phía trước. Nhưng việc thiếu các điểm chuẩn độc lập cho bất kỳ mô hình xAI nào có nghĩa là tất cả các tuyên bố về khả năng cạnh tranh vẫn chưa được xác minh cho đến khi có kết quả kiểm tra từ bên thứ ba. Trong một cuộc đua mà sự minh bạch cũng quan trọng như quy mô, khoảng cách đó là một yếu tố đáng kể.