grok-build-0.1 thay thế endpoint API grok-code-fast-1 cũ Phiên bản 1.0 chủ yếu là một cột mốc về độ ổn định và sự trưởng thành, chứ không phải là một nâng cấp mô hình. Mô hình nền grok-build-0.1 vẫn giữ nguyên từ bản beta . Các cải tiến chính trong bản V1.0 bao gồm:
Các khả năng được giữ lại từ bản beta vẫn là cốt lõi của V1.0:
grok-build-0.1 (dựa trên kiến trúc Grok 4.x) grok-code-fast-1; điểm chuẩn riêng cho mô hình hiện tại chưa được công bố) Grok Build V1.0 bước vào một cuộc đua khốc liệt, nơi nó thua kém về điểm benchmark thô nhưng lại có những lợi thế kiến trúc độc đáo:
| Tính năng | Grok Build V1.0 | Claude Code | Codex CLI |
|---|---|---|---|
| Nhà phát triển | xAI | Anthropic | OpenAI |
| Mô hình mặc định | grok-build-0.1 (Grok 4.x) | Claude Opus 4.7 / Sonnet 4.6 | GPT-5.5 |
| Cửa sổ ngữ cảnh | 256K | 200K (1M trên Opus 4.7) | 200K–1M |
| Kiến trúc đa tác tử | Tối đa 8 tác tử phụ song song, mỗi tác tử có worktree riêng | Tác tử phụ theo tác vụ | Công cụ tác vụ phụ |
| Plan Mode | ✅ | ✅ (Shift+Tab) | ✅ |
| SWE-Bench Verified | 70,8% | 87,6% | 88,7% |
| Giá API (đầu vào) | ~1 USD/1M token | Cao hơn (mô hình tiên tiến) | Khác nhau |
| Giá khởi điểm | Đi kèm với SuperGrok / X Premium+ | Đi kèm với Claude Pro (20 USD/tháng) | Đi kèm gói ChatGPT |
| Khác biệt nổi bật | Đa tác tử song song + Arena Mode; API rẻ nhất cho coding | Thực thi theo kế hoạch rõ ràng nhất; tái cấu trúc đa tệp sâu | Agent đánh giá tích hợp; sandbox-first; backbone đa phương thức |
Kết luận: Grok Build thua kém về điểm benchmark thô (70,8% so với ~88% của đối thủ) nhưng cạnh tranh nhờ giá cả (~1/2 USD mỗi triệu token so với các mô hình tiên tiến đắt đỏ hơn) và kiến trúc đa tác tử song song (tối đa 8 agent đồng thời) . Các nhà đánh giá cho rằng nó phù hợp nhất với các nhà phát triển đã ở trong hệ sinh thái xAI (SuperGrok/X Premium+), trong khi Claude Code được ưa chuộng cho các tác vụ tái cấu trúc phức tạp và Codex CLI cho các quy trình làm việc sandbox-first
.
Chiến lược ra mắt kép này vận hành như sau:
Lưu ý quan trọng: Tất cả thông tin về Grok 4.6/4.7 đều đến từ một bài trả lời duy nhất của Elon Musk trên X; chưa có model card chính thức hay benchmark từ bên thứ ba nào được công bố
.