Ngày 14/9, Musk cho biết Grok 4.8 có 2,5 nghìn tỷ tham số sẽ hoàn tất tiền huấn luyện trong tuần rồi chuyển sang học tăng cường (RL); Grok 5 được ông nêu là ứng viên AGI của xAI. Musk đánh giá Grok 4.7, vốn đang bị lùi lịch, ở mức xấp xỉ Opus 5.0 của Anthropic chứ không phải Opus 5.1; ông cũng thừa nhận năng lực đa...
Đăng bởiBiên tập bằng GPT-5.6 TerraHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did Elon Musk claim on September 14 about xAI’s roadmap toward artificial general intelligence—specifically, that the 2.5-trillion-para. Article summary: Musk’s September 14 roadmap was an aspirational sequence, not a substantiated AGI forecast: Grok 4.8, a claimed 2.5-trillion-parameter model using a new C++ training stack, would finish pretraining that week and then ent. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Ngày 14/9, Elon Musk phác ra một chuỗi mô hình Grok chưa phát hành của xAI: Grok 4.8 sẽ hoàn tất tiền huấn luyện trong tuần và bước sang giai đoạn học tăng cường (reinforcement learning — RL), còn Grok 5 được ông đặt vào vị trí mô hình có thể tiến tới trí tuệ nhân tạo tổng quát, hay AGI. Nhưng đây chưa phải là bằng chứng Grok đã đạt AGI: thông báo không đi kèm kết quả benchmark công khai, model card, định nghĩa vận hành cho AGI hoặc ngày phát hành. Vì vậy, nên xem đây là dự báo của nhà sáng lập, không phải kết quả AGI đã được chứng minh. 1
2
4
Theo Musk, Grok 4.8 là mô hình 2,5 nghìn tỷ tham số, được huấn luyện trên nền tảng phần mềm C++ mới của xAI. Ông nói giai đoạn tiền huấn luyện sẽ kết thúc trong tuần, sau đó bắt đầu RL. 1
2
Trong cùng trao đổi, Musk xếp các mẫu sau Grok 4.7 theo một nấc thang năng lực:
Cách diễn đạt này rất đáng lưu ý. “Có thể tốt hơn mọi thứ khác” không phải một tuyên bố hiệu năng có thể đo lường. Cũng chưa có thông tin nào nêu rõ những năng lực, ngưỡng độ tin cậy, mức tự chủ, tiêu chuẩn an toàn hay bộ đánh giá nào sẽ đủ để gọi một mô hình là AGI. Một số bài viết gọi Grok 5 là bước đột phá AGI mà xAI tuyên bố, nhưng lộ trình ban đầu vẫn thiếu các chi tiết có thể kiểm tra độc lập. 2
10
Với Grok 4.7 — mẫu gần thời điểm phát hành hơn nhưng đã trễ — Musk thận trọng hơn. Ông nói mô hình này sẽ “xấp xỉ ngang Opus 5.0, không phải 5.1”, tốt hơn ở một số mặt và kém hơn ở những mặt khác. Musk cũng thừa nhận xAI vẫn cần cải thiện khả năng đa phương thức, tức xử lý kết hợp văn bản, hình ảnh và các dạng dữ liệu khác. 3
8
Đây là nhận định hẹp hơn nhiều so với tuyên bố dẫn đầu toàn diện. Đồng thời, lộ trình 4.8, 4.9 và 5 vẫn mang tính tạm thời, bởi các nhà phát triển khi đó còn chưa có Grok 4.7 phát hành công khai để tự đánh giá.
Ngày 2/9, Musk từng nói Grok 4.7 còn khoảng 10 ngày nữa sẽ ra mắt, tức gợi ra mốc khoảng 12/9. Đến ngày 11/9, ông nói cần “thêm vài ngày”. 7
20
Lý do ông nêu liên quan đến tinh chỉnh RL: xAI có thể đã phạt độ dài câu trả lời quá mạnh, khiến mô hình dừng sớm trước các bài toán khó mà thực ra nó có thể giải, đồng thời tự kiểm tra kết quả chưa đủ kỹ. Musk trình bày đây như một khả năng chẩn đoán, không phải kết luận kỹ thuật cuối cùng. 20
21
Điều này không chỉ là câu chuyện chậm lịch. Nó cho thấy sự khác biệt giữa hoàn tất một đợt tiền huấn luyện quy mô lớn và đưa ra thị trường một sản phẩm đáng tin cậy. Hành vi sau huấn luyện bằng RL, đánh giá chất lượng, năng lực đa phương thức, độ ổn định, an toàn, mức sẵn sàng triển khai và giá đều có thể quyết định thời điểm — thậm chí việc — một mô hình được phát hành.
Tính đến ngày 14/9, Grok 4.7 vẫn chưa được phát hành công khai. Các báo cáo cho biết mẫu flagship được xAI ghi nhận gần nhất vẫn là Grok 4.6, ra mắt ngày 12/8, với giá API niêm yết 2 USD cho một triệu token đầu vào và 6 USD cho một triệu token đầu ra. 3
11
Cùng thời điểm, Claude Fable 5.1, Gemini 3.8 Flash và GPT-6 Astra được đưa tin là đã phát hành hoặc công bố trong tháng 9. 34
45 Bối cảnh cạnh tranh này làm lộ trình của xAI đáng chú ý hơn, nhưng không thể xác thực các tuyên bố so sánh hiệu năng cho những Grok chưa phát hành.
Quy mô 2,5 nghìn tỷ tham số và nền tảng huấn luyện mới có thể phản ánh khoản đầu tư hạ tầng lớn của xAI. Tuy vậy, số tham số hay năng lực tính toán, xét riêng lẻ, không chứng minh năng lực thực tế, độ tin cậy hoặc AGI. Việc Grok 4.7 trễ lịch là minh họa cụ thể rằng hành vi sau huấn luyện có thể mang tính quyết định, kể cả khi một mô hình đã được huấn luyện xong. 1
20
Với nhà phát triển, khách hàng và nhà đầu tư, các mốc nên chờ đợi cụ thể hơn ngôn ngữ lộ trình:
Cho tới khi các tài liệu này xuất hiện, phát biểu ngày 14/9 của Musk mới xác lập hướng đi mà xAI nhắm tới: Grok 4.8 sau tiền huấn luyện và RL, Grok 4.9 mạnh hơn, rồi Grok 5 với tham vọng rất lớn. Chúng chưa xác lập rằng bất kỳ mô hình nào trong số đó đã đạt mức năng lực được hứa hẹn. 2
4
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Ngày 14/9, Musk cho biết Grok 4.8 có 2,5 nghìn tỷ tham số sẽ hoàn tất tiền huấn luyện trong tuần rồi chuyển sang học tăng cường (RL); Grok 5 được ông nêu là ứng viên AGI của xAI.
Ngày 14/9, Musk cho biết Grok 4.8 có 2,5 nghìn tỷ tham số sẽ hoàn tất tiền huấn luyện trong tuần rồi chuyển sang học tăng cường (RL); Grok 5 được ông nêu là ứng viên AGI của xAI. Musk đánh giá Grok 4.7, vốn đang bị lùi lịch, ở mức xấp xỉ Opus 5.0 của Anthropic chứ không phải Opus 5.1; ông cũng thừa nhận năng lực đa phương thức vẫn cần cải thiện.
Việc Grok 4.7 không kịp mốc khoảng 12/9 cho thấy quy mô mô hình và quá trình huấn luyện trước không tự động đồng nghĩa với sản phẩm sẵn sàng phát hành hoặc đạt một mức năng lực đã hứa hẹn.