Reflection AI công bố Beam vào ngày 5/10/2026, mô hình mở trọng số đầu tiên của công ty, nhắm tới lập trình, suy luận phức tạp và các tác vụ AI agent — tức những công việc trong đó mô hình có thể dùng công cụ và thực hiện nhiều bước để hoàn thành mục tiêu. Reflection định vị Beam là lựa chọn dành cho doanh nghiệp và cơ quan công quyền muốn chủ động hơn trong việc triển khai, vận hành và điều chỉnh hệ thống AI.
4
5
18
Động thái này đưa Beam vào cuộc cạnh tranh với các mô hình từ DeepSeek, nhóm Qwen của Alibaba và Z.ai. Nhưng việc ra mắt một đối thủ mới không đồng nghĩa Beam đã vượt qua các mô hình Trung Quốc: phần lớn bằng chứng về hiệu năng hiện nay vẫn đến từ chính Reflection.
4
7
13
Mô hình lớn, nhưng chỉ kích hoạt một phần tham số
Beam sử dụng kiến trúc hỗn hợp chuyên gia thưa (sparse mixture-of-experts): mô hình có tổng cộng 501 tỷ tham số, nhưng chỉ khoảng 23 tỷ tham số được kích hoạt để xử lý mỗi token. Reflection cho biết Beam được tiền huấn luyện trên 23,8 nghìn tỷ token và có cửa sổ ngữ cảnh tối đa 1 triệu token.
7
18
Theo công ty, một đợt huấn luyện tăng cường kéo dài bốn tuần sử dụng 10.500 GPU Nvidia GB300 và tạo ra hơn 100 triệu lượt thử tác vụ, hay “rollout”. Đây là các số liệu do Reflection công bố.
18
Các tuyên bố hiệu năng cần được kiểm chứng
Reflection cho biết Beam đạt điểm 80,1 trên Terminal Bench v2.1, 80,9 trên SWE-Bench Verified và 90,5 trên GPQA Diamond. Công ty mô tả kết quả suy luận nâng cao của Beam là tương đương với GLM-5.2 của Z.ai, đồng thời đưa ra so sánh với Qwen 3.8-Max của Alibaba, Kimi K3 và các mô hình mở hàng đầu ở phương Tây. Những so sánh này phản ánh đánh giá của Reflection, không phải bảng xếp hạng đã được xác nhận độc lập.
3
7
13
Tuyên bố đáng chú ý nhất của công ty là Beam có thể đạt hiệu năng tương đương với mức tài nguyên tính toán khi suy luận thấp hơn khoảng 3–4 lần. Tuy nhiên, đây là ước tính và không tính phần xử lý đầu vào (prompt prefill) hoặc chi phí vận hành hệ thống phục vụ mô hình. TechCrunch lưu ý rằng các tuyên bố hiệu năng chưa được xác minh độc lập; vì vậy, chưa thể xem mức tiết kiệm tài nguyên này là khoản giảm chi phí đã được chứng minh trong triển khai thực tế.
7
13
Nói cách khác, Beam đánh dấu thêm một đối thủ Mỹ trong nhóm mô hình mở trọng số, nhưng các dữ liệu hiện có chưa chứng minh mô hình dẫn đầu toàn diện trước các đối thủ Trung Quốc.
13
Kế hoạch phát hành và những câu hỏi còn bỏ ngỏ
Khi công bố Beam, Reflection cho biết mô hình vẫn đang trải qua các vòng kiểm thử an toàn (red-teaming) và đánh giá cuối cùng. Một số người dùng được chọn có thể đăng ký danh sách chờ để xin quyền truy cập sớm. Công ty dự kiến phát hành trọng số theo giấy phép Apache 2.0 vào cuối tháng 10, kèm báo cáo kỹ thuật, thẻ mô hình và tài liệu dành cho nhà phát triển.
18
25
28
Tại thời điểm công bố, việc phát hành công khai trọng số vẫn là kế hoạch, chưa phải bước đã hoàn tất. Khi có thể tải và chạy mô hình cùng các tài liệu đi kèm, nhà phát triển mới có điều kiện đánh giá trực tiếp hơn về hiệu năng, chi phí triển khai và vị trí của Beam so với các đối thủ.