Reflection AI công bố Beam ngày 5/10/2026, đánh dấu mô hình trọng số mở đầu tiên của công ty. Đây là hệ thống chỉ xử lý văn bản, hướng tới lập trình, suy luận và các tác vụ AI agent. Reflection định vị Beam như một lựa chọn thay thế cho những mô hình mở hàng đầu từ Trung Quốc và phương Tây. Tuy vậy, các so sánh nổi bật về hiệu năng và hiệu quả tính toán vẫn nên được xem là tuyên bố của công ty cho đến khi trọng số và chi tiết đánh giá được kiểm tra độc lập.
3
7
13
Kiến trúc, quá trình huấn luyện và cửa sổ ngữ cảnh
Beam dùng kiến trúc hỗn hợp chuyên gia thưa (sparse mixture-of-experts): mô hình có tổng cộng 501 tỷ tham số nhưng chỉ khoảng 23 tỷ tham số hoạt động khi xử lý mỗi token. Reflection cho biết hãng tiền huấn luyện Beam trên 23,8 nghìn tỷ token, sau đó sử dụng học tăng cường với lượng tính toán lớn; theo công bố của công ty, đợt huấn luyện này tạo ra hơn 100 triệu lượt chạy thử (rollout).
14
Reflection công bố cửa sổ ngữ cảnh của Beam có thể lên tới 1 triệu token. Tuy nhiên, một số tin bài về giao diện beta ban đầu ghi nhận giới hạn 256.000 token. Vì vậy, thông số ngữ cảnh được công bố cho mô hình và giới hạn người dùng có thể tiếp cận qua một dịch vụ cụ thể có thể khác nhau; thông tin hiện có chưa xác nhận giới hạn beta áp dụng cho mọi hình thức triển khai.
3
7
17
18
Các so sánh benchmark cho thấy điều gì?
Reflection báo cáo Beam đạt 80,9% trong bài SWE-bench Verified. Trong một so sánh riêng trên Terminal-Bench v2.1, Beam đạt 80,1 điểm, thấp hơn GLM-5.2 với 81,0, Kimi K3 với 88,3 và DeepSeek V4.1 Flash với 90,6. Kết quả này cho thấy Beam có thể cạnh tranh ở một số tác vụ, nhưng chưa đủ để khẳng định mô hình vượt trội so với các mô hình mở hàng đầu của Trung Quốc hoặc phương Tây nói chung.
12
20
Reflection cũng cho biết Beam đạt mức suy luận tương đương GLM-5.2 trên một số benchmark được lựa chọn. Công ty ước tính lượng tính toán cần cho việc tạo sinh của Beam thấp hơn khoảng 3–4 lần so với GLM-5.2, và thấp hơn hơn 4 lần so với các mô hình mở hàng đầu của phương Tây trong những phép so sánh của hãng. Đây là các ước tính, không phải phép đo độc lập chứng minh mọi người dùng đều sẽ thấy chi phí phục vụ hoặc độ trễ giảm tương ứng.
13
16
Trọng số của Beam chưa được phát hành để các bên độc lập kiểm tra, vì vậy nên xem kết quả benchmark và so sánh tính toán là thông tin ban đầu. Khác biệt về cách thiết lập đánh giá và điều kiện vận hành có thể ảnh hưởng tới kết quả; riêng các con số được công bố chưa cho biết Beam sẽ hoạt động ra sao trên những tác vụ hoặc môi trường triển khai khác.
7
13
Kế hoạch phát hành và cách tiếp cận
Reflection dự kiến phát hành trọng số Beam theo giấy phép Apache 2.0 vào cuối tháng 10/2026, nhưng các nguồn hiện có chưa nêu ngày cụ thể. Người dùng có thể đăng ký danh sách chờ để xin quyền truy cập sớm. Các tin bài cũng đề cập kế hoạch phát hành tài liệu hỗ trợ, gồm báo cáo kỹ thuật và thẻ mô hình (model card); trước khi những tài liệu này được công bố, phạm vi cụ thể của đợt phát hành vẫn chưa rõ.
2
3
21
Trọng số mở cho phép nhà phát triển chạy và điều chỉnh mô hình được phát hành. Nhưng điều đó không đồng nghĩa Beam đã được xác minh là hệ thống sẵn sàng triển khai cho mọi tổ chức. Mô hình hướng tới nhà phát triển, doanh nghiệp và khu vực công; các thông tin về đợt ra mắt hiện chưa xác nhận một cơ quan cụ thể đã triển khai Beam, hay mô hình đã được tùy chỉnh trên dữ liệu riêng của một tổ chức.
1
5
31
Beam trong chiến lược của Reflection AI
Việc ra mắt Beam đi cùng một kế hoạch đầu tư hạ tầng tính toán quy mô lớn. Các tin bài đề cập thỏa thuận trị giá 6,3 tỷ USD với SpaceX liên quan đến hệ thống Nvidia GB300, cùng một thỏa thuận năng lực tính toán riêng với Nebius. Những thỏa thuận này cho thấy quy mô hạ tầng gắn với tham vọng của Reflection, nhưng tự chúng không xác nhận hiệu năng của Beam hay mức tiết kiệm suy luận mà công ty ước tính.
4
8
Ở thời điểm hiện tại, cách đánh giá thận trọng nhất là tách thông số đã công bố khỏi những so sánh chưa được xác minh: kiến trúc, quy mô huấn luyện và nhóm tác vụ mục tiêu đã được nêu, còn hiệu năng tương đối trên benchmark và hiệu quả trong sử dụng thực tế vẫn cần chờ kiểm tra khi trọng số cùng tài liệu đánh giá đầy đủ được phát hành.
7
13
14