Ox Alpha là bản xem trước ẩn danh của GLM 5.3 Flash thuộc Z.ai, được xác nhận ngày 26/8/2026—not một mô hình vẫn chưa rõ nguồn gốc. Mô hình từng chấm dứt chuỗi 56 ngày đứng đầu của DeepSeek trên bảng xếp hạng OpenCode và thu hút nhu cầu đột biến, nhưng các bài kiểm tra đầy đủ đưa kết quả về gần Claude Opus 4.8 hơn l...
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What is the anonymous AI model “Ox Alpha” (or “Niu Lai”), launched quietly on OpenRouter and OpenCode on August 20, 2026 and offered free fo. Article summary: Ox Alpha was a short anonymous “stealth” preview, not a still-unidentified new lab model: Z.ai subsequently identified it as GLM-5.3-Flash, a GLM-family model. Its strong early agentic-coding showing and unusually genero. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
Ox Alpha từng là một bản xem trước ẩn danh trong thời gian ngắn của GLM-5.3-Flash, mô hình thuộc dòng GLM của Z.ai. Mô hình xuất hiện trên OpenRouter và OpenCode ngày 20/8/2026 dưới tên nhà cung cấp “Stealth”, với cửa sổ ngữ cảnh 1.048.576 token, khả năng tiếp nhận văn bản, hình ảnh và video, gọi công cụ, cùng mức giá bằng 0 trong giai đoạn thử nghiệm. Sau đó, Z.ai xác nhận họ đã thử nghiệm GLM-5.3-Flash ẩn danh dưới mã ox-alpha trước khi phát hành phiên bản chính thức. 110
Câu chuyện này đáng chú ý không chỉ vì danh tính của mô hình cuối cùng được giải đáp. Nó còn cho thấy một mô hình AI có thể nhanh chóng trở thành hiện tượng nhờ cách phân phối, quyền truy cập hào phóng và khả năng phục vụ các quy trình làm việc với AI agent—ngay cả trước khi nhà phát triển công bố model card hay bộ benchmark hoàn chỉnh.
Trang niêm yết ẩn danh định vị Ox Alpha là mô hình suy luận dành cho lập trình, các tác vụ agent kéo dài và môi trường sản xuất. Những thông số chính của bản xem trước gồm:
stealth/ox-alphaOpenRouter và OpenCode công bố thời hạn truy cập hơi khác nhau. OpenRouter đề cập một khoảng thời gian ngắn hơn tùy tuyến cung cấp, trong khi OpenCode mô tả thời gian miễn phí kéo dài khoảng một tuần kể từ ngày 20/8. Vì vậy, mốc 24–27/8 nên được hiểu là khoảng thời gian kết thúc tương đối của các tuyến miễn phí, thay vì một ngày kết thúc duy nhất được mọi bên xác nhận. 2412
Cửa sổ ngữ cảnh 1 triệu token không tự động biến một mô hình thành hệ thống tốt hơn. Tuy nhiên, nó mở ra những quy trình mà các mô hình ngữ cảnh ngắn khó xử lý: coding agent có thể giữ lại nhiều phần hơn của kho mã, kết quả gọi công cụ, nhật ký và dữ liệu hình ảnh trong cùng một phiên, thay vì liên tục tóm tắt hoặc loại bỏ thông tin. Khả năng tiếp nhận video cũng khiến Ox Alpha phù hợp với việc kiểm thử giao diện và các tác vụ vượt ra ngoài sinh mã thuần văn bản. 343
Sức hút ban đầu của Ox Alpha mang tính thực dụng hơn là đầu cơ. Nhà phát triển có thể thử một mô hình lập trình đa phương thức, ngữ cảnh dài, hỗ trợ gọi công cụ và không tính phí token. Rào cản thử nghiệm vì thế thấp hơn đáng kể, nhất là với những người xây dựng agent để sửa lỗi trong kho mã, tương tác với trình duyệt hoặc thực hiện các tác vụ kỹ thuật kéo dài.
Mức độ hiện diện của mô hình cũng tăng vọt. Ox Alpha từng tạm thời chấm dứt chuỗi 56 ngày đứng đầu của DeepSeek trên bảng xếp hạng OpenCode, trong khi nhiều báo cáo ghi nhận nhu cầu tăng đột biến trong một ngày. Một số tuyên bố về năng lực hạ tầng và tổng số token được xử lý trong thời điểm ra mắt chưa được kiểm toán độc lập đầy đủ. Do đó, chúng phù hợp hơn với vai trò bằng chứng về mức độ quan tâm rất lớn, thay vì số liệu chính xác về quy mô vận hành. 114
Điểm này rất quan trọng: mức độ phổ biến trong một đợt dùng thử miễn phí phản ánh tổng hòa của năng lực, tính mới lạ, giá cả và khả năng tiếp cận. Nó không tự chứng minh mô hình là hệ thống mạnh nhất nói chung.
Tuyên bố được chia sẻ rộng rãi nhất là kết quả 80% trên DeepSWE, tương ứng 8 nhiệm vụ thành công trong mẫu 10 nhiệm vụ. Đây là tín hiệu tích cực, nhưng 10 nhiệm vụ là quá ít để xác lập một thứ hạng ổn định trên bảng xếp hạng. Một bài đánh giá lớn hơn đưa ra kết quả khoảng 63%, còn con số chính thức sau này của Z.ai dành cho GLM-5.3-Flash là 63,4% trên DeepSWE v1.1. 7634
Một số đánh giá chạy toàn bộ tập nhiệm vụ cho kết quả thấp hơn, trong đó có mức 58,4% trên 113 nhiệm vụ. Bài đánh giá này cho rằng một phần đáng kể thất bại liên quan đến định dạng đầu ra và vấn đề triển khai. Điều đó cho thấy benchmark dành cho AI agent nhạy cảm với cấu hình bộ kiểm thử, quyền truy cập công cụ, giới hạn thời gian và tiêu chí xác định một nhiệm vụ là thành công. 4142
Kết luận thận trọng nhất là: Ox Alpha cho thấy năng lực coding agent mạnh và trong một số đánh giá đạt mức gần các mô hình đóng hàng đầu. Tuy nhiên, dữ liệu hiện có không chứng minh mô hình liên tục vượt qua Claude Fable 5 hoặc mọi mô hình tiên phong khác.
Các con số được tạo ra trong những điều kiện khác nhau: tập nhiệm vụ khác nhau, bộ khung agent khác nhau và cách đánh giá khác nhau. Một mẫu sớm chỉ gồm 10 nhiệm vụ có thể tạo ra kết quả 80% nhưng không đại diện cho toàn bộ benchmark. Một lần chạy lớn hơn cho kết quả gần 63%, còn mức 58,4% có thể bao gồm thêm các hình phạt liên quan đến định dạng hoặc hành vi của bộ khung kiểm thử.
Sau đó, nhóm DeepSWE được cho là đánh giá năng lực tổng thể của mô hình gần với Claude Opus 4.8 hơn, thay vì xem đây là bằng chứng dứt khoát rằng Ox Alpha vượt Claude Fable 5. 35 Vì vậy, các con số benchmark cần luôn đi kèm phạm vi và điều kiện thử nghiệm, thay vì được xem như những điểm số có thể đặt cạnh nhau trên một bảng xếp hạng hoàn toàn đồng nhất.
Sự hào hứng từ các nhà phát triển nổi bật phù hợp với hồ sơ sử dụng của Ox Alpha. Patrick Collison gọi mô hình là “rất ấn tượng” sau khi dùng nó thông qua một bộ khung agent, trong khi nhà sáng lập HermesAgent cho biết kết quả vượt qua nhiều tiêu chuẩn đánh giá nội bộ của đội ngũ. 3335
Những nhận xét này có giá trị như các báo cáo thực tế về mức độ hữu dụng, đặc biệt trong lập trình và tác vụ agent. Tuy nhiên, chúng không tương đương với một kết luận có kiểm soát rằng Ox Alpha vượt trội về mọi mặt. Một mô hình có thể đặc biệt hiệu quả trong một quy trình cụ thể nhờ độ dài ngữ cảnh, cách gọi công cụ, tốc độ, hỗ trợ đa phương thức hoặc chi phí—ngay cả khi vị trí tổng hợp trên các benchmark vẫn chưa chắc chắn.
Trước khi Z.ai công bố, các nhà nghiên cứu so sánh hành vi quan sát được của Ox Alpha với những ứng viên đến từ nhóm MiMo của Xiaomi, Google DeepMind và Zhipu AI.
Xiaomi được xem là một ứng viên có khả năng, một phần vì nhóm MiMo từng thử nghiệm ẩn danh một mô hình có tên “Hunter Alpha”. Tuy nhiên, các báo cáo chỉ ra sự khác biệt về năng lực: những mô hình MiMo được biết đến với khả năng xử lý âm thanh, trong khi Ox Alpha hỗ trợ văn bản, hình ảnh và video nhưng không nhận đầu vào âm thanh. Xiaomi vì thế là một giả thuyết đáng xem xét, chứ chưa phải bằng chứng quy kết mạnh. 2229
Một số gợi ý liên quan đến Google và các bài đăng trên mạng xã hội tiếp tục làm dấy lên suy đoán. Dù vậy, những manh mối này không xác lập được rằng DeepMind xây dựng hoặc vận hành endpoint. Chúng vẫn chỉ mang tính gián tiếp.
Trước thời điểm công bố chính thức, lập luận mạnh nhất hướng về dòng GLM của Zhipu. Các thử nghiệm cộng đồng cho biết số token của Ox Alpha trùng với hành vi của GLM-5.3 trên nhiều loại prompt, ngoại trừ một phần chênh lệch cố định khoảng 75 token—có thể đến từ lớp bao bọc hoặc chỉ dẫn hệ thống được thêm vào. Các thử nghiệm video độc lập cũng ghi nhận cách tiêu thụ token tương đồng với những mô hình thị giác GLM qua nhiều đặc điểm mã hóa. 1821
Những dấu hiệu khác được báo cáo gồm:
reasoning_effort có nét tương tự phản hồi từ API GLM;Từng manh mối riêng lẻ vẫn có thể xuất phát từ hệ thống định tuyến, lớp wrapper, hạ tầng dùng chung hoặc việc bắt chước hành vi. Khi kết hợp lại, giả thuyết GLM trở nên thuyết phục hơn, nhưng vẫn chưa thể thay thế tuyên bố chính thức. Bằng chứng quyết định chỉ xuất hiện khi Z.ai xác định Ox Alpha là GLM-5.3-Flash và công bố phiên bản mang tên chính thức. 1043
Thông báo của Z.ai biến Ox Alpha từ một bí ẩn về nguồn gốc thành bản xem trước sản phẩm. Tài liệu của Z.ai mô tả GLM-5.3-Flash là mô hình lai có 320 tỷ tham số tổng cộng và 18 tỷ tham số được kích hoạt, đồng thời sở hữu khả năng thị giác gốc để quan sát giao diện, kết quả hiển thị và phản hồi tương tác. Điều này tạo ra một vòng lặp khép kín giữa mã nguồn, trình duyệt và giao diện đồ họa. 43
Phiên bản chính thức cũng giải quyết điểm yếu lớn nhất của một endpoint ẩn danh: sự không chắc chắn về tính liên tục. Các báo cáo cho biết GLM-5.3-Flash được phát hành theo giấy phép MIT, với trọng số được cung cấp cho những nhà phát triển muốn chủ động hơn trong việc triển khai. 1950
Tuy nhiên, giấy phép mở không có nghĩa mọi triển khai đều tự động an toàn hoặc rẻ. Đội ngũ kỹ thuật vẫn cần đánh giá yêu cầu phần cứng, hiệu năng suy luận, điều khoản API, cách xử lý dữ liệu riêng tư, giới hạn tốc độ, độ tin cậy khi gọi công cụ và tính nhất quán của đầu ra đối với từng quy trình cụ thể.
Bản xem trước miễn phí đã tạo ra sự chú ý, nhưng việc sử dụng lâu dài sẽ phụ thuộc vào những yếu tố bền vững hơn:
Bài học trung tâm từ Ox Alpha không đơn giản là một mô hình ẩn danh từng vượt qua một đối thủ nổi tiếng. Điều đáng nói hơn là một mô hình được thiết kế đúng cho quy trình làm việc có thể lan truyền rất nhanh khi nhà phát triển được phép thử nghiệm ở quy mô lớn.
Câu chuyện benchmark cuối cùng có nhiều điều kiện hơn những tiêu đề lan truyền ban đầu, nhưng sự kết hợp giữa ngữ cảnh dài, đa phương thức, gọi công cụ, lập trình theo hướng agent và quyền truy cập chi phí thấp vẫn đủ mạnh để thu hút sự chú ý. Giờ đây, khi danh tính đã được xác định là GLM-5.3-Flash, bài kiểm tra thực sự là liệu mô hình có còn hữu ích khi yếu tố mới lạ và quyền truy cập miễn phí không còn tạo đà hay không.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Ox Alpha là bản xem trước ẩn danh của GLM 5.3 Flash thuộc Z.ai, được xác nhận ngày 26/8/2026—not một mô hình vẫn chưa rõ nguồn gốc.
Ox Alpha là bản xem trước ẩn danh của GLM 5.3 Flash thuộc Z.ai, được xác nhận ngày 26/8/2026—not một mô hình vẫn chưa rõ nguồn gốc. Mô hình từng chấm dứt chuỗi 56 ngày đứng đầu của DeepSeek trên bảng xếp hạng OpenCode và thu hút nhu cầu đột biến, nhưng các bài kiểm tra đầy đủ đưa kết quả về gần Claude Opus 4.8 hơn là chứng minh ưu thế tuyệt đối.
GLM 5.3 Flash giữ lại lợi thế cốt lõi với khả năng xử lý hình ảnh và video, kiến trúc lai 320 tỷ tham số tổng cộng/18 tỷ tham số kích hoạt cùng giấy phép MIT, cho phép các nhà phát triển tự triển khai sau khi các tuyế...