Ox Alpha คือรุ่นพรีวิวแบบนิรนามของ GLM 5.3 Flash จาก Z.ai ซึ่งได้รับการยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ไม่ใช่โมเดลจากแล็บปริศนาที่ยังระบุชื่อไม่ได้ โมเดลนี้หยุดสถิติการครองอันดับ 1 ของ DeepSeek บน OpenCode ที่ยาวนาน 56 วันได้ชั่วคราว และมีความต้องการใช้งานพุ่งสูง แต่ผลทดสอบฉบับเต็มทำให้ภาพรวมใกล้เคียง Claude Opus...
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What is the anonymous AI model “Ox Alpha” (or “Niu Lai”), launched quietly on OpenRouter and OpenCode on August 20, 2026 and offered free fo. Article summary: Ox Alpha was a short anonymous “stealth” preview, not a still-unidentified new lab model: Z.ai subsequently identified it as GLM-5.3-Flash, a GLM-family model. Its strong early agentic-coding showing and unusually genero. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
Ox Alpha คือพรีวิวแบบนิรนามของ GLM-5.3-Flash โมเดลในตระกูล GLM จาก Z.ai โดยปรากฏบน OpenRouter และ OpenCode เมื่อวันที่ 20 สิงหาคม 2026 ภายใต้ชื่อผู้ให้บริการว่า “Stealth” พร้อมหน้าต่างบริบทขนาด 1,048,576 โทเคน รองรับอินพุตข้อความ ภาพ และวิดีโอ การเรียกใช้เครื่องมือ และเปิดให้ใช้งานโดยไม่คิดค่าใช้จ่ายในช่วงทดลอง Z.ai ยืนยันภายหลังว่าเคยทดสอบ GLM-5.3-Flash แบบนิรนามในชื่อ ox-alpha ก่อนเปิดตัวโมเดลอย่างเป็นทางการ 110
เรื่องนี้จึงเป็นกรณีศึกษาที่น่าสนใจว่า โมเดล AI สามารถกลายเป็นกระแสในหมู่นักพัฒนาได้ก่อนมีโมเดลการ์ดหรือผลเบนช์มาร์กอย่างเป็นทางการ หากมีทั้งการจัดจำหน่ายที่เข้าถึงง่าย เงื่อนไขการใช้งานที่เอื้อเฟื้อ และความสามารถที่ตอบโจทย์งาน AI Agent
รายการโมเดลนิรนามวางตำแหน่ง Ox Alpha เป็นโมเดลด้านการใช้เหตุผลสำหรับเขียนโค้ด งาน AI Agent ระยะยาว และเวิร์กโหลดระดับโปรดักชัน โดยมีสเปกสำคัญดังนี้
stealth/ox-alphaOpenRouter และ OpenCode ระบุช่วงเวลาให้บริการไม่ตรงกันทั้งหมด โดย OpenRouter ระบุช่วงเวลาสั้นกว่าสำหรับเส้นทางของตน ขณะที่ OpenCode บอกว่าจะเปิดให้ใช้ประมาณหนึ่งสัปดาห์นับจากวันที่ 20 สิงหาคม ดังนั้นกรอบเวลาสิ้นสุดโดยประมาณจึงอยู่ราววันที่ 24–27 สิงหาคม ไม่ใช่วันสิ้นสุดเดียวที่ทุกแพลตฟอร์มยืนยันตรงกัน 2412
บริบทขนาด 1 ล้านโทเคนไม่ได้ทำให้โมเดลเก่งขึ้นโดยอัตโนมัติ แต่ช่วยเปลี่ยนประเภทงานที่นักพัฒนาสามารถทดลองได้ เอเจนต์เขียนโค้ดอาจเก็บข้อมูลรีโพซิทอรี ผลลัพธ์จากเครื่องมือ บันทึกการทำงาน และบริบทภาพไว้ในเซสชันเดียวได้นานขึ้น โดยไม่ต้องสรุปหรือตัดข้อมูลทิ้งซ้ำ ๆ การรองรับวิดีโอยังทำให้ Ox Alpha เหมาะกับการทดสอบอินเทอร์เฟซและงานที่เกินขอบเขตของการสร้างโค้ดจากข้อความเพียงอย่างเดียว 343
จุดดึงดูดในช่วงแรกของ Ox Alpha ไม่ได้มาจากความลึกลับเพียงอย่างเดียว แต่เป็นประโยชน์ที่ทดลองได้จริง นักพัฒนาสามารถลองใช้โมเดลเขียนโค้ดแบบมัลติโมดัลที่มีบริบทยาวมากและเรียกใช้เครื่องมือได้ โดยไม่ต้องเสียค่าโทเคนในช่วงพรีวิว อีกทั้งยังมีโควตาการใช้งานค่อนข้างมาก เงื่อนไขนี้ลดต้นทุนในการทดลอง โดยเฉพาะสำหรับผู้สร้างเอเจนต์ที่กำลังทดสอบการแก้ไขรีโพซิทอรี การโต้ตอบกับเบราว์เซอร์ และงานวิศวกรรมซอฟต์แวร์ที่ดำเนินต่อเนื่องเป็นเวลานาน
กระแสของโมเดลเพิ่มขึ้นอย่างรวดเร็ว Ox Alpha สามารถหยุดสถิติการครองอันดับสูงสุดของ DeepSeek บนการจัดอันดับ OpenCode ที่ยาวนาน 56 วันได้ชั่วคราว และมีรายงานว่าความต้องการใช้งานในวันเดียวพุ่งขึ้นอย่างผิดปกติ อย่างไรก็ตาม ตัวเลขความจุและจำนวนโทเคนขนาดใหญ่มากที่เผยแพร่ระหว่างการเปิดตัวไม่ได้ผ่านการตรวจสอบอย่างเป็นอิสระทั้งหมด จึงควรมองเป็นสัญญาณว่าความสนใจพุ่งสูง มากกว่าจะใช้เป็นตัวเลขวัดขนาดการให้บริการจริงอย่างแม่นยำ 114
ประเด็นนี้สำคัญ เพราะความนิยมระหว่างช่วงทดลองใช้ฟรีสะท้อนหลายปัจจัยพร้อมกัน ทั้งความสามารถ ความใหม่ ราคา และการเข้าถึง ไม่ได้พิสูจน์ด้วยตัวเองว่าโมเดลนั้นดีที่สุดในทุกด้าน
ตัวเลขที่ถูกพูดถึงมากที่สุดในช่วงแรกคือผล 80% บน DeepSWE ซึ่งมาจากการทำภารกิจสำเร็จ 8 รายการจากทั้งหมด 10 รายการ ตัวเลขนี้เป็นสัญญาณที่ดี แต่กลุ่มตัวอย่าง 10 รายการเล็กเกินไปที่จะใช้จัดอันดับโมเดลอย่างมั่นคง ต่อมามีการรายงานผลการประเมินชุดใหญ่ที่ประมาณ 63% ขณะที่ตัวเลขอย่างเป็นทางการภายหลังของ Z.ai สำหรับ GLM-5.3-Flash อยู่ที่ 63.4% บน DeepSWE v1.1 7634
การประเมินแบบรันเต็มชุดอื่นให้ผลต่ำกว่า โดยมีรายงานหนึ่งอยู่ที่ 58.4% จาก 113 ภารกิจ การประเมินดังกล่าวระบุว่าความล้มเหลวจำนวนมากเกี่ยวข้องกับรูปแบบเอาต์พุตและการทำงานของระบบทดสอบ ประเด็นนี้สะท้อนว่าเบนช์มาร์กสำหรับ AI Agent อ่อนไหวต่อการตั้งค่าเครื่องมือ ฮาร์เนส เวลาจำกัด และเกณฑ์ตัดสินความสำเร็จ 4142
ข้อสรุปที่รอบคอบกว่าพาดหัวไวรัลคือ Ox Alpha แสดงความสามารถด้านเอเจนต์เขียนโค้ดในระดับสูง และผลทดสอบบางชุดทำให้โมเดลอยู่ในกลุ่มใกล้เคียงโมเดลปิดชั้นนำ แต่หลักฐานที่มีอยู่ยังไม่พิสูจน์ว่า Ox Alpha เอาชนะ Claude Fable 5 หรือโมเดลแนวหน้าทุกตัวได้อย่างสม่ำเสมอ
การเปรียบเทียบเหล่านั้นใช้ชุดภารกิจ โครงสร้างเอเจนต์ และเงื่อนไขการประเมินแตกต่างกัน ผล 80% จากกลุ่มตัวอย่าง 10 ภารกิจจึงอาจดูโดดเด่นโดยไม่สะท้อนภาพรวมของเบนช์มาร์กทั้งหมด ขณะที่การรันชุดใหญ่ได้ผลใกล้ 63% และการรันเต็มชุดที่ได้ประมาณ 58.4% อาจมีการหักคะแนนเพิ่มเติมจากปัญหารูปแบบเอาต์พุตหรือพฤติกรรมของฮาร์เนส
ต่อมามีรายงานว่าทีม DeepSWE มองความสามารถโดยรวมของโมเดลว่าใกล้เคียง Claude Opus 4.8 มากกว่าเป็นหลักฐานชัดเจนว่าโมเดลเอาชนะ Claude Fable 5 35 ดังนั้นตัวเลขเบนช์มาร์กควรนำเสนอพร้อมขอบเขตและวิธีการทดสอบ ไม่ควรนำคะแนนจากการทดลองคนละรูปแบบมาเปรียบเทียบราวกับเป็นอันดับเดียวกัน
เสียงชื่นชมจากผู้ใช้ที่มีชื่อเสียงสอดคล้องกับลักษณะการใช้งานของโมเดล Patrick Collison ระบุว่า Ox Alpha “น่าประทับใจมาก” หลังทดลองผ่านเอเจนต์ฮาร์เนส ขณะที่ผู้ก่อตั้ง HermesAgent กล่าวว่าโมเดลทำคะแนนเกินมาตรฐานการประเมินภายในของทีมหลายรายการ 3335
ความเห็นเหล่านี้มีความหมายในฐานะประสบการณ์ใช้งานจริง โดยเฉพาะงานเขียนโค้ดและงาน AI Agent แต่ไม่ใช่ข้อสรุปจากการทดสอบควบคุมว่า Ox Alpha เหนือกว่าโมเดลอื่นในทุกเวิร์กโฟลว์ โมเดลหนึ่งอาจใช้งานได้ดีเป็นพิเศษในบริบทใดบริบทหนึ่ง เพราะมีบริบทขนาดใหญ่ พฤติกรรมการเรียกใช้เครื่องมือ ความเร็ว การรองรับหลายโมดัล หรือราคาที่ต่ำ แม้อันดับรวมจากเบนช์มาร์กจะยังไม่แน่นอนก็ตาม
ก่อนการเปิดเผยอย่างเป็นทางการ นักวิจัยพยายามเปรียบเทียบพฤติกรรมที่สังเกตได้ของ Ox Alpha กับโมเดลที่อาจมาจากทีม MiMo ของ Xiaomi, Google DeepMind และ Zhipu AI
Xiaomi ถูกมองว่าเป็นหนึ่งในผู้ต้องสงสัย เพราะทีม MiMo เคยใช้โมเดลนิรนามในชื่อ “Hunter Alpha” มาก่อน แต่รายงานหลายชิ้นชี้ถึงความไม่ตรงกันด้านความสามารถ โมเดล MiMo เชื่อมโยงกับการรองรับเสียง ขณะที่ Ox Alpha รับข้อมูลข้อความ ภาพ และวิดีโอ แต่ไม่รองรับเสียง ทำให้ Xiaomi เป็นสมมติฐานที่น่าสนใจมากกว่าจะเป็นหลักฐานระบุแหล่งที่มา 2229
เบาะแสและโพสต์บนโซเชียลมีเดียที่เกี่ยวข้องกับ Google ทำให้เกิดการคาดเดาเพิ่มเติม แต่ข้อมูลที่มีอยู่ไม่สามารถยืนยันได้ว่า DeepMind เป็นผู้สร้างหรือให้บริการปลายทางดังกล่าว เบาะแสเหล่านั้นยังเป็นเพียงหลักฐานแวดล้อม
หลักฐานก่อนการเปิดตัวที่ชี้ไปยังตระกูล GLM ของ Zhipu มีน้ำหนักมากที่สุด การทดสอบจากชุมชนพบว่าจำนวนโทเคนของ Ox Alpha ตรงกับพฤติกรรมของ GLM-5.3 ในพรอมป์หลากหลายรูปแบบ โดยมีส่วนต่างคงที่ประมาณ 75 โทเคน ซึ่งอาจมาจาก wrapper ที่ระบบเติมเข้ามา นอกจากนี้ การทดสอบวิดีโอแยกชุดยังพบรูปแบบการใช้โทเคนสอดคล้องกับโมเดล GLM ด้านการมองเห็นในหลายลักษณะการเข้ารหัส 1821
เบาะแสอื่นที่ถูกรายงาน ได้แก่
reasoning_effort ที่มีลักษณะคล้ายการตอบกลับจาก GLM APIเบาะแสแต่ละข้ออาจเกิดจากการกำหนดเส้นทาง wrapper โครงสร้างพื้นฐานร่วม หรือการเลียนแบบได้ แต่เมื่อพิจารณารวมกัน ทฤษฎี GLM ก็มีน้ำหนักเพิ่มขึ้นเรื่อย ๆ ถึงกระนั้น เบาะแสเหล่านี้ยังไม่อาจแทนคำยืนยันจากผู้พัฒนาได้ หลักฐานที่ยุติข้อสงสัยคือการที่ Z.ai ระบุว่า Ox Alpha คือ GLM-5.3-Flash และเผยแพร่โมเดลในชื่อดังกล่าว 1043
การเปิดเผยดังกล่าวเปลี่ยน Ox Alpha จากปริศนาเรื่องผู้สร้างให้กลายเป็นพรีวิวผลิตภัณฑ์ Z.ai ระบุว่า GLM-5.3-Flash เป็นโมเดลไฮบริดที่มีพารามิเตอร์รวม 320,000 ล้านพารามิเตอร์ และเปิดใช้งาน 18,000 ล้านพารามิเตอร์ต่อโทเคน พร้อมความสามารถด้านการมองเห็นโดยตรงสำหรับสังเกตอินเทอร์เฟซ ดูผลการเรนเดอร์ และรับข้อมูลป้อนกลับจากการโต้ตอบ ทำให้เกิดวงจรการทำงานต่อเนื่องระหว่างโค้ด เบราว์เซอร์ และ GUI 43
การเปิดตัวในชื่อทางการยังแก้จุดอ่อนสำคัญของปลายทางแบบนิรนาม นั่นคือความไม่แน่นอนว่าโมเดลจะให้บริการต่อเนื่องหรือไม่ โดยมีรายงานว่า GLM-5.3-Flash เปิดตัวภายใต้ MIT License และเผยแพร่น้ำหนักโมเดลให้นักพัฒนาควบคุมการนำไปใช้งานได้มากขึ้น 1950
อย่างไรก็ตาม การมีใบอนุญาตแบบ MIT ไม่ได้หมายความว่าทุกการติดตั้งจะปลอดภัยหรือมีต้นทุนต่ำโดยอัตโนมัติ นักพัฒนายังต้องประเมินข้อกำหนดด้านฮาร์ดแวร์ ประสิทธิภาพการประมวลผล เงื่อนไข API การจัดการข้อมูลส่วนตัว ขีดจำกัดการใช้งาน ความน่าเชื่อถือของการเรียกใช้เครื่องมือ และความสม่ำเสมอของเอาต์พุตให้เหมาะกับงานของตนเอง
ช่วงทดลองใช้ฟรีช่วยสร้างกระแสได้อย่างรวดเร็ว แต่การใช้งานระยะยาวจะขึ้นอยู่กับปัจจัยด้านผลิตภัณฑ์ที่ยั่งยืนกว่าเดิม ได้แก่
บทเรียนสำคัญจาก Ox Alpha จึงไม่ใช่เพียงเรื่องที่โมเดลนิรนามเคยเอาชนะคู่แข่งชื่อดังในช่วงสั้น ๆ แต่คือการที่โมเดลซึ่งออกแบบมาให้ตอบโจทย์เวิร์กโฟลว์ สามารถแพร่กระจายได้อย่างรวดเร็วเมื่อผู้พัฒนาเข้าถึงและทดลองใช้งานได้ในวงกว้าง เรื่องราวจากเบนช์มาร์กมีเงื่อนไขซับซ้อนกว่าพาดหัวแรก ๆ แต่ส่วนผสมของบริบทขนาดใหญ่ ความสามารถหลายโมดัล การใช้เครื่องมือ การเขียนโค้ดแบบเอเจนต์ และราคาที่ต่ำ ก็แข็งแรงพอจะสร้างความสนใจได้จริง
เมื่อยืนยันแล้วว่า Ox Alpha คือ GLM-5.3-Flash บททดสอบต่อไปคือ โมเดลนี้จะยังมีประโยชน์มากแค่ไหนเมื่อความใหม่และการเปิดให้ใช้ฟรีไม่ได้เป็นแรงส่งอีกต่อไป
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
Ox Alpha คือรุ่นพรีวิวแบบนิรนามของ GLM 5.3 Flash จาก Z.ai ซึ่งได้รับการยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ไม่ใช่โมเดลจากแล็บปริศนาที่ยังระบุชื่อไม่ได้
Ox Alpha คือรุ่นพรีวิวแบบนิรนามของ GLM 5.3 Flash จาก Z.ai ซึ่งได้รับการยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ไม่ใช่โมเดลจากแล็บปริศนาที่ยังระบุชื่อไม่ได้ โมเดลนี้หยุดสถิติการครองอันดับ 1 ของ DeepSeek บน OpenCode ที่ยาวนาน 56 วันได้ชั่วคราว และมีความต้องการใช้งานพุ่งสูง แต่ผลทดสอบฉบับเต็มทำให้ภาพรวมใกล้เคียง Claude Opus 4.8 มากกว่าจะเป็นหลักฐานว่าชนะ Claude Fable 5 อย่า...
GLM 5.3 Flash ยังคงจุดเด่นเดิมไว้ ทั้งความสามารถด้านภาพและวิดีโอ สถาปัตยกรรมไฮบริดพารามิเตอร์รวม 320B และเปิดใช้งาน 18B ต่อโทเคน รวมถึงน้ำหนักภายใต้ MIT License ที่เปิดทางให้โฮสต์เองได้หลังช่วงทดลองใช้ฟรีสิ้นสุดลง