Zhipu AI ยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ว่าโมเดลนิรนาม Ox Alpha หรือ “Niu Lai” คือ GLM 5.3 Flash โมเดลโอเพนเวตแบบมัลติโมดัลและ Mixture of Experts [1][4][6] การเปิดให้ทดลองฟรีแบบไม่เปิดเผยชื่อบน OpenRouter และ OpenCode มียอดใช้งานมากกว่า 50 ล้านล้านโทเค็นภายใน 5 วัน และมีรายงานว่าสูงกว่า 60 ล้านล้านโทเค็นใน 6 วัน...
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What did Zhipu AI reveal on August 26, 2026, about the anonymous “Ox Alpha” model known as “Niu Lai,” including its identity as GLM 5.3 Flas. Article summary: On August 26, Zhipu AI (Z.ai) disclosed that the anonymous “Ox Alpha”/“Niu Lai” model was its GLM 5.3 Flash: an open weight, native multimodal mixture of experts model tested anonymously before release.. Topic tags: general web, ai, productivity, code, api. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, cl
เมื่อวันที่ 26 สิงหาคม 2026 Zhipu AI หรือ Z.ai บริษัทผู้พัฒนาโมเดลตระกูล GLM จากจีน เปิดเผยว่าโมเดลปริศนาที่ใช้ชื่อ Ox Alpha และชื่อจีนว่า “Niu Lai” คือ GLM-5.3-Flash ซึ่งเป็นโมเดลแบบโอเพนเวต (open-weight) รองรับข้อมูลหลายรูปแบบตั้งแต่ต้น และใช้สถาปัตยกรรม Mixture of Experts (MoE) โดยก่อนหน้านี้บริษัทนำโมเดลไปทดสอบแบบไม่เปิดเผยตัวตนก่อนการเปิดตัวอย่างเป็นทางการ 1
4
6
Ox Alpha เปิดให้ใช้งานฟรีบน OpenRouter แพลตฟอร์มรวมโมเดล AI และ OpenCode ซึ่งเป็นแพลตฟอร์มที่นักพัฒนาใช้สร้างเอเจนต์และเครื่องมือเขียนโค้ด การทดสอบแบบไม่เปิดเผยชื่อดึงดูดการใช้งานอย่างรวดเร็ว โดยมีรายงานว่ายอดรวมทะลุ 50 ล้านล้านโทเค็นภายใน 5 วัน และเพิ่มเป็นมากกว่า 60 ล้านล้านโทเค็นใน 6 วัน พร้อมขึ้นเป็นโมเดลที่มีการใช้งานสูงสุดบนทั้งสองแพลตฟอร์ม 3
รายงานบางส่วนระบุว่า ในช่วงพีก ปริมาณการใช้งานของ Ox Alpha สูงกว่าโมเดล DeepSeek ที่นำมาเปรียบเทียบมากกว่าสองเท่า อย่างไรก็ตาม ตัวเลขดังกล่าวเป็นสถิติการใช้งานบนแพลตฟอร์ม ไม่ใช่หลักฐานว่าตัวโมเดลมีประสิทธิภาพเหนือกว่าในทุกการทดสอบหรือทุกงานจริง 1
3
จุดสำคัญที่สุดของการเปิดเผยครั้งนี้คือ Zhipu ระบุว่า การให้บริการ Ox Alpha ในช่วงทดสอบดำเนินการทั้งหมดบนคลัสเตอร์ที่มีชิปผลิตในจีนมากกว่า 100,000 ชิ้น บริษัทอ้างว่า หลังปรับปรุงซอฟต์แวร์และระบบให้เหมาะกับฮาร์ดแวร์แล้ว ประสิทธิภาพของฮาร์ดแวร์และต้นทุนต่อโทเค็นอยู่ในระดับใกล้เคียงกับ GPU ของ Nvidia ในตลาดกระแสหลัก 3
6
แต่ Zhipu ยังไม่ได้ระบุชื่อผู้ผลิตชิปอย่างเป็นทางการ รายงานบางแห่งคาดการณ์ว่าอาจมี Huawei, Moore Threads และ Hygon รวมอยู่ด้วย ทว่าข้อมูลนี้ยังเป็นเพียงการคาดเดาที่ไม่ได้รับการยืนยันจาก Zhipu 40
ประเด็นนี้จึงไม่ควรถูกตีความว่า จีนมีฮาร์ดแวร์ AI ที่เทียบเท่า Nvidia ได้ทั้งหมด หรือว่าต้นทุนการประมวลผลบนชิปจีนจะเท่ากับ Nvidia ในทุกกรณี สิ่งที่หลักฐานสนับสนุนได้คือ ระบบที่ไม่ใช้ Nvidia สามารถรองรับงานอนุมานโมเดลขนาดใหญ่ในระดับการใช้งานจริงได้ เมื่ออาศัยการออกแบบระบบและการปรับแต่งซอฟต์แวร์อย่างมาก 3
6
ความสำเร็จของ GLM-5.3-Flash สะท้อนว่า สำหรับงานอนุมานบางประเภท ซอฟต์แวร์เฉพาะโมเดลและเอนจินที่ออกแบบมาให้เข้ากับฮาร์ดแวร์อาจช่วยลดการพึ่งพา CUDA ซึ่งเป็นแพลตฟอร์มซอฟต์แวร์หลักของ Nvidia ได้
อย่างไรก็ตาม นี่ยังไม่ใช่การลบข้อได้เปรียบของ CUDA ทั้งหมด เพราะ Nvidia ยังคงมีระบบนิเวศ เครื่องมือสำหรับนักพัฒนา ฐานผู้ใช้งาน และข้อได้เปรียบด้านการฝึกโมเดลที่กว้างกว่า หลักฐานที่มีอยู่ยังไม่เพียงพอสำหรับข้อสรุปที่แรงกว่านี้
Zhipu รายงานว่าเอนจินให้บริการที่พัฒนาบน SGLang ใช้เทคนิคสำคัญหลายอย่าง ได้แก่
เทคนิคเหล่านี้มีเป้าหมายเพื่อจัดการข้อจำกัดด้านหน่วยความจำ แบนด์วิดท์ การสื่อสารระหว่างชิป และการจัดตารางงาน โดยเฉพาะเมื่อโมเดลรองรับบริบทขนาดสูงสุด 1 ล้านโทเค็น 4
7
Zhipu ระบุว่าการปรับปรุงดังกล่าวช่วยเพิ่มประสิทธิภาพการให้บริการแบบครบกระบวนการประมาณ สามเท่า เมื่อเทียบกับระบบตั้งต้นของบริษัท 2 ขณะที่เอกสาร SGLang ในภายหลังรายงานว่าการกำหนดค่าแคช FP8 ให้ปริมาณโทเค็นต่อแรงก์ได้มากกว่าการใช้ BF16 อย่างมีนัยสำคัญ และให้ประสิทธิภาพสูงขึ้นในช่วงโหลดต่าง ๆ แต่ข้อมูลนี้ไม่ใช่การตรวจสอบโดยอิสระต่อคำกล่าวอ้างเรื่องประสิทธิภาพที่เพิ่มขึ้นสามเท่าของ Zhipu
2
GLM-5.3-Flash มีพารามิเตอร์รวมประมาณ 320,000 ล้านรายการ แต่เปิดใช้งานราว 18,000 ล้านรายการต่อโทเค็น ตามแนวทางของโมเดล Mixture of Experts จึงไม่จำเป็นต้องประมวลผลพารามิเตอร์ทั้งหมดในทุกครั้งที่สร้างคำตอบ โมเดลรองรับหน้าต่างบริบทสูงสุด 1,048,576 โทเค็น หรือประมาณ 1 ล้านโทเค็น 5
7
โมเดลนี้ยังเป็นรุ่นแรกในตระกูล GLM-5 ที่รองรับมัลติโมดัลแบบติดตั้งมาในตัว โดยรับอินพุตอย่างข้อความ ภาพ วิดีโอ และไฟล์ได้ ตามข้อมูลทางเทคนิคที่เผยแพร่ 4
5
ในดัชนี Artificial Analysis Intelligence Index โมเดลได้รับคะแนนรายงานที่ 57 ซึ่งอยู่ในระดับเดียวกับคะแนนที่รายงานของ Claude Opus 4.8 การเปรียบเทียบนี้ควรเข้าใจว่าเป็นความเท่าเทียมกันบนดัชนีรวมชุดหนึ่งเท่านั้น ไม่ได้หมายความว่าโมเดลทั้งสองมีผลลัพธ์เท่ากันในทุกเบนช์มาร์กหรืองานเอเจนต์ในโลกจริง 1
Zhipu วาง GLM-5.3-Flash ให้แข่งขันกับโมเดลประสิทธิภาพสูงแต่เน้นความคุ้มค่า เช่น DeepSeek V4 Flash และ DeepSeek V4 Pro พร้อมชูราคาการอนุมานที่ต่ำกว่าอย่างมาก อย่างไรก็ดี หลักฐานที่มีอยู่ยังไม่เพียงพอที่จะยืนยันการเปรียบเทียบแบบเบนช์มาร์กต่อเบนช์มาร์กระหว่าง GLM-5.3-Flash กับ DeepSeek ทั้งสองรุ่น
ราคาที่มีการรายงานสำหรับ API ของ Zhipu อยู่ที่ 0.15 ดอลลาร์ต่อโทเค็นขาเข้า 1 ล้านรายการ และ 0.50 ดอลลาร์ต่อโทเค็นขาออก 1 ล้านรายการ 1
สื่อร่วมสมัยบางแห่งอธิบายว่าราคานี้อยู่ที่ประมาณหนึ่งในสิบของ GLM-5.3 รุ่นก่อนหน้า และราวหนึ่งในสี่สิบของ Claude Opus 4.8 แต่สัดส่วนดังกล่าวขึ้นอยู่กับทิศทางของโทเค็น ระดับบริบท และแผนราคาที่นำมาเปรียบเทียบ 1
โดยสรุป การเปิดเผยตัวตนของ Ox Alpha ไม่ได้มีความหมายเพียงว่า Zhipu เปิดตัวโมเดลใหม่ แต่ยังเป็นการสาธิตว่าโมเดลขนาดใหญ่สามารถนำไปให้บริการแก่ผู้ใช้ทั่วโลกบนโครงสร้างพื้นฐานที่ใช้ชิปจีนเป็นหลักได้ ขณะเดียวกัน ผลลัพธ์ดังกล่าวยังสะท้อนบทบาทของการปรับแต่งเอนจิน การจัดการหน่วยความจำ และการออกแบบระบบ ซึ่งอาจมีความสำคัญไม่แพ้ตัวชิปเองในการลดต้นทุน AI ระดับอุตสาหกรรม
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
Zhipu AI ยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ว่าโมเดลนิรนาม Ox Alpha หรือ “Niu Lai” คือ GLM 5.3 Flash โมเดลโอเพนเวตแบบมัลติโมดัลและ Mixture of Experts [1][4][6]
Zhipu AI ยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ว่าโมเดลนิรนาม Ox Alpha หรือ “Niu Lai” คือ GLM 5.3 Flash โมเดลโอเพนเวตแบบมัลติโมดัลและ Mixture of Experts [1][4][6] การเปิดให้ทดลองฟรีแบบไม่เปิดเผยชื่อบน OpenRouter และ OpenCode มียอดใช้งานมากกว่า 50 ล้านล้านโทเค็นภายใน 5 วัน และมีรายงานว่าสูงกว่า 60 ล้านล้านโทเค็นใน 6 วัน [3]
Zhipu ระบุว่าระบบให้บริการผ่านคลัสเตอร์ชิปที่ผลิตในจีนมากกว่า 100,000 ชิ้น แต่ยังไม่ได้เปิดเผยผู้ผลิตชิปอย่างเป็นทางการ [3][6]