Z.ai ยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ว่า Ox Alpha โมเดลทดลองใช้งานฟรีแบบไม่เปิดเผยชื่อ คือ GLM 5.3 Flash ซึ่งมีพารามิเตอร์ทั้งหมด 320B และเปิดใช้งานจริง 18B ต่อโทเค็น พร้อมใบอนุญาต MIT โมเดลรองรับอินพุตทั้งข้อความ ภาพ และวิดีโอ มีบริบทประมาณ 1 ล้านโทเค็น และราคาแพลตฟอร์มของ Z.ai อยู่ที่ 0.15 ดอลลาร์ต่อโทเค็นอินพุต...
เผยแพร่โดยแก้ไขด้วย GPT-5.6 Lunaรูปภาพสร้างด้วย GPT Image 1.5
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What did Z.ai, the Chinese AI company formerly known as Zhipu AI, reveal about the anonymous “Ox Alpha” model that appeared free and without. Article summary: Z.ai disclosed on August 26 that the previously anonymous, free “Ox Alpha” preview was **GLM-5.3-Flash**—the first natively multimodal GLM-5 model. It is an open-weight, low-cost coding and agent model whose stealth rele. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
ปริศนาสิ้นสุดลงเมื่อวันที่ 26 สิงหาคม 2026: Z.ai ยืนยันว่า Ox Alpha โมเดลนิรนามที่เปิดให้ใช้งานผ่าน OpenRouter และ OpenCode คือ GLM-5.3-Flash โมเดลแรกในตระกูล GLM-5 ที่รองรับหลายรูปแบบข้อมูลได้โดยกำเนิด (native multimodal) โดยมีน้ำหนักโมเดลแบบเปิด ภายในบริบทประมาณ 1 ล้านโทเค็น และมุ่งเน้นงานเขียนโค้ดกับงานของ AI agent ที่ทำงานต่อเนื่องเป็นเวลานาน 15
40
ประเด็นสำคัญจึงไม่ได้อยู่ที่การเฉลยชื่อโมเดลเพียงอย่างเดียว แต่คือวิธีเปิดตัวของ Z.ai บริษัท AI จากจีนใช้โมเดลตัวอย่างแบบไม่เปิดเผยชื่อและไม่คิดค่าใช้บริการ ดึงการใช้งานจากนักพัฒนาจำนวนมาก ก่อนเปลี่ยนให้เป็นผลิตภัณฑ์อย่างเป็นทางการและเปิดให้ดาวน์โหลด แนวทางนี้ช่วยให้บริษัททดสอบโครงสร้างพื้นฐานกับภาระงานจริง พร้อมสร้างกระแสความสนใจก่อนการเปิดตัวเต็มรูปแบบ
GLM-5.3-Flash เป็นโมเดลแบบ Mixture of Experts (MoE) มีพารามิเตอร์ทั้งหมด 320 พันล้านตัว แต่เปิดใช้งานประมาณ 18 พันล้านตัวต่อโทเค็น จึงไม่จำเป็นต้องใช้พารามิเตอร์ทั้งหมดในทุกขั้นตอนการประมวลผล โมเดลรับข้อมูลเข้าเป็นข้อความ ภาพ และวิดีโอ ขณะที่ผลลัพธ์เป็นข้อความ
Z.ai ระบุการออกแบบให้รองรับบริบทประมาณ 1 ล้านโทเค็น แต่ตัวเลขที่แสดงอาจแตกต่างกันตามแพลตฟอร์ม โดยเอกสารของ Z.ai ระบุความจุระดับ 1 ล้านโทเค็น ขณะที่ OpenRouter แสดงหน้าต่างบริบท 1,310,720 โทเค็น 1
2
3
40
Z.ai ปล่อยน้ำหนักโมเดลภายใต้ MIT License ซึ่งทำให้นักพัฒนานำไปติดตั้งและปรับใช้เองได้ยืดหยุ่นกว่าระบบที่เปิดให้ใช้งานผ่าน API แบบปิดเท่านั้น หลังช่วงทดลองแบบนิรนามสิ้นสุดลง โมเดลก็ปรากฏบน OpenRouter ในนาม GLM-5.3-Flash อย่างเป็นทางการ 3
4
8
อย่างไรก็ตาม GLM-5.3-Flash ไม่ใช่ผลิตภัณฑ์เดียวกับ GLM-5.3 รุ่นขนาดใหญ่ที่ประกาศก่อนหน้านี้ในเดือนสิงหาคม รายงานระบุว่า Flash เป็นโมเดลอีก SKU หนึ่ง ขนาด 320B-A18B และมีต้นทุนต่ำกว่า ไม่ใช่ชื่อเรียกอีกแบบของ GLM-5.3 รุ่นใหญ่ 10
Z.ai ระบุว่า GLM-5.3-Flash ทำได้ดีกว่า GLM-5.2 พร้อมลดต้นทุนการให้บริการลง ในผลทดสอบที่ถูกอ้างถึงช่วงเปิดตัว โมเดลทำคะแนน 63.4 ใน DeepSWE v1.1 เทียบกับ 46.2 ของ GLM-5.2 นอกจากนี้ Z.ai รายงานคะแนน 29.0 ในการทดสอบเขียนโค้ดภายในของบริษัท ใกล้เคียงกับคะแนน 29.5 ของ Claude Opus 4.8 3
16
ตัวเลขเหล่านี้ช่วยให้เห็นว่าบริษัทกำลังวางตำแหน่งโมเดลไว้ตรงไหน แต่ยังไม่ใช่หลักฐานอิสระที่ยืนยันว่า GLM-5.3-Flash ทัดเทียมกับโมเดลของ Anthropic การตีความผลลัพธ์จำเป็นต้องดูนิยามของเบนช์มาร์ก เงื่อนไขการทดสอบ วิธีเขียนพรอมป์ และรายละเอียดการทำซ้ำการทดลองด้วย
ข้อสรุปที่ระมัดระวังที่สุดคือ Z.ai กำลังเสนอโมเดลที่อ้างว่ามีความสามารถด้านการเขียนโค้ดและ AI agent สูง ในต้นทุนที่ต่ำกว่ามาก ไม่ใช่ข้อยืนยันว่าโมเดลนี้เอาชนะระบบปิดระดับแนวหน้าได้อย่างเด็ดขาด
จุดเด่นที่ทำให้ Ox Alpha เป็นที่สนใจคือ นักพัฒนาสามารถทดลองใช้งานได้โดยไม่เสียเงินในช่วงเปิดตัวแบบนิรนาม แต่ช่วงดังกล่าวสิ้นสุดลงเมื่อโมเดลได้รับชื่ออย่างเป็นทางการ
ราคาตามรายการของ Z.ai อยู่ที่ 0.15 ดอลลาร์ต่อโทเค็นอินพุต 1 ล้านรายการ และ 0.50 ดอลลาร์ต่อโทเค็นเอาต์พุต 1 ล้านรายการ 1
3
ในช่วงเปิดตัว OpenRouter แสดงราคาโปรโมชั่นที่ต่ำกว่า คือ 0.075 ดอลลาร์ต่อโทเค็นอินพุต 1 ล้านรายการ และ 0.25 ดอลลาร์ต่อโทเค็นเอาต์พุต 1 ล้านรายการ 2 ดังนั้นควรแยกให้ออกระหว่างสามเงื่อนไข ได้แก่ ช่วงทดลองฟรี ราคาเต็มของ Z.ai และส่วนลดเฉพาะแพลตฟอร์ม
แม้คิดตามราคาเต็ม เศรษฐศาสตร์ของโมเดลก็ยังเป็นจุดขายสำคัญ งานของ coding agent มักใช้ทั้งบริบทและเอาต์พุตจำนวนมาก ต้นทุนต่อโทเค็นที่ต่ำลงจึงอาจมีผลต่อการเลือกโมเดลพอ ๆ กับความแตกต่างของคะแนนเบนช์มาร์กเพียงเล็กน้อย
Z.ai ระบุว่า GLM-5.3-Flash ทำงานทั้งหมดบนตัวเร่งประมวลผล AI ที่ผลิตในจีน 15 รายงานเกี่ยวกับระบบให้บริการระบุว่า Z.ai ใช้สแต็กที่พัฒนาบน SGLang และเทคนิคต่าง ๆ เช่น quantization, tensor parallelism, การจัดรูปแบบแคชแบบผสม การแบ่งเลเยอร์ และสถาปัตยกรรมแยกขั้นตอน encode–prefill–decode เป้าหมายคือเพิ่มประสิทธิภาพตั้งแต่ต้นจนจบ โดยยังทำงานได้ภายใต้ข้อจำกัดของฮาร์ดแวร์ภายในประเทศ
25
เรื่องนี้ต่อยอดจากแนวทางก่อนหน้าของ Z.ai ที่บริษัทเคยระบุว่าตระกูล GLM ได้รับการฝึกบนโปรเซสเซอร์ Huawei Ascend โดยไม่ใช้ฮาร์ดแวร์ Nvidia รายงานยังระบุว่า Z.ai ถูกขึ้นบัญชี U.S. Entity List ของสหรัฐฯ ซึ่งจำกัดการเข้าถึงตัวเร่งประมวลผล Nvidia รุ่น H100, H200 และ B200 26
ข้ออ้างเรื่องการประมวลผลควรอ่านในฐานะข้อมูลจากบริษัทและรายงานในอุตสาหกรรม ไม่ใช่ผลเปรียบเทียบประสิทธิภาพฮาร์ดแวร์ที่ผ่านการตรวจสอบอย่างอิสระทั้งหมด แต่สิ่งที่เห็นได้ชัดคือ Z.ai กำลังนำเสนอระบบโมเดลที่สามารถให้บริการโมเดลมัลติโมดัลขนาดใหญ่ โดยไม่พึ่งพา GPU ดาต้าเซ็นเตอร์ระดับแนวหน้าของ Nvidia
การเปิดตัวแบบนิรนามดูเหมือนเป็นแผนการที่วางไว้อย่างจงใจ: ปล่อยโมเดลที่มีความสามารถโดยไม่เปิดเผยผู้พัฒนา เปิดให้ใช้ฟรีผ่านเส้นทางยอดนิยมสำหรับงานเขียนโค้ด สังเกตว่านักพัฒนาใช้งานอย่างไร แล้วจึงเปิดเผยชื่อผลิตภัณฑ์หลังได้รับข้อมูลจากการใช้งานจริง
Z.ai เคยมีความเชื่อมโยงกับการทดสอบ “Pony Alpha” ก่อนหน้านี้ ซึ่งใช้แนวคิดใกล้เคียงกัน ขณะเดียวกัน นักวิเคราะห์จากชุมชนพยายามระบุตัวตนของ Ox Alpha ผ่านพฤติกรรมของ tokenizer เบาะแสจากการประมวลผลวิดีโอ และรูปแบบข้อผิดพลาดจาก API 7
11
13
รายงานในช่วงเปิดตัวยังกล่าวถึงปริมาณการใช้งานที่สูงผิดปกติและกระแสตอบรับที่ดีจากนักพัฒนา แต่เนื้อหาที่มีอยู่ยังไม่สามารถยืนยันตัวเลขหรือคำพูดทุกส่วนได้อย่างเป็นอิสระ ข้อกล่าวอ้างเหล่านี้จึงควรถูกมองว่าเป็นรายงานช่วงเปิดตัว ไม่ใช่ข้อมูลการใช้งานที่ผ่านการตรวจสอบบัญชีแล้ว 14
GLM-5.3-Flash ยังไม่ได้พิสูจน์ว่า Z.ai แซงหน้า OpenAI หรือ Anthropic ในความสามารถของโมเดลแนวหน้าทุกด้าน แต่การเปิดตัวครั้งนี้รวมองค์ประกอบที่สร้างแรงกระเพื่อมไว้ด้วยกัน ได้แก่ อินพุตแบบมัลติโมดัล บริบทที่ยาวมาก น้ำหนักโมเดลแบบเปิดภายใต้ MIT License ความเชี่ยวชาญด้าน coding agent และราคา API ที่ต่ำในผลิตภัณฑ์เดียว 15
40
สำหรับนักพัฒนา การรวมกันนี้ช่วยลดต้นทุนในการเปลี่ยนผู้ให้บริการ และทำให้การติดตั้งใช้งานเองหรือกระจายระบบไปยังหลายผู้ให้บริการเป็นไปได้จริงมากขึ้น สำหรับผู้ให้บริการโมเดลปิด ก็หมายถึงแรงกดดันต่อราคาและอัตรากำไร โดยเฉพาะงาน coding agent ที่ปริมาณโทเค็น ความหน่วง การควบคุมการติดตั้ง และความพร้อมของโครงสร้างพื้นฐาน อาจสำคัญพอ ๆ กับอันดับบนลีดเดอร์บอร์ด
บทเรียนจาก Ox Alpha จึงไม่ได้มีแค่ว่า Z.ai ซ่อนชื่อโมเดลได้นานเพียงใด แต่คือการเปิดตัวแบบลับสามารถทำหน้าที่เป็นทั้งสนามทดสอบระบบขนาดใหญ่ เครื่องมือเก็บฟีดแบ็ก และกลยุทธ์สร้างกระแสได้ในคราวเดียว
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
Z.ai ยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ว่า Ox Alpha โมเดลทดลองใช้งานฟรีแบบไม่เปิดเผยชื่อ คือ GLM 5.3 Flash ซึ่งมีพารามิเตอร์ทั้งหมด 320B และเปิดใช้งานจริง 18B ต่อโทเค็น พร้อมใบอนุญาต MIT
Z.ai ยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ว่า Ox Alpha โมเดลทดลองใช้งานฟรีแบบไม่เปิดเผยชื่อ คือ GLM 5.3 Flash ซึ่งมีพารามิเตอร์ทั้งหมด 320B และเปิดใช้งานจริง 18B ต่อโทเค็น พร้อมใบอนุญาต MIT โมเดลรองรับอินพุตทั้งข้อความ ภาพ และวิดีโอ มีบริบทประมาณ 1 ล้านโทเค็น และราคาแพลตฟอร์มของ Z.ai อยู่ที่ 0.15 ดอลลาร์ต่อโทเค็นอินพุต 1 ล้านรายการ และ 0.50 ดอลลาร์ต่อโทเค็นเอาต์พุต 1 ล้านรายการ
การเปิดตัวแบบลับทำให้ Z.ai ได้ทดสอบระบบให้บริการกับงานเขียนโค้ดและ AI agent ในสถานการณ์จริง ก่อนเปิดเผยชื่อและปล่อยน้ำหนักโมเดลให้ดาวน์โหลด
Z.ai ยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ว่า Ox Alpha โมเดลทดลองใช้งานฟรีแบบไม่เปิดเผยชื่อ คือ GLM 5.3 Flash ซึ่งมีพารามิเตอร์ทั้งหมด 320B และเปิดใช้งานจริง 18B ต่อโทเค็น พร้อมใบอนุญาต MIT โมเดลรองรับอินพุตทั้งข้อความ ภาพ และวิดีโอ มีบริบทประมาณ 1 ล้านโทเค็น และราคาแพลตฟอร์มของ Z.ai อยู่ที่ 0.15 ดอลลาร์ต่อโทเค็นอินพุต...
เผยแพร่โดยแก้ไขด้วย GPT-5.6 Lunaรูปภาพสร้างด้วย GPT Image 1.5
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What did Z.ai, the Chinese AI company formerly known as Zhipu AI, reveal about the anonymous “Ox Alpha” model that appeared free and without. Article summary: Z.ai disclosed on August 26 that the previously anonymous, free “Ox Alpha” preview was **GLM-5.3-Flash**—the first natively multimodal GLM-5 model. It is an open-weight, low-cost coding and agent model whose stealth rele. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
ปริศนาสิ้นสุดลงเมื่อวันที่ 26 สิงหาคม 2026: Z.ai ยืนยันว่า Ox Alpha โมเดลนิรนามที่เปิดให้ใช้งานผ่าน OpenRouter และ OpenCode คือ GLM-5.3-Flash โมเดลแรกในตระกูล GLM-5 ที่รองรับหลายรูปแบบข้อมูลได้โดยกำเนิด (native multimodal) โดยมีน้ำหนักโมเดลแบบเปิด ภายในบริบทประมาณ 1 ล้านโทเค็น และมุ่งเน้นงานเขียนโค้ดกับงานของ AI agent ที่ทำงานต่อเนื่องเป็นเวลานาน 15
40
ประเด็นสำคัญจึงไม่ได้อยู่ที่การเฉลยชื่อโมเดลเพียงอย่างเดียว แต่คือวิธีเปิดตัวของ Z.ai บริษัท AI จากจีนใช้โมเดลตัวอย่างแบบไม่เปิดเผยชื่อและไม่คิดค่าใช้บริการ ดึงการใช้งานจากนักพัฒนาจำนวนมาก ก่อนเปลี่ยนให้เป็นผลิตภัณฑ์อย่างเป็นทางการและเปิดให้ดาวน์โหลด แนวทางนี้ช่วยให้บริษัททดสอบโครงสร้างพื้นฐานกับภาระงานจริง พร้อมสร้างกระแสความสนใจก่อนการเปิดตัวเต็มรูปแบบ
GLM-5.3-Flash เป็นโมเดลแบบ Mixture of Experts (MoE) มีพารามิเตอร์ทั้งหมด 320 พันล้านตัว แต่เปิดใช้งานประมาณ 18 พันล้านตัวต่อโทเค็น จึงไม่จำเป็นต้องใช้พารามิเตอร์ทั้งหมดในทุกขั้นตอนการประมวลผล โมเดลรับข้อมูลเข้าเป็นข้อความ ภาพ และวิดีโอ ขณะที่ผลลัพธ์เป็นข้อความ
Z.ai ระบุการออกแบบให้รองรับบริบทประมาณ 1 ล้านโทเค็น แต่ตัวเลขที่แสดงอาจแตกต่างกันตามแพลตฟอร์ม โดยเอกสารของ Z.ai ระบุความจุระดับ 1 ล้านโทเค็น ขณะที่ OpenRouter แสดงหน้าต่างบริบท 1,310,720 โทเค็น 1
2
3
40
Z.ai ปล่อยน้ำหนักโมเดลภายใต้ MIT License ซึ่งทำให้นักพัฒนานำไปติดตั้งและปรับใช้เองได้ยืดหยุ่นกว่าระบบที่เปิดให้ใช้งานผ่าน API แบบปิดเท่านั้น หลังช่วงทดลองแบบนิรนามสิ้นสุดลง โมเดลก็ปรากฏบน OpenRouter ในนาม GLM-5.3-Flash อย่างเป็นทางการ 3
4
8
อย่างไรก็ตาม GLM-5.3-Flash ไม่ใช่ผลิตภัณฑ์เดียวกับ GLM-5.3 รุ่นขนาดใหญ่ที่ประกาศก่อนหน้านี้ในเดือนสิงหาคม รายงานระบุว่า Flash เป็นโมเดลอีก SKU หนึ่ง ขนาด 320B-A18B และมีต้นทุนต่ำกว่า ไม่ใช่ชื่อเรียกอีกแบบของ GLM-5.3 รุ่นใหญ่ 10
Z.ai ระบุว่า GLM-5.3-Flash ทำได้ดีกว่า GLM-5.2 พร้อมลดต้นทุนการให้บริการลง ในผลทดสอบที่ถูกอ้างถึงช่วงเปิดตัว โมเดลทำคะแนน 63.4 ใน DeepSWE v1.1 เทียบกับ 46.2 ของ GLM-5.2 นอกจากนี้ Z.ai รายงานคะแนน 29.0 ในการทดสอบเขียนโค้ดภายในของบริษัท ใกล้เคียงกับคะแนน 29.5 ของ Claude Opus 4.8 3
16
ตัวเลขเหล่านี้ช่วยให้เห็นว่าบริษัทกำลังวางตำแหน่งโมเดลไว้ตรงไหน แต่ยังไม่ใช่หลักฐานอิสระที่ยืนยันว่า GLM-5.3-Flash ทัดเทียมกับโมเดลของ Anthropic การตีความผลลัพธ์จำเป็นต้องดูนิยามของเบนช์มาร์ก เงื่อนไขการทดสอบ วิธีเขียนพรอมป์ และรายละเอียดการทำซ้ำการทดลองด้วย
ข้อสรุปที่ระมัดระวังที่สุดคือ Z.ai กำลังเสนอโมเดลที่อ้างว่ามีความสามารถด้านการเขียนโค้ดและ AI agent สูง ในต้นทุนที่ต่ำกว่ามาก ไม่ใช่ข้อยืนยันว่าโมเดลนี้เอาชนะระบบปิดระดับแนวหน้าได้อย่างเด็ดขาด
จุดเด่นที่ทำให้ Ox Alpha เป็นที่สนใจคือ นักพัฒนาสามารถทดลองใช้งานได้โดยไม่เสียเงินในช่วงเปิดตัวแบบนิรนาม แต่ช่วงดังกล่าวสิ้นสุดลงเมื่อโมเดลได้รับชื่ออย่างเป็นทางการ
ราคาตามรายการของ Z.ai อยู่ที่ 0.15 ดอลลาร์ต่อโทเค็นอินพุต 1 ล้านรายการ และ 0.50 ดอลลาร์ต่อโทเค็นเอาต์พุต 1 ล้านรายการ 1
3
ในช่วงเปิดตัว OpenRouter แสดงราคาโปรโมชั่นที่ต่ำกว่า คือ 0.075 ดอลลาร์ต่อโทเค็นอินพุต 1 ล้านรายการ และ 0.25 ดอลลาร์ต่อโทเค็นเอาต์พุต 1 ล้านรายการ 2 ดังนั้นควรแยกให้ออกระหว่างสามเงื่อนไข ได้แก่ ช่วงทดลองฟรี ราคาเต็มของ Z.ai และส่วนลดเฉพาะแพลตฟอร์ม
แม้คิดตามราคาเต็ม เศรษฐศาสตร์ของโมเดลก็ยังเป็นจุดขายสำคัญ งานของ coding agent มักใช้ทั้งบริบทและเอาต์พุตจำนวนมาก ต้นทุนต่อโทเค็นที่ต่ำลงจึงอาจมีผลต่อการเลือกโมเดลพอ ๆ กับความแตกต่างของคะแนนเบนช์มาร์กเพียงเล็กน้อย
Z.ai ระบุว่า GLM-5.3-Flash ทำงานทั้งหมดบนตัวเร่งประมวลผล AI ที่ผลิตในจีน 15 รายงานเกี่ยวกับระบบให้บริการระบุว่า Z.ai ใช้สแต็กที่พัฒนาบน SGLang และเทคนิคต่าง ๆ เช่น quantization, tensor parallelism, การจัดรูปแบบแคชแบบผสม การแบ่งเลเยอร์ และสถาปัตยกรรมแยกขั้นตอน encode–prefill–decode เป้าหมายคือเพิ่มประสิทธิภาพตั้งแต่ต้นจนจบ โดยยังทำงานได้ภายใต้ข้อจำกัดของฮาร์ดแวร์ภายในประเทศ
25
เรื่องนี้ต่อยอดจากแนวทางก่อนหน้าของ Z.ai ที่บริษัทเคยระบุว่าตระกูล GLM ได้รับการฝึกบนโปรเซสเซอร์ Huawei Ascend โดยไม่ใช้ฮาร์ดแวร์ Nvidia รายงานยังระบุว่า Z.ai ถูกขึ้นบัญชี U.S. Entity List ของสหรัฐฯ ซึ่งจำกัดการเข้าถึงตัวเร่งประมวลผล Nvidia รุ่น H100, H200 และ B200 26
ข้ออ้างเรื่องการประมวลผลควรอ่านในฐานะข้อมูลจากบริษัทและรายงานในอุตสาหกรรม ไม่ใช่ผลเปรียบเทียบประสิทธิภาพฮาร์ดแวร์ที่ผ่านการตรวจสอบอย่างอิสระทั้งหมด แต่สิ่งที่เห็นได้ชัดคือ Z.ai กำลังนำเสนอระบบโมเดลที่สามารถให้บริการโมเดลมัลติโมดัลขนาดใหญ่ โดยไม่พึ่งพา GPU ดาต้าเซ็นเตอร์ระดับแนวหน้าของ Nvidia
การเปิดตัวแบบนิรนามดูเหมือนเป็นแผนการที่วางไว้อย่างจงใจ: ปล่อยโมเดลที่มีความสามารถโดยไม่เปิดเผยผู้พัฒนา เปิดให้ใช้ฟรีผ่านเส้นทางยอดนิยมสำหรับงานเขียนโค้ด สังเกตว่านักพัฒนาใช้งานอย่างไร แล้วจึงเปิดเผยชื่อผลิตภัณฑ์หลังได้รับข้อมูลจากการใช้งานจริง
Z.ai เคยมีความเชื่อมโยงกับการทดสอบ “Pony Alpha” ก่อนหน้านี้ ซึ่งใช้แนวคิดใกล้เคียงกัน ขณะเดียวกัน นักวิเคราะห์จากชุมชนพยายามระบุตัวตนของ Ox Alpha ผ่านพฤติกรรมของ tokenizer เบาะแสจากการประมวลผลวิดีโอ และรูปแบบข้อผิดพลาดจาก API 7
11
13
รายงานในช่วงเปิดตัวยังกล่าวถึงปริมาณการใช้งานที่สูงผิดปกติและกระแสตอบรับที่ดีจากนักพัฒนา แต่เนื้อหาที่มีอยู่ยังไม่สามารถยืนยันตัวเลขหรือคำพูดทุกส่วนได้อย่างเป็นอิสระ ข้อกล่าวอ้างเหล่านี้จึงควรถูกมองว่าเป็นรายงานช่วงเปิดตัว ไม่ใช่ข้อมูลการใช้งานที่ผ่านการตรวจสอบบัญชีแล้ว 14
GLM-5.3-Flash ยังไม่ได้พิสูจน์ว่า Z.ai แซงหน้า OpenAI หรือ Anthropic ในความสามารถของโมเดลแนวหน้าทุกด้าน แต่การเปิดตัวครั้งนี้รวมองค์ประกอบที่สร้างแรงกระเพื่อมไว้ด้วยกัน ได้แก่ อินพุตแบบมัลติโมดัล บริบทที่ยาวมาก น้ำหนักโมเดลแบบเปิดภายใต้ MIT License ความเชี่ยวชาญด้าน coding agent และราคา API ที่ต่ำในผลิตภัณฑ์เดียว 15
40
สำหรับนักพัฒนา การรวมกันนี้ช่วยลดต้นทุนในการเปลี่ยนผู้ให้บริการ และทำให้การติดตั้งใช้งานเองหรือกระจายระบบไปยังหลายผู้ให้บริการเป็นไปได้จริงมากขึ้น สำหรับผู้ให้บริการโมเดลปิด ก็หมายถึงแรงกดดันต่อราคาและอัตรากำไร โดยเฉพาะงาน coding agent ที่ปริมาณโทเค็น ความหน่วง การควบคุมการติดตั้ง และความพร้อมของโครงสร้างพื้นฐาน อาจสำคัญพอ ๆ กับอันดับบนลีดเดอร์บอร์ด
บทเรียนจาก Ox Alpha จึงไม่ได้มีแค่ว่า Z.ai ซ่อนชื่อโมเดลได้นานเพียงใด แต่คือการเปิดตัวแบบลับสามารถทำหน้าที่เป็นทั้งสนามทดสอบระบบขนาดใหญ่ เครื่องมือเก็บฟีดแบ็ก และกลยุทธ์สร้างกระแสได้ในคราวเดียว
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
Z.ai ยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ว่า Ox Alpha โมเดลทดลองใช้งานฟรีแบบไม่เปิดเผยชื่อ คือ GLM 5.3 Flash ซึ่งมีพารามิเตอร์ทั้งหมด 320B และเปิดใช้งานจริง 18B ต่อโทเค็น พร้อมใบอนุญาต MIT
Z.ai ยืนยันเมื่อวันที่ 26 สิงหาคม 2026 ว่า Ox Alpha โมเดลทดลองใช้งานฟรีแบบไม่เปิดเผยชื่อ คือ GLM 5.3 Flash ซึ่งมีพารามิเตอร์ทั้งหมด 320B และเปิดใช้งานจริง 18B ต่อโทเค็น พร้อมใบอนุญาต MIT โมเดลรองรับอินพุตทั้งข้อความ ภาพ และวิดีโอ มีบริบทประมาณ 1 ล้านโทเค็น และราคาแพลตฟอร์มของ Z.ai อยู่ที่ 0.15 ดอลลาร์ต่อโทเค็นอินพุต 1 ล้านรายการ และ 0.50 ดอลลาร์ต่อโทเค็นเอาต์พุต 1 ล้านรายการ
การเปิดตัวแบบลับทำให้ Z.ai ได้ทดสอบระบบให้บริการกับงานเขียนโค้ดและ AI agent ในสถานการณ์จริง ก่อนเปิดเผยชื่อและปล่อยน้ำหนักโมเดลให้ดาวน์โหลด