Alibaba’s Qwen 3.7 Max ซึ่งเปิดตัวในเดือนพฤษภาคม 2026 เป็นโมเดลเรือธง Mixture-of-Experts (MoE) ที่มีพารามิเตอร์ 2.8 ล้านล้าน และดูเหมือนจะมีประสิทธิภาพเทียบเท่าหรือดีกว่า Fable 5 ของ Anthropic ในหลายเกณฑ์วัด โดยมีต้นทุนประมาณหนึ่งในหก สำหรับการใช้งานปริมาณมาก Alibaba's Qwen3.6 Flash มีราคาเพียง $0.19 ต่อล้าน input tokens
Zhipu AI’s GLM-5.2 เปิดตัวเมื่อวันที่ 13 มิถุนายน 2026 ใช้สถาปัตยกรรม MoE ขนาด 7.44 แสนล้านพารามิเตอร์ (ทำงานจริง 4 หมื่นล้าน) มีหน้าต่างบริบท 1 ล้าน token และได้รับการจัดอันดับเป็นโมเดลโอเพนเวทอันดับหนึ่งในดัชนี Artificial Analysis Intelligence Index ราคาอยู่ที่ $1.40 ต่อล้าน input tokens และ $4.40 ต่อล้าน output tokens ซึ่งถูกกว่าโมเดลระดับแนวหน้าของสหรัฐฯ ประมาณ 5-6 เท่า
Moonshot AI’s Kimi K3 เปิดตัวเมื่อวันที่ 16 กรกฎาคม 2026 ถือเป็นระบบ AI โอเพนเวทที่ใหญ่ที่สุดเท่าที่เคยประกาศ: มีพารามิเตอร์รวม 2.8 ล้านล้าน หน้าต่างบริบท 1 ล้าน token และความสามารถในการทำความเข้าใจภาพโดยธรรมชาติ Moonshot สัญญาว่าจะปล่อยน้ำหนักโมเดลแบบเต็มรูปแบบภายในวันที่ 27 กรกฎาคม 2026 ราคา API อยู่ที่ $3 ต่อล้าน input tokens และ $15 ต่อล้าน output tokens ทำให้เป็นโมเดลจีนที่แพงที่สุด แต่ก็ยังต่ำกว่าโมเดลเทียบเคียงของสหรัฐฯ
ช่องว่างด้านต้นทุนระหว่างโมเดลระดับแนวหน้าของจีนและสหรัฐฯ นั้นสุดขั้ว:
| โมเดล | ราคานำเข้า (ต่อ 1 ล้าน tokens) | ราคาส่งออก (ต่อ 1 ล้าน tokens) |
|---|---|---|
| DeepSeek V4-Flash | $0.14 | $0.28 |
| Alibaba Qwen3.6 Flash | $0.19 | $1.13 |
| Zhipu GLM-5.2 | $1.40 | $4.40 |
| Alibaba Qwen3.7 Max | $1.25 | $3.75 |
| Moonshot Kimi K3 | $3.00 | $15.00 |
| Anthropic Claude Fable 5 (โดยประมาณ) | ~$15.00 | ~$50.00 |
| OpenAI GPT-5.5 (โดยประมาณ) | ~$5.00 | ~$15.00 |
แหล่งที่มา: อ้างอิงจากตารางก่อนหน้าและ
ตัวเลขบ่งบอกเรื่องราว: V4-Flash ของ DeepSeek มีต้นทุนเฉลี่ยประมาณ 3 เซนต์ต่อการทดสอบหนึ่งครั้ง เทียบกับ $1.86 สำหรับ GPT-5.5 และ $3.33 สำหรับ Claude Fable 5 มาร์ค อังเดรียเซน (Marc Andreessen) นักลงทุนเสี่ยงภัย กล่าวถึง GLM-5.2 ว่าเป็น "โมเดล AI จีนตัวแรกที่เทียบเคียงและมักจะเอาชนะโมเดล AI สาธารณะของห้องปฏิบัติการใหญ่ในอเมริกาได้โดยไม่มีการลดทอนใด ๆ" ในราคาเพียงเศษเสี้ยวเดียว
กลยุทธ์อีกด้านของจีนคือการปล่อยน้ำหนักโมเดลแบบเปิด (open-weight) โมเดลต่างๆ เช่น GLM-5.2 (สัญญาอนุญาต MIT), Kimi K3 (สัญญาอนุญาต Modified MIT ที่สัญญาไว้) และซีรีส์ Qwen สามารถดาวน์โหลดและใช้งาน ปรับแต่ง หรือ Fine-tune ได้ฟรีโดยไม่มีค่าใช้จ่ายต่อ token กลยุทธ์ "แจกโมเดล" นี้กำลังกัดกร่อนตลาดระดับกลาง ซึ่งเป็นที่ที่บริษัทสหรัฐฯ เคยคิดราคาพรีเมียม
จุดเปลี่ยนสำคัญเกิดขึ้นในเดือนมิถุนายน 2026 เมื่อรัฐบาลของประธานาธิบดีทรัมป์ขอให้ Anthropic หยุดการทำงานของระบบ AI ที่ล้ำหน้าที่สุดสองระบบของตน (Fable และ Mythos) ด้วยเหตุผลด้านความมั่นคงแห่งชาติ ภายในสองสัปดาห์ Z.ai ได้เปิดตัวโมเดลที่มีความสามารถใกล้เคียงกับของ Anthropic โดยมีราคาถูกกว่าและไม่มีข้อจำกัดจากสหรัฐฯ บริษัทจีนมองเห็นช่องว่างและรีบเข้าไปเติมเต็ม
การตอบสนองของสหรัฐฯ ยังคงกระจัดกระจาย Anthropic ปฏิบัติตามคำขอของรัฐบาล มีรายงานว่า Google กำลังประสบปัญหากับ Gemini เวอร์ชันล่าสุด เนื่องจากโมเดลจีนเข้ามาใกล้ชิดมากขึ้น ยังไม่มีมาตรการตอบโต้เชิงนโยบายจากสหรัฐฯ โดยรวมที่มีนัยสำคัญ นักวิเคราะห์ชี้ว่ามาตรการควบคุมการส่งออกชิปไม่ได้หยุดบริษัทจีนจากการบรรลุประสิทธิภาพการแข่งขันผ่านประสิทธิภาพทางสถาปัตยกรรม (เช่น MoE, Hybrid Attention) แทนที่จะใช้พลังการคำนวณดิบ
ในขณะเดียวกัน บริษัทสหรัฐฯ กำลังทดสอบและนำโมเดลของจีนมาใช้มากขึ้นด้วยเหตุผลด้านต้นทุน ซึ่งยิ่งกัดเซาะความได้เปรียบในบ้านของห้องปฏิบัติการ AI อเมริกัน