| สถาปัตยกรรม | Sparse Mixture-of-Experts (MoE), 92 เลเยอร์, 512 เอ็กซ์เพิร์ต (ทำงาน 10 ตัว + 1 ค่าเฉลี่ยต่อโทเคน) |
| กลไก Attention | Hybrid Gated DeltaNet + Gated Attention |
| บริบทพื้นฐาน (Native context) | 262,144 โทเคน ขยายได้ถึง ~1,010,000 โทเคน |
| อินพุตสูงสุด | 991K โทเคน (983K เมื่อเปิดใช้โหมดคิด) |
| เอาต์พุตสูงสุด | 131K โทเคน |
| ขนาดคำศัพท์ (Vocab size) | 248,320 |
| ความแม่นยำ (Precision) | มีทั้งน้ำหนักโมเดลแบบ BF16 และ FP8 |
| รูปแบบข้อมูล (Open weights) | รับเฉพาะข้อความ (Text-only) |
| ลิขสิทธิ์ | แบบกำหนดเอง (revenue-share); ธุรกิจ MaaS หรือ AI Work Assistant ที่มีรายได้รวมเกิน 50 ล้านดอลลาร์ต่อปีต้องเจรจาสัญญาแยก |
อาลีบาบาประกาศว่า Qwen3.8-Max ทำคะแนน "เป็นรองเพียงแค่ Fable 5" เท่านั้นในบรรดาระบบที่ทดสอบ ผล benchmark ที่เผยแพร่
:
| Benchmark | คะแนน |
|---|---|
| Terminal-Bench 2.1 | 86.6 |
| GPQA Diamond | 92.6 |
| SWE-bench Pro | 67.7 (เทียบกับ Fable 5 ที่ 80.0) |
| FrontierSWE | 73.8 (เทียบกับ Fable 5 ที่ ~80+) |
ข้อควรระวังสำคัญ: ตัวเลขเหล่านี้มาจากการทดสอบภายในของอาลีบาบาเท่านั้น ณ วันที่ 12 สิงหาคม ยังไม่มีผลประเมินจากหน่วยงานอิสระอย่าง Artificial Analysis หรือ LMArena โดยเฉพาะในงานด้านการเขียนโค้ดหลัก Qwen3.8-Max ยังตามหลัง Fable 5 ของ Anthropic อยู่มาก
| บริการ | ราคา |
|---|---|
| โทเคนอินพุต | 2.00 ดอลลาร์ต่อล้านโทเคน |
| โทเคนเอาต์พุต | 6.00 ดอลลาร์ต่อล้านโทเคน |
| อ่านแคชแบบ Implicit | 0.25 ดอลลาร์ต่อล้านโทเคน |
| สร้างแคชแบบ Explicit | 2.50 ดอลลาร์ / อ่าน 0.17 ดอลลาร์ |
ตัวโมเดลที่ดาวน์โหลดโอเพนซอร์สนั้นฟรี แต่ลิขสิทธิ์จำกัดการใช้งานเชิงพาณิชย์แบบ MaaS ที่มีรายได้เกิน 50 ล้านดอลลาร์ ซึ่งบีบให้ผู้ใช้รายใหญ่ต้องจ่ายค่าสัญญาเชิงพาณิชย์
Qwen3.8-2.4T-A95B แบบโอเพนซอร์สเป็นเพียง ส่วนย่อยที่ถูกตัดทอน ของโมเดลคลาวด์ Qwen3.8-Max เต็มรูปแบบ: