| รุ่น | อินพุต (นอกช่วงเร่งด่วน) | เอาต์พุต (นอกช่วงเร่งด่วน) | Cache Hit |
|---|---|---|---|
| V4-Pro | $0.435 | $0.87 | ส่วนลด 90% |
| V4-Flash | $0.14 | $0.28 | ส่วนลด 90% |
นอกจากนี้ DeepSeek ยังจัดโปรโมชั่นลดราคา 75% สำหรับ V4-Pro จนถึงต้นเดือนพฤษภาคม 2026 เมื่อเทียบกับ GPT-5.5 ซึ่งมีราคาเอาต์พุตประมาณ $30 ต่อล้านโทเค็น ทำให้ V4-Flash ถูกกว่าประมาณ 107 เท่า
ผลการทดสอบมาตรฐานของ DeepSeek V4 บอกเล่าเรื่องราวที่ซับซ้อน:
ข้อควรระวังสำคัญจากการประเมินของ NIST CAISI (พฤษภาคม 2026): ผลการทดสอบมาตรฐานที่ DeepSeek รายงานด้วยตนเองอ้างว่าทัดเทียมกับ GPT-5.4 และ Opus 4.6 แต่การประเมินอย่างอิสระของ CAISI พบว่า V4 "มีความสามารถน้อยกว่าอย่างมีนัยสำคัญ" ในการทดสอบที่ไม่เปิดเผยต่อสาธารณะ ซึ่งชี้ว่าคะแนนที่รายงานด้วยตนเองบางส่วนอาจสูงเกินจริง ดัชนีความฉลาดของ Artificial Analysis จัดอันดับ GPT-5.5 (high) ไว้ที่ 53 เทียบกับ DeepSeek V4 Pro (Reasoning, High Effort) ที่ 41* — GPT-5.5 ฉลาดกว่าและเร็วกว่า (69 เทียบกับ 56 tok/s) แต่ DeepSeek ถูกกว่าอย่างมาก ($0.18 เทียบกับ $4.35 ต่อล้านโทเค็นในโหมด Reasoning)
ทีม Qwen ของอาลีบาบาเปิดตัว Qwen 3.8 Max ในงาน World AI Conference ที่เซี่ยงไฮ้เมื่อ วันที่ 19 กรกฎาคม 2026 นับเป็นโมเดลเรือธงรุ่นแรกของทีมที่มีพารามิเตอร์มากกว่า 1 ล้านล้าน
ยังไม่มีการเผยแพร่ราคาแบบจ่ายตามการใช้งาน ปัจจุบันเข้าถึงได้ผ่านการสมัครสมาชิกผ่าน Qwen Chat และพาร์ทเนอร์ API ที่คัดเลือกแล้ว BenchLM ระบุราคาของ Qwen 3.8 Max Preview ว่า "ไม่ได้ระบุ" ผู้ติดตามบุคคลที่สามบางรายแสดงราคาอัตโนมัติที่ $1.50/$5.00 ต่อล้านโทเค็นอินพุต/เอาต์พุต แต่ยังไม่ได้รับการยืนยันจากอาลีบาบา
อาลีบาบาระบุว่า Qwen 3.8 "เป็นรองเพียง Fable 5" (โมเดล Claude ชั้นนำของ Anthropic) ซึ่งจะทำให้มันนำหน้า GPT-5.5 และ DeepSeek V4 ในการจัดอันดับของอาลีบาบาเอง มีการอ้างถึงการปรับปรุงด้านการเขียนโค้ด, ผลผลิตทางวิชาชีพ, การพัฒนาฟูลสแตก, การวิเคราะห์ข้อมูล และขั้นตอนการทำงานในสำนักงานเหนือ Qwen 3.7 Max
อย่างไรก็ตาม ยังไม่มีการเผยแพร่ผลการทดสอบมาตรฐานจากบุคคลที่สาม BenchLM ซึ่งเป็นเว็บไซต์ติดตามผลการทดสอบ ติดตามการทดสอบมาตรฐาน 321 รายการสำหรับ Qwen 3.8 Max Preview โดยไม่มีผลลัพธ์ที่ได้รับการยืนยันแม้แต่รายการเดียว ณ วันที่ 20 กรกฎาคม 2026 ตามที่บทวิเคราะห์หนึ่งระบุ "Qwen 3.8 คุ้มค่าที่จะทดสอบ แต่ยังเร็วเกินไปที่จะถือว่ามันเป็นสิ่งทดแทนการผลิตที่เสถียรสำหรับ Kimi K3, GPT-5.6 Sol หรือ Claude Fable 5"
สำหรับบริบท รุ่นก่อนหน้าของ Qwen ได้วางรากฐานที่แข็งแกร่ง: Qwen 3.6-Max-Preview (20 เมษายน 2026) เป็นโมเดลแบบข้อความเท่านั้นที่มีพารามิเตอร์รวม 35B / ใช้งานจริง 3B พร้อมบริบท 262K ที่อ้างว่าเป็นที่ 1 ในการทดสอบการเขียนโค้ดและ Agent หกรายการ Qwen 3.7-Max (พฤษภาคม 2026) ขยายหน้าต่างบริบทเป็น 1 ล้านโทเค็นพร้อมความสามารถ Agent ด้านการให้เหตุผล
แต่ทั้งสองรุ่นไม่ได้รับการพิจารณาให้อยู่ในระดับแนวหน้า นอกเหนือจากการเขียนโค้ดแบบ Agentic
อาลีบาบาระบุตำแหน่งของ Qwen 3.8 อย่างชัดเจนว่า "เป็นรองเพียง Fable 5" หากคำกล่าวนี้เป็นจริงภายใต้การประเมินอย่างอิสระ มันจะทำให้ Qwen 3.8 อยู่เหนือ GPT-5.5 และเหนือกว่า DeepSeek V4 มาก แต่ด้วยการทดสอบมาตรฐานที่ไม่มีใครยืนยัน นี่จึงยังคงเป็นคำกล่าวทางการตลาด ไม่ใช่ข้อเท็จจริงที่ได้รับการยอมรับ Fable 5 ของ Anthropic ดูเหมือนจะเป็นผู้นำแนวหน้าที่ยอมรับในปัจจุบันตามกรอบของอาลีบาบาเอง
กลยุทธ์ราคาที่ aggressive ของ DeepSeek ได้ผลักดันให้เกิดการแข่งขันลดราคาในต้นทุน API V4-Flash ที่ $0.14 ต่อล้านอินพุตนั้นถูกกว่าโมเดลระดับแนวหน้าของชาติตะวันตกอย่างเทียบไม่ติด อาลีบาบายังไม่ได้ตั้งราคา Qwen 3.8 แต่ Qwen 3.6 ก็ตั้งราคาไว้สูงอยู่แล้ว (~$1.25/$7.50 อินพุต/เอาต์พุต)
สัญญาอนุญาต MIT แบบโอเพนเวทสำหรับ DeepSeek V4 หมายความว่าสามารถโฮสต์เองได้ ซึ่งยิ่งกดดันอัตรากำไรของผู้ให้บริการแบบปิด ดังที่บทวิเคราะห์หนึ่งระบุ ผลในทางปฏิบัติคือ "นักพัฒนาสามารถเข้าถึงความสามารถใกล้เคียงระดับแนวหน้า (ในงานเขียนโค้ด) ได้ในเศษเสี้ยวของต้นทุนของ GPT-5.5 หรือ Claude"