ราคาการใช้งาน API อยู่ที่ 0.14 ดอลลาร์ต่อ 1 ล้านโทเคนอินพุต และ 0.28 ดอลลาร์ต่อ 1 ล้านโทเคนเอาต์พุต ส่วนอินพุตที่ดึงจากแคชอาจมีราคาต่ำถึง 0.028 ดอลลาร์ต่อ 1 ล้านโทเคน ด้วยโครงสร้างราคานี้ V4-Flash จึงถูกจัดให้อยู่ในกลุ่ม API ด้านการให้เหตุผลระดับแนวหน้าที่มีต้นทุนต่ำมาก โดยถูกกว่า Gemini 2.5 Flash ซึ่งมีราคา 0.30 ดอลลาร์สำหรับอินพุต และ 2.50 ดอลลาร์สำหรับเอาต์พุตต่อ 1 ล้านโทเคน
เมื่อวันที่ 31 กรกฎาคม 2026 DeepSeek เปิดตัวบิลด์ “0731” ที่ผ่านการฝึกซ้ำและให้บริการในรูปแบบเบต้าสาธารณะผ่าน API รายงานหนึ่งระบุว่าบิลด์ดังกล่าวทำคะแนนเหนือกว่า V4-Pro-Preview ในการทดสอบงานแบบเอเจนต์ โดยได้ 82.7 คะแนนใน Terminal Bench 2.1 และ 76.7 คะแนนใน Cybergym
ผู้พัฒนาสามารถเลือกระดับการให้เหตุผลได้ทั้งแบบมาตรฐาน ระดับสูง และระดับสูงสุด รวมถึงปิดโหมดคิดวิเคราะห์เพื่อรองรับงานที่ต้องการประมวลผลจำนวนมากและตอบสนองเร็ว
MiniMax เปิดตัว H3 เมื่อ 31 กรกฎาคม 2026 โดยวางตำแหน่งให้เป็นโมเดลสร้างสื่อแบบมัลติโหมดที่เข้าใจข้อความ ภาพ วิดีโอ และเสียงภายในบริบทเดียวกัน โมเดลสร้างวิดีโอความละเอียดสูงสุด 2K (2560×1440 พิกเซล) ความยาวสูงสุด 15 วินาที ที่ 24 เฟรมต่อวินาที พร้อมเสียงสเตอริโอซึ่งสร้างขึ้นในกระบวนการประมวลผลเดียวกับภาพ ไม่จำเป็นต้องใช้ระบบสร้างเสียงแยกต่างหาก
H3 รองรับอินพุตอ้างอิงพร้อมกันสูงสุด ภาพ 9 ภาพ วิดีโอ 3 คลิป และแทร็กเสียง 3 แทร็ก ความสามารถนี้เปิดทางให้ผู้สร้างกำหนดตัวละคร ฉาก การเคลื่อนไหว และบรรยากาศของวิดีโอได้ละเอียดขึ้นจากข้อมูลหลายประเภทในคำสั่งเดียว
MiniMax ระบุว่าจะเผยแพร่น้ำหนักโมเดลภายในไม่กี่วันหลังการเปิดตัว หากดำเนินการตามแผน H3 จะเป็นอีกตัวอย่างของการขยายแนวทาง “open-weight” หรือการเปิดน้ำหนักโมเดล ไปสู่ตลาดวิดีโอที่โมเดลเชิงพาณิชย์รายใหญ่จำนวนมากยังคงเป็นระบบปิด บริษัทอ้างว่าค่าใช้จ่ายต่อวินาทีของ H3 ที่ความละเอียด 2K ต่ำกว่าคู่แข่งกระแสหลักมากกว่าสองในสาม หรือคิดเป็นไม่ถึงหนึ่งในสามของคู่แข่ง
ByteDance ประกาศ Seedance 2.5 ในงาน Volcano Engine FORCE เมื่อ 23 มิถุนายน 2026 ก่อนเปิดให้เข้าถึง API สาธารณะในวันที่ 16 กรกฎาคม 2026
การอัปเกรดที่เป็นหัวใจสำคัญคือการสร้างวิดีโอความยาว 30 วินาทีในครั้งเดียว โดยไม่ต้องนำคลิปสั้นหลายช่วงมาต่อกันภายหลัง ความละเอียดสูงสุดอยู่ที่ 4K (3840×2160 พิกเซล) พร้อมสีแบบ 10-bit
Seedance 2.5 รองรับอินพุตอ้างอิงแบบมัลติโหมดสูงสุด 50 รายการ ทั้งภาพ คลิปเสียง โมเดลสีขาว 3 มิติ เฟรมอ้างอิงด้านสไตล์ และคำสั่งกำกับฉาก เพิ่มขึ้นจากรุ่นก่อนที่รองรับ 12 รายการ นอกจากนี้ยังมีฟังก์ชันแก้ไขเฉพาะพื้นที่ ทำให้ผู้ใช้ปรับบางส่วนของคลิปที่สร้างแล้วได้โดยไม่ต้องสร้างวิดีโอทั้งช่วงใหม่
ByteDance ระบุการใช้งานที่ครอบคลุมตั้งแต่ภาพยนตร์ โฆษณา และการศึกษา ไปจนถึงการผลิตภาคอุตสาหกรรมและการจำลองระบบขับขี่อัตโนมัติ
การเปิดตัวที่เกิดขึ้นใกล้เคียงกัน โดยเฉพาะในวันที่ 31 กรกฎาคม 2026 สะท้อนทิศทางร่วมของอุตสาหกรรม AI จีนอย่างน้อยสามด้าน
กรอบเรื่องเดิมยังกล่าวถึงสัดส่วนการดาวน์โหลดโมเดลโอเพนซอร์สของจีนที่คิดเป็น 41% ของการดาวน์โหลดทั่วโลก รวมถึงข้อกล่าวหาจากเจ้าหน้าที่สหรัฐฯ เรื่องการกลั่นหรือถ่ายทอดความรู้จากโมเดลต่างประเทศ และการปฏิเสธข้อกล่าวหาดังกล่าวของจีน อย่างไรก็ตาม ผลการค้นหาที่มีอยู่ไม่รองรับตัวเลข 41% หรือรายละเอียดเฉพาะของข้อกล่าวหาเหล่านี้
ข้อมูลดังกล่าวอาจเกี่ยวข้องกับเหตุการณ์ DeepSeek-V3 หรือ Qwen ในช่วงก่อนหน้านี้ แต่ยังไม่สามารถยืนยันได้จากแหล่งข้อมูลที่ใช้ในบทความนี้ ดังนั้นจึงไม่ควรนำมาเชื่อมโยงกับการเปิดตัวทั้งสามโมเดลโดยตรง
| โมเดล | กำหนดการเปิดตัว | จุดเด่นสำคัญ |
|---|---|---|
| DeepSeek V4-Flash | พรีวิว 24 เมษายน 2026; เบต้าสาธารณะ 31 กรกฎาคม 2026 | MoE 284,000 ล้านพารามิเตอร์ เปิดใช้งาน 13,000 ล้านพารามิเตอร์ บริบท 1 ล้านโทเคน ราคาอินพุต 0.14 ดอลลาร์ต่อ 1 ล้านโทเคน |
| MiniMax H3 | 31 กรกฎาคม 2026 | วิดีโอ 2K ยาวสูงสุด 15 วินาที เสียงสเตอริโอในตัว และมีแผนเปิดน้ำหนักโมเดล |
| ByteDance Seedance 2.5 | ประกาศ 23 มิถุนายน 2026; API เปิด 16 กรกฎาคม 2026 | วิดีโอ 30 วินาทีแบบสร้างครั้งเดียว ความละเอียดสูงสุด 4K และอินพุตอ้างอิงมัลติโหมดสูงสุด 50 รายการ |
เมื่อพิจารณาตามหลักฐานที่มีอยู่ DeepSeek V4-Flash, MiniMax H3 และ Seedance 2.5 ไม่ใช่เหตุการณ์สามรายการที่เกิดขึ้นในวันที่ 26 ธันวาคม 2024 แต่เป็นคลื่นการพัฒนาและเปิดตัวที่ทยอยเกิดขึ้นในช่วงกลางปี 2026 จุดร่วมของทั้งสามคือการผลักดัน AI ให้มีต้นทุนต่ำลง เปิดให้ผู้พัฒนานำไปต่อยอดได้มากขึ้น และสร้างคอนเทนต์ที่ยาวและควบคุมรายละเอียดได้กว่าเดิม