DeepSeek เปลี่ยน V4 Flash และ V4 Pro จากราคาแบบคงที่เป็นระบบคิดตามเวลาเมื่อเวลา 00:00 น. ช่วงพีกคือ 09:00–12:00 น. และ 14:00–18:00 น.
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What changed when DeepSeek’s new API pricing for DeepSeek-V4-Flash and DeepSeek-V4-Pro took effect at midnight on August 17, 2026—including. Article summary: At 00:00 Beijing time on August 17 (16:00 UTC on August 16), DeepSeek replaced flat V4 API pricing with time-of-use pricing: off-peak rates are exactly half peak rates. Peak is 09:00–12:00 and 14:00–18:00 Beijing time da. Topic tags: general, news, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, waterm
DeepSeek เปลี่ยนโครงสร้างราคา API ของโมเดล V4-Flash และ V4-Pro จากอัตราเดียวตลอดวันเป็นระบบ พีก/นอกพีก (peak/off-peak) ตั้งแต่เวลา 00:00 น. ตามเวลาปักกิ่ง วันที่ 17 สิงหาคม 2026 หรือ 16:00 น. UTC ของวันที่ 16 สิงหาคม โดยราคาช่วงนอกพีกอยู่ที่ครึ่งหนึ่งของราคาช่วงพีกอย่างแน่นอน 1
2
สำหรับผู้พัฒนา ความเปลี่ยนแปลงนี้ไม่ได้หมายถึงการขึ้นราคาแบบอัตราเดียวทั้งระบบ แต่หมายความว่าคำขอเดียวกันอาจมีต้นทุนต่างกันถึง 2 เท่า ขึ้นอยู่กับเวลาที่เซิร์ฟเวอร์ของแพลตฟอร์มได้รับคำขอ 7
ช่วงพีกของ DeepSeek ตามเวลาปักกิ่งมี 2 ช่วงต่อวัน ได้แก่
ช่วงเวลาอื่นทั้งหมดถือเป็นช่วงนอกพีก โดยระบบจะตัดสินอัตราค่าบริการจากเวลาที่แพลตฟอร์มได้รับคำขอ ไม่ใช่เวลาที่การประมวลผลเสร็จสิ้น 2
7
หากอ้างอิงเวลาไทย ซึ่งช้ากว่าเวลาปักกิ่ง 1 ชั่วโมง ช่วงพีกจะอยู่ที่ 08:00–11:00 น. และ 13:00–17:00 น. แต่ระบบยังใช้เวลาที่เซิร์ฟเวอร์ได้รับคำขอตามเขตเวลาปักกิ่งเป็นเกณฑ์หลัก
ตัวเลขทั้งหมดด้านล่างเป็นเงินหยวนต่อ 1 ล้านโทเคน โดย cache hit หมายถึงอินพุตที่ใช้ส่วนต้นของพรอมต์ซึ่งถูกแคชไว้แล้ว ส่วน cache miss หมายถึงอินพุตที่ไม่พบข้อมูลในแคชและต้องประมวลผลในอัตราที่สูงกว่า
| โมเดลและประเภทโทเคน | ราคาเดิม | ราคานอกพีก | เปลี่ยนแปลงจากเดิม | ราคาพีก | เปลี่ยนแปลงจากเดิม |
|---|---|---|---|---|---|
| V4-Flash อินพุตแบบ cache hit | ¥0.02 | ¥0.05 | +150% | ¥0.10 | +400% |
| V4-Flash อินพุตแบบ cache miss | ¥1.00 | ¥1.50 | +50% | ¥3.00 | +200% |
| V4-Flash เอาต์พุต | ¥2.00 | ¥4.50 | +125% | ¥9.00 | +350% |
| V4-Pro อินพุตแบบ cache hit | ¥0.025 | ¥0.15 | +500% | ¥0.30 | +1,100% |
| V4-Pro อินพุตแบบ cache miss | ¥3.00 | ¥4.50 | +50% | ¥9.00 | +200% |
| V4-Pro เอาต์พุต | ¥6.00 | ¥13.50 | +125% | ¥27.00 | +350% |
สำหรับ V4-Flash เอกสารราคาแสดงอัตรานอกพีกที่ ¥0.05, ¥1.50 และ ¥4.50 สำหรับอินพุตแบบ cache hit, อินพุตแบบ cache miss และเอาต์พุตตามลำดับ ส่วนช่วงพีกอยู่ที่ ¥0.10, ¥3 และ ¥9 2
เมื่อมองภาพรวม การปรับราคาครั้งนี้ทำให้อัตราใหม่สูงกว่าราคาเดิมตั้งแต่ 50% ถึง 1,100% ขึ้นอยู่กับโมเดล ประเภทโทเคน และช่วงเวลาที่ใช้งาน 1
8
งานประเมินโมเดล การทำดัชนีเอกสาร การประมวลผลข้อมูลย้อนหลัง การสร้างข้อมูลสังเคราะห์ และงานเอเจนต์ที่ไม่เร่งด่วน สามารถจัดคิวให้ทำงานนอกช่วง 2 หน้าต่างพีกได้ เมื่อราคานอกพีกอยู่ที่ครึ่งหนึ่งของราคาพีก การจัดตารางเวลาเพียงอย่างเดียวก็อาจช่วยลดต้นทุนของงานที่ยืดหยุ่นด้านเวลาได้อย่างมีนัยสำคัญ 2
สำหรับทีมวิศวกร นี่ทำให้เขตเวลากลายเป็นตัวแปรใหม่ของระบบ AI โครงสร้างคิวงานควรรู้ทั้งกำหนดส่งและช่วงเวลาคิดค่าบริการตามเวลาปักกิ่ง เพื่อเลื่อนงานที่ไม่เร่งด่วนออกไปโดยไม่ต้องเปลี่ยนโมเดลหรือลดงบโทเคน
แชตบริการลูกค้า ผู้ช่วยเขียนโค้ด และเอเจนต์แบบเรียลไทม์มักทำงานในเวลาที่ผู้ใช้กำลังใช้งาน จึงมีโอกาสต้องรับต้นทุนช่วงพีกมากกว่า อย่างไรก็ตาม ยังลดค่าใช้จ่ายได้ด้วยการนำพรอมต์กลับมาใช้ซ้ำ ออกแบบคำขอให้เหมาะกับระบบแคช จำกัดความยาวเอาต์พุต และเลือกส่งงานบางประเภทไปยัง Flash แทน Pro
การแคชมีความสำคัญเป็นพิเศษ เพราะอินพุตแบบ cache hit ยังถูกกว่าอินพุตแบบ cache miss อย่างมากในทั้งสองโมเดล สำหรับระบบที่ส่งคำสั่งเดิม คำจำกัดความเครื่องมือ หรือบริบทเอกสารเดิมซ้ำ ๆ การเพิ่มอัตรา cache hit อาจช่วยได้มากกว่าการลดจำนวนคำขอเพียงเล็กน้อย
การสร้างบทสรุปหรือรายงานยาว การสร้างโค้ดจำนวนมาก และกระบวนการให้เหตุผลที่มีเอาต์พุตยาว ล้วนใช้โทเคนเอาต์พุตสูงขึ้น ช่วงพีก เอาต์พุตของ Flash มีราคา ¥9 ต่อ 1 ล้านโทเคน ขณะที่ Pro อยู่ที่ ¥27 1
2
แนวทางรับมือคือกำหนดเพดานเอาต์พุตให้รัดกุมขึ้น ใช้ Flash สำหรับงานทั่วไป และเก็บ Pro ไว้สำหรับงานที่ความสามารถเพิ่มเติมคุ้มกับต้นทุนที่สูงกว่า
ราคาอินพุตแบบ cache hit ของ V4-Pro ในช่วงพีกเพิ่มเป็น 12 เท่าของราคาเดิม ซึ่งเป็นการเพิ่มขึ้นในเชิงเปอร์เซ็นต์สูงที่สุดของตารางใหม่ แม้ราคาต่อหน่วยยังต่ำกว่าอินพุตแบบไม่พบแคชและเอาต์พุตมาก แต่การเปลี่ยนแปลงนี้มีนัยสำคัญต่อระบบที่ประมวลผลพรอมต์ซึ่งถูกแคชซ้ำ ๆ ในปริมาณมหาศาล 1
19
การปรับราคาเกิดขึ้นหลัง DeepSeek เปิดให้ใช้งาน DeepSeek-V4-Pro-0813 โดยทั่วไปผ่านเอนด์พอยต์ deepseek-v4-pro ในเดือนสิงหาคม รายละเอียดที่มีการรายงานระบุว่าเป็นโมเดลข้อความที่มีบริบทสูงสุด 1 ล้านโทเคน เอาต์พุตสูงสุด 384,000 โทเคน และใช้สถาปัตยกรรม Mixture of Experts ซึ่งมีพารามิเตอร์รวมประมาณ 1.6 ล้านล้านพารามิเตอร์ และมีพารามิเตอร์ที่ทำงานอยู่ราว 49,000 ล้านพารามิเตอร์ต่อโทเคน 29
33
ข้อจำกัดจำนวนคำขอพร้อมกันที่มีการระบุไว้ยังแตกต่างกันระหว่างสองระดับ ได้แก่
หนึ่งคำขอจะใช้ช่องความจุจนกว่าจะประมวลผลเสร็จ รวมถึงกรณีที่ส่งผลลัพธ์แบบสตรีมมิง 28
เมื่อพิจารณาราคาและข้อจำกัดด้านความจุร่วมกัน โครงสร้างนี้บ่งชี้ว่า Flash เหมาะกับงานทั่วไปที่ต้องการปริมาณการประมวลผลสูง ขณะที่ Pro เป็นระดับที่มีความจุจำกัดกว่าและวางไว้สำหรับงานให้เหตุผลที่ซับซ้อนหรือการประมวลผลบริบทขนาดใหญ่ ข้อสรุปดังกล่าวเป็นการอนุมานจากราคาและข้อจำกัดที่เผยแพร่ ไม่ใช่คำกล่าวโดยตรงว่าเหมาะกับทุกกรณีใช้งาน 2
28
การเปลี่ยนแปลงของ DeepSeek คล้ายแนวคิดการบริหารอุปสงค์สำหรับการประมวลผลอนุมานบน GPU ผู้ให้บริการต้องรับมือกับความต้องการที่กระจุกตัวในช่วงที่ผู้ใช้แบบโต้ตอบออนไลน์ ขณะที่งานแบบแบตช์จำนวนมากสามารถรอได้ การตั้งราคาสูงขึ้นในช่วงดังกล่าวและลดลงในช่วงอื่นจึงช่วยจูงใจให้ผู้ใช้กระจายการประมวลผลตลอดวัน
สำหรับนักพัฒนา ปัญหาการเพิ่มประสิทธิภาพจึงไม่ได้มีแค่การเลือกโมเดลและนับจำนวนโทเคนอีกต่อไป แต่ต้องตอบคำถามสำคัญด้วยว่า
ในภาพใหญ่ การเคลื่อนไหวนี้สะท้อนการเปลี่ยนจากการแข่งขันลดราคาแบบอัตราคงที่ ไปสู่การตั้งราคาตามความขาดแคลนของกำลังประมวลผล DeepSeek ยังคงมีช่องทางต้นทุนต่ำกว่าสำหรับงานที่เลื่อนเวลาได้ แต่กำลังทำให้ต้นทุนของการใช้โมเดลระดับสูงอ่อนไหวต่อช่วงเวลาที่เลือกใช้งานมากขึ้น Reuters อธิบายการเปลี่ยนแปลงนี้ว่าเป็นการขึ้นราคาครั้งใหญ่ที่แตกต่างกันไปตามโมเดล ประเภทโทเคน และช่วงเวลาการใช้งาน ไม่ใช่การบวกค่าบริการเท่ากันทุกกรณี 1
บทเรียนเชิงปฏิบัติสำหรับทีมที่ใช้ DeepSeek V4 คือควรมองการจัดตารางเวลา การแคช การเลือกเส้นทางโมเดล และการควบคุมเอาต์พุตเป็นส่วนหนึ่งของโมเดลต้นทุน API หากงานไม่สามารถเลื่อนเวลาได้ อาจต้องเปลี่ยนไปใช้โมเดลอื่นหรือลดงบโทเคน แต่หากงานรอได้ การรันในช่วงนอกพีกอาจช่วยรักษาความคุ้มค่าไว้ได้มาก
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
DeepSeek เปลี่ยน V4 Flash และ V4 Pro จากราคาแบบคงที่เป็นระบบคิดตามเวลาเมื่อเวลา 00:00 น.
DeepSeek เปลี่ยน V4 Flash และ V4 Pro จากราคาแบบคงที่เป็นระบบคิดตามเวลาเมื่อเวลา 00:00 น. ช่วงพีกคือ 09:00–12:00 น. และ 14:00–18:00 น.
การเลือกโมเดล การใช้พรอมต์แคช และการจัดเวลางานกลายเป็นปัจจัยที่ต้องวางแผนร่วมกันเพื่อควบคุมค่าใช้จ่าย API