Menurut dokumentasi API rasmi DeepSeek, sebaik promosi tamat, harga API model ini akan dilaraskan secara kekal kepada satu perempat daripada harga asalnya, secara efektif menjadikan harga diskaun sebagai kadar standard baharu.
Sebelum diskaun, harga asas yang disenaraikan adalah kira-kira $1.74 per juta token input dan $3.48 per juta token output, bermakna harga semasa mewakili perubahan langkah yang berkekalan, bukan promosi pemasaran jangka pendek.
Harga DeepSeek menonjol paling jelas apabila dibandingkan dengan model AI perbatasan yang lain.
OpenAI GPT‑5.5
Anthropic Claude Opus 4.7
DeepSeek V4‑Pro
Ini bermaksud:
Bagi pembangun yang menjalankan beban kerja volum tinggi — seperti pembantu pengekodan, ejen, saluran analisis dokumen, atau sistem sokongan pelanggan — harga token selalunya menguasai jumlah kos operasi. Perbezaan sebesar ini boleh mengubah seni bina mana yang berdaya maju dari segi ekonomi.
Di luar harga, V4‑Pro juga bersaing secara teknikal dengan model perbatasan.
Spesifikasi utama termasuk:
Model ini dibina menggunakan seni bina Mixture‑of‑Experts (MoE) dengan kira-kira 1.6 trilion jumlah parameter dan kira-kira 49 bilion parameter aktif setiap langkah inferens, membolehkan kapasiti tinggi tanpa kos pengiraan yang berkadar lebih tinggi.
Tetingkap konteks besar amat berguna untuk:
Digabungkan dengan harga token yang sangat rendah, keupayaan ini membolehkan kes penggunaan yang akan menjadi terlalu mahal dengan model yang lebih tinggi harganya.
Bagi banyak pasukan, kos inferens — bukan keupayaan model — adalah faktor pengehad apabila menggunakan AI pada skala besar. Harga token yang sangat rendah membolehkan pembangun:
Secara praktikal, perbezaan antara $0.87 dan $25 per juta token output boleh mengubah aliran kerja yang sebelum ini bersifat eksperimen kepada produk yang berdaya maju dari segi ekonomi.
Strategi DeepSeek mencerminkan peralihan yang lebih besar yang sedang berlaku dalam industri AI.
Dari segi sejarah, model perbatasan dihargai dalam lingkungan beberapa dolar hingga puluhan dolar per juta token, seperti yang dilihat dengan GPT‑5.5 dan Claude Opus 4.7.
DeepSeek sebaliknya mengejar model harga dipacu volum, menawarkan inferens yang jauh lebih murah sambil mengekalkan keupayaan kompetitif. Penganalisis menyatakan bahawa modelnya telah berulang kali mengurangkan harga pembekal sedia ada dengan margin yang besar, membantu menekan kos AI keseluruhan ke bawah merentas pasaran.
Pendekatan ini mencerminkan dinamik yang dilihat dalam pengkomputeran awan dan GPU: sebaik sahaja vendor membuktikan sistem berprestasi tinggi boleh berjalan dengan lebih murah, keseluruhan pasaran terpaksa bertindak balas.
Langkah harga DeepSeek menimbulkan beberapa persoalan strategik untuk ekosistem AI:
Apa yang sudah jelas ialah harga token — yang dahulunya dianggap sebagai bahagian yang agak stabil dalam timbunan AI — kini menjadi senjata kompetitif. Dan jika harga DeepSeek kekal, kos membina sistem AI berskala besar mungkin jatuh lebih cepat daripada jangkaan ramai pembangun.