Kadar kenaikan berbeza mengikut model, jenis token dan waktu penggunaan. Reuters melaporkan bahawa harga baharu itu antara 50% hingga 1,100% lebih tinggi berbanding kadar terdahulu.
Perubahan peratusan terbesar berlaku pada harga input cache-hit kerana ia bermula daripada asas yang sangat kecil. Bagi pembangun, kesan sebenar bergantung pada gabungan input yang menggunakan cache, input tanpa cache, jumlah output yang dijana dan waktu operasi dijalankan.
Sebagai contoh, output V4-Pro berharga kira-kira 128% lebih tinggi pada waktu luar puncak berbanding kadar promosi terdahulu $0.87, dan kira-kira 355% lebih tinggi pada waktu puncak berdasarkan harga yang disenaraikan.
Walaupun dinaikkan, DeepSeek masih murah berbanding banyak model AI tertutup dari Amerika Syarikat. Laporan terdahulu menyenaraikan output V4-Pro pada kira-kira $0.87 bagi setiap 1 juta token di bawah harga promosi, berbanding harga sejarah yang jauh lebih tinggi bagi sistem AI utama AS. Kenaikan ini mengecilkan kelebihan kos DeepSeek, tetapi tidak menghapuskannya.
Bayangkan seorang pembangun menjana 10 juta token output V4-Pro setiap bulan:
Ini bermakna bil output sahaja meningkat kira-kira $11.10 hingga $30.90 sebulan, bergantung pada masa tugas dijalankan. Pengiraan ini tidak termasuk token input, caj cache-hit, cukai atau yuran platform lain.
Untuk aplikasi produksi, isu lebih besar mungkin terletak pada komposisi beban kerja, bukan jumlah output semata-mata. Sistem dengan arahan yang panjang, penggunaan semula cache yang rendah atau trafik yang tertumpu pada waktu puncak boleh mengalami kenaikan kos yang jauh berbeza.
Justeru, pembangun mungkin perlu menjadualkan kerja kelompok pada waktu luar puncak dan memantau kadar cache-hit dengan lebih teliti.
OpenAI mengumumkan perubahan yang berbeza bagi ChatGPT. GPT-5.6 Luna menjadi model lalai untuk pengguna Free dan Go, sementara OpenAI turut menawarkan chat teks tanpa had serta butang Think baharu untuk soalan yang lebih sukar.
Namun, tajuk “tanpa had” perlu difahami dengan tepat. Akses tanpa had itu hanya terpakai kepada chat teks, bukan semua keupayaan ChatGPT. Had masih dikenakan terhadap muat naik fail, imej, suara, penjanaan imej dan alat lain, selain perlindungan terhadap penyalahgunaan.
Ini ialah strategi pengedaran pengguna, bukannya strategi harga API. OpenAI mengurangkan halangan untuk penggunaan harian dan memastikan model yang berkeupayaan kekal dalam pengalaman ChatGPT lalai. Menurut laporan TechCrunch mengenai pengumuman itu, ChatGPT baru-baru ini melepasi 1 bilion pengguna mingguan.
Harga token yang rendah membantu model China menarik penggunaan daripada pembangun. Satu ukuran Vercel AI Gateway mendapati model open-weight yang dibangunkan di China memproses 29% token produksi pada Jun 2026, meningkat daripada kira-kira satu per sembilan pada April. Model tersebut bagaimanapun menyumbang kurang daripada 4% jumlah perbelanjaan di gerbang itu. Angka ini hanya menggambarkan trafik pada gerbang berkenaan, bukan keseluruhan pasaran AI global.
Perbezaan itu penting. Bahagian token menunjukkan jumlah kerja yang mengalir melalui sesuatu sistem, tetapi tidak dengan sendirinya membuktikan hasil, keuntungan, kesetiaan pelanggan atau kuasa pasaran yang berkekalan.
Pembangun boleh menghala beban kerja antara penyedia, manakala trafik yang sensitif terhadap harga boleh berpindah dengan pantas apabila kadar berubah.
Jadual baharu DeepSeek menunjukkan bahawa mendapatkan penggunaan sahaja bukan lagi matlamat tunggal. Harga berdasarkan waktu memberi syarikat itu cara untuk mengagihkan kapasiti mengikut tempoh permintaan tinggi dan mengenakan caj lebih apabila trafik tertumpu.
Dokumentasi rasmi DeepSeek menerangkan perubahan ini sebagai langkah pengagihan sumber yang lebih munasabah serta menggalakkan pengguna menjadualkan tugas berdasarkan corak penggunaan sebenar.
Perubahan itu juga berlaku ketika syarikat AI China lain mula memperkenalkan tawaran berbayar atau mempertimbangkan harga yang lebih tinggi. Laporan mengenai pasaran China yang lebih luas menyebut Moonshot AI dan ByteDance telah memperkenalkan pelan berbayar, manakala Alibaba bersedia mengikut langkah tersebut. Ini menunjukkan peralihan daripada subsidi agresif kepada pengewangan.
Ia masih belum membuktikan bahawa DeepSeek atau pesaingnya telah mencatat keuntungan. Namun, ia menunjukkan bahawa bahagian pasaran yang dibina melalui harga rendah akhirnya perlu ditukar kepada hasil bagi setiap token, kontrak berulang atau model perniagaan lain yang mampan.
Pelancaran Luna secara percuma menekankan pengedaran, bukan bil API yang paling murah. Dengan menjadikan chat teks tersedia secara meluas dan menambah kawalan Think yang mudah dilihat, OpenAI cuba menjadikan ChatGPT sebahagian daripada tabiat harian pengguna. Pada masa sama, had yang lebih ketat masih dikenakan terhadap ciri yang memerlukan kos pengiraan lebih tinggi.
Perbezaan strategi kedua-dua syarikat itu jelas:
Kedua-dua strategi ini boleh wujud serentak. Seorang pembangun mungkin memilih DeepSeek untuk beban kerja volum tinggi, sementara pengguna biasa menggunakan ChatGPT bagi bantuan umum.
Namun, setiap syarikat cuba menjadikan ekosistemnya lebih sukar digantikan—DeepSeek melalui gabungan prestasi dan kos serta penghalaan pembangun, manakala OpenAI melalui kebiasaan produk dan jangkauan pengguna.
DeepSeek masih merupakan pilihan kos rendah, tetapi selepas perubahan ini, label “model paling murah” tidak lagi mencukupi. Pembangun perlu membandingkan jumlah bil berdasarkan input cache-hit, input cache-miss, jumlah output dan tumpuan trafik pada waktu puncak.
Soalan praktikal yang perlu ditanya kini ialah:
Persaingan AI China-AS kini semakin kurang berkisar tentang siapa yang boleh menawarkan kadar utama paling rendah. DeepSeek sedang menguji sama ada kepimpinan dari segi nisbah kos-prestasi boleh ditukar kepada ekonomi unit yang mampan. OpenAI pula menguji sama ada akses pengguna percuma yang menjadi kebiasaan boleh menghasilkan kawalan ekosistem yang bertahan lama.
Dalam kedua-dua kes, cabaran asasnya sama: menukar penggunaan yang sangat besar kepada perniagaan yang mampu terus membiayai kos pengkomputeran model AI termaju.