Harga API DeepSeek V4 Flash dan V4 Pro meningkat antara 50% hingga 1,100%, dengan kadar waktu puncak ditetapkan dua kali ganda berbanding waktu luar puncak. DeepSeek kini cuba mengewangkan permintaan pembangun dan kapasiti pengkomputeran, sementara OpenAI menggunakan akses percuma untuk mengekalkan tabiat penggunaan...
Research answer

Create a landscape editorial hero image for this Studio Global article: How did the latest pricing and access decisions by DeepSeek and OpenAI illustrate the intensifying US–China AI competition, and what were th. Article summary: These moves show competition shifting from a simple “cheapest model wins” contest to a two-front battle: Chinese providers are monetizing enormous developer demand while retaining major cost advantages, and OpenAI is def. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Keputusan harga terbaharu DeepSeek dan OpenAI menunjukkan persaingan AI kini semakin berlapis. DeepSeek mengenakan bayaran lebih tinggi untuk beban kerja API berskala besar sambil memperkenalkan caj mengikut waktu. OpenAI pula meluaskan akses percuma kepada sembang teks bagi memastikan pengguna terus berada dalam ekosistem ChatGPT.
Kedua-dua langkah ini menggambarkan bahawa persaingan Amerika Syarikat–China bukan lagi sekadar soal siapa menawarkan model paling murah. Kapasiti pusat data, pengedaran kepada pengguna, penerimaan pembangun dan kos menjalankan AI pada skala besar turut menjadi penentu.
DeepSeek mengumumkan kenaikan harga untuk API V4-Flash dan V4-Pro pada 13 Ogos. Jadual baharu itu berkuat kuasa pada 16:00 UTC, 16 Ogos — bersamaan 17 Ogos di Beijing — dan menggantikan harga rata dengan kadar waktu puncak serta luar puncak.
Waktu puncak ditetapkan dari 01:00 hingga 04:00 UTC dan 06:00 hingga 10:00 UTC. Semua waktu lain dikategorikan sebagai luar puncak. Kadar waktu puncak pula adalah dua kali ganda kadar luar puncak.
Harga di bawah dinyatakan dalam dolar AS bagi setiap 1 juta token:
| Model | Tempoh | Input berjaya cache | Input tidak berjaya cache | Output |
|---|---|---|---|---|
| V4-Flash | Luar puncak | $0.007 | $0.22 | $0.66 |
| V4-Flash | Puncak | $0.014 | $0.44 | $1.32 |
| V4-Pro | Luar puncak | $0.022 | $0.66 | $1.98 |
| V4-Pro | Puncak | $0.044 | $1.32 | $3.96 |
Besarnya kenaikan berbeza mengikut model, jenis token, status cache dan waktu penggunaan. Reuters menyifatkan perubahan keseluruhan itu sebagai antara 50% hingga 1,100% lebih tinggi daripada harga terdahulu.
Kesan paling ketara dirasai oleh beban kerja yang menghasilkan banyak output pada waktu puncak. Harga output V4-Pro meningkat daripada $0.87 bagi setiap 1 juta token kepada $1.98 pada waktu luar puncak dan $3.96 pada waktu puncak.
Sebagai contoh, ejen pengekodan yang menghasilkan 10 juta token output sebulan akan menelan kos kira-kira $8.70 di bawah kadar lama. Kos itu meningkat kepada sekitar $19.80 jika semua output dijana di luar waktu puncak, atau $39.60 jika semuanya berlaku pada waktu puncak — belum termasuk caj token input.
Struktur baharu DeepSeek menjadikan penjadualan sebahagian daripada pengurusan kos API. Pembangun yang menjalankan tugas kelompok, ejen pengekodan, penilaian model atau beban kerja tidak mendesak boleh cuba mengalihkan trafik ke 17 jam waktu luar puncak setiap hari.
Namun, aplikasi interaktif mempunyai ruang yang lebih terhad kerana permintaan datang ketika pengguna memerlukan jawapan. Dalam keadaan ini, masa penggunaan bukan sesuatu yang boleh diubah sesuka hati.
Caching dan penghalaan model juga menjadi semakin penting. Sistem yang meningkatkan kadar cache berjaya, menghantar tugasan rutin kepada V4-Flash atau mengalihkan permintaan tertentu kepada penyedia lain boleh mengurangkan pendedahan kepada kadar baharu.
Bagi pasukan perusahaan, pemilihan model kini bukan lagi perbandingan penanda aras yang dibuat sekali sahaja. Ia menjadi keputusan operasi yang melibatkan kos, latensi, kebolehpercayaan, caching dan keupayaan bertukar antara penyedia.
Kenaikan ini tidak menghapuskan daya tarikan kos DeepSeek, tetapi ia mengecilkan kelebihan yang sebelum ini datang daripada inferens yang sangat murah. Caj waktu puncak juga selari dengan usaha penyedia mengurus permintaan dan mendapatkan nilai lebih tinggi daripada kapasiti pengkomputeran yang terhad. Bahan awam dalam laporan ini bagaimanapun belum membuktikan bahawa DeepSeek sudah mencapai keuntungan atau mempunyai laluan yang disahkan ke arah itu.
OpenAI mengambil pendekatan berbeza. Pada 6 Ogos, syarikat itu mengumumkan bahawa GPT-5.6 Luna akan menjadi model lalai untuk pengguna ChatGPT Free dan Go, menggantikan GPT-5.5. Kedua-dua pelan itu turut menerima sembang teks harian tanpa had serta pilihan Think untuk soalan yang lebih sukar, tertakluk pada perlindungan penyalahgunaan.
Namun, perkataan “tanpa had” tidak bermaksud semua fungsi ChatGPT boleh digunakan tanpa sekatan. Had berasingan masih dikenakan untuk muat naik fail, penjanaan imej dan alat lain. Pengguna Free dan Go juga tidak mendapat GPT-5.6 Sol; Luna ialah model lalai untuk pengalaman mereka dan turut menggerakkan fungsi Think.
Luna diposisikan sebagai model yang lebih ekonomik dalam keluarga GPT-5.6, bukannya model utama Sol. Laporan pihak ketiga menyenaraikan harga API sebanyak $0.20 bagi setiap 1 juta token input dan $1.20 bagi setiap 1 juta token output, tetapi angka itu tidak dapat disahkan di sini melalui sumber berautoriti tertinggi yang disediakan.
Perbezaan strategiknya lebih jelas: Luna pada asasnya percuma untuk penggunaan sembang teks dalam ChatGPT Free dan Go, manakala akses API masih merupakan produk berbayar yang berasingan.
Perubahan harga ini berlaku ketika model China meraih trafik pembangun yang besar. Bloomberg melaporkan bahawa model China mengatasi platform Amerika Syarikat di OpenRouter pada Jun dan menguasai lebih 60% bahagian token pada bulan berikutnya.
OpenRouter ialah platform yang membolehkan pembangun menghala permintaan kepada pelbagai model AI. Oleh itu, datanya berguna untuk melihat tingkah laku penghalaan model dalam kalangan pembangun, tetapi tidak boleh dianggap sebagai ukuran lengkap penggunaan AI di seluruh dunia.
Pertumbuhan itu bukan hanya didorong oleh DeepSeek. Kedudukan OpenRouter bagi Julai meletakkan model yang dibangunkan di China pada kelima-lima tempat teratas berdasarkan jumlah token: MiMo-V2.5 milik Xiaomi, DeepSeek, MiniMax, keluarga Qwen Alibaba dan Kimi milik Moonshot.
Analisis lain pula mengenal pasti DeepSeek sebagai vendor individu terbesar di platform tersebut, dengan bahagian 17.6% dalam satu kedudukan Jun.
Corak ini membantu menjelaskan mengapa harga masih menjadi perkara utama. Beban kerja pengekodan dan ejen yang menggunakan token dalam jumlah besar cenderung memihak kepada model yang cukup murah untuk dijalankan berulang kali.
Pada masa yang sama, langkah OpenAI menunjukkan bahawa penggunaan boleh dimenangi melalui pengedaran produk, bukan harga API sahaja. Dengan meletakkan model berkebolehan di hadapan pengguna percuma, OpenAI boleh menggalakkan penggunaan berulang, menerima lebih banyak maklum balas dan berpotensi menukar sebahagian pengguna kepada produk berbayar pada masa depan.
DeepSeek dan OpenAI sedang menangani sisi berbeza daripada tekanan pasaran yang sama:
Sebab itu perang harga AI tidak semestinya berakhir walaupun sesetengah harga meningkat. Persaingan kini terbahagi kepada beberapa lapisan: inferens kos rendah dan ketersediaan model dengan berat terbuka di satu pihak, serta capaian pengguna, integrasi produk, keupayaan premium dan kawalan perusahaan di pihak yang lain.
Kenaikan harga DeepSeek mengingatkan bahawa harga API yang rendah boleh menarik penggunaan besar-besaran tanpa menjamin kos akan kekal rendah. Pelancaran Luna secara percuma oleh OpenAI pula ialah pertaruhan yang berbeza: mensubsidi pengalaman pengguna yang luas untuk mengukuhkan pengedaran, kemudian membezakan perkhidmatan melalui peringkat model dan ciri bukan teks.
Bagi pembangun dan pembeli perusahaan, pengajaran praktikalnya ialah jangan menganggap mana-mana helaian harga atau penanda aras sebagai kekal. Kos boleh berubah mengikut permintaan, tahap model, status cache dan waktu penggunaan.
Seni bina yang lebih tahan lasak ialah seni bina yang mengukur beban kerja sebenar, mengekalkan beberapa pilihan penghalaan dan memadankan setiap tugasan dengan model serta tahap akses yang sesuai dengan risiko perniagaan dan keperluan kos.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Harga API DeepSeek V4 Flash dan V4 Pro meningkat antara 50% hingga 1,100%, dengan kadar waktu puncak ditetapkan dua kali ganda berbanding waktu luar puncak.
Harga API DeepSeek V4 Flash dan V4 Pro meningkat antara 50% hingga 1,100%, dengan kadar waktu puncak ditetapkan dua kali ganda berbanding waktu luar puncak. DeepSeek kini cuba mengewangkan permintaan pembangun dan kapasiti pengkomputeran, sementara OpenAI menggunakan akses percuma untuk mengekalkan tabiat penggunaan ChatGPT.
Model China menguasai lebih 60% bahagian token di OpenRouter dalam tempoh laporan terkini, tetapi angka itu hanya mencerminkan pasaran penghalaan model untuk pembangun, bukan keseluruhan penggunaan AI global.