Indeks harga token LLM campuran Silicon Data mencatat paras terendah AS$0.97 bagi sejuta token pada 1 September 2026, kurang daripada separuh paras tertingginya pada awal musim panas. Kadar V4 Flash DeepSeek, iaitu AS$0.14 bagi sejuta token input, menggambarkan betapa rendahnya harga API baharu; penggunaan token AI...
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How has the Chinese AI-lab price war—marked by June 2026 international API cuts of 50–99% by DeepSeek, Alibaba Cloud, ByteDance, Moonshot AI. Article summary: China’s price war appears to have reset the marginal market price of LLM inference rather than reduced demand. Aggressive low-cost Chinese APIs pulled customers toward cheaper models and altered the usage mix, helping dr. Topic tags: general, general web, user generated, education, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermark
Indeks LLM Token Expenditure Index (SDLLMTK) oleh Silicon Data jatuh kepada AS$0.97 bagi sejuta token pada 1 September 2026 — paras rekod terendah dan kurang daripada separuh puncaknya pada awal musim panas. Persaingan harga API yang sengit dalam ekosistem AI China membantu mengubah jangkaan tentang kos inferens model bahasa besar (LLM) untuk tugasan biasa. Namun, harga yang jatuh ini bukan tanda permintaan AI merosot. 2
4
Perkara pentingnya: indeks itu mengukur harga efektif campuran bagi sejuta token berdasarkan penggunaan, bukannya jumlah semua token yang digunakan atau seluruh nilai belanja AI dalam pasaran.
Silicon Data menerangkan SDLLMTK sebagai penanda aras harga token inferens LLM campuran. Ia menggabungkan harga penyedia dengan corak penggunaan yang diperhatikan dalam set model tertentu, lalu menghasilkan harga efektif pasaran bagi setiap sejuta token. 2
4
Jadi, jika pelanggan mengalihkan lebih banyak tugasan kepada model yang lebih murah, indeks boleh menurun walaupun jumlah token diproses — malah jumlah wang yang dibelanjakan organisasi untuk AI — meningkat. Indeks ini mencerminkan perubahan pada harga dan campuran beban kerja, bukan hasil keseluruhan pasaran AI.
Persaingan tersebut menawarkan pilihan kos rendah bagi tugasan yang tidak memerlukan model paling canggih dan mahal. DeepSeek V4-Flash, misalnya, disenaraikan pada kadar AS$0.14 bagi sejuta token input dan AS$0.28 bagi sejuta token output. 49
DeepSeek juga menurunkan harga V4-Pro sebanyak 75% pada Mei 2026, satu langkah yang dilaporkan sebagai peningkatan persaingan antara penyedia model China. 58 Langkah penetapan harga lain serta penawaran murah daripada pemain ekosistem China meningkatkan tekanan terhadap penyedia yang bersaing untuk beban kerja inferens berskala besar.
4
52
Bukti yang ada menunjukkan kaitan kukuh antara persekitaran persaingan ini dengan kejatuhan harga token campuran. Namun, ia tidak mengasingkan secara tepat berapa besar sumbangan mana-mana makmal, model atau potongan harga tertentu. Peningkatan kecekapan model, pertambahan kapasiti pengkomputeran dan keputusan pelanggan sendiri dalam memilih model turut mempengaruhi indeks.
Hubungan asasnya mudah:
jumlah belanja token = harga efektif setiap token × jumlah token
Apabila harga seunit turun, lebih banyak kes penggunaan menjadi berdaya maju dari sudut ekonomi. Syarikat boleh mengautomasi lebih banyak aliran kerja, menggunakan arahan dan konteks lebih panjang, menjana lebih banyak kod, atau mengendalikan lebih banyak sistem berasaskan ejen AI. Jika jumlah token tumbuh lebih pantas daripada penurunan harga efektif, belanja keseluruhan tetap meningkat.
Corak itu selaras dengan laporan bahawa harga setiap token telah susut lebih 90% sejak 2023, sementara belanja penggunaan LLM kira-kira berganda sejak lewat 2025. 41
43 Mekanismenya bukan kegagalan potongan harga, sebaliknya peluasan penggunaan: inferens yang lebih murah membesarkan jumlah tugas yang wajar diautomasi.
Penggunaan token AI harian di China dilaporkan melepasi 140 trilion menjelang Mac 2026, meningkat daripada 100 trilion pada penghujung 2025, berdasarkan unjuran kerajaan yang dipetik Reuters. 18
Pendedahan syarikat dan sektor kewangan juga menunjukkan arah yang sama. China Merchants Bank berkata purata daya pemprosesan token hariannya meningkat lebih 78% tahun ke tahun. Laporan berasingan pula meletakkan penggunaan hariannya sekitar 33 bilion token pada akhir Mei. 19
29 Beberapa bank China lain turut dilaporkan mencatat peningkatan jauh lebih besar dalam penggunaan token harian purata.
20
Angka ini tidak patut dianggap sebagai ukuran langsung hasil API atau bukti bahawa setiap beban kerja memberi pulangan ekonomi. Namun, ia menunjukkan inferens berharga rendah sedang diterjemahkan kepada penggunaan yang jauh lebih tinggi pada skala besar.
Bagi pembeli AI, harga inferens yang semakin rendah jelas menguntungkan. Bagi vendor model pula, persamaannya menjadi lebih sukar: hasil bagi setiap token mungkin susut, sedangkan perbelanjaan untuk cip, pusat data, latihan dan pembangunan model kekal besar.
Soalan utamanya bukan lagi sama ada pelanggan akan menggunakan token murah — bukti semasa menunjukkan mereka akan berbuat demikian. Sebaliknya, persoalannya ialah sama ada jumlah penggunaan yang lebih tinggi, tawaran premium dan produk perusahaan dapat menjana hasil mampan serta peningkatan produktiviti yang boleh diukur dengan cukup pantas untuk menyokong pelaburan infrastruktur berterusan. Penurunan indeks itu telah menonjolkan risiko terhadap kuasa penetapan harga penyedia. 4
36
Jangan hanya melihat harga senarai sebuah model. Perhatikan hubungan antara:
Kesimpulannya, persaingan API kos rendah dari China telah membantu menjadikan inferens LLM jauh lebih murah dan menolak harga pasaran campuran ke bawah AS$1 bagi sejuta token. Namun, harga rendah menggalakkan penggunaan lebih meluas. Sebab itu penggunaan token dan belanja AI agregat boleh terus meningkat serentak. 2
4
41
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Indeks harga token LLM campuran Silicon Data mencatat paras terendah AS$0.97 bagi sejuta token pada 1 September 2026, kurang daripada separuh paras tertingginya pada awal musim panas.
Indeks harga token LLM campuran Silicon Data mencatat paras terendah AS$0.97 bagi sejuta token pada 1 September 2026, kurang daripada separuh paras tertingginya pada awal musim panas. Kadar V4 Flash DeepSeek, iaitu AS$0.14 bagi sejuta token input, menggambarkan betapa rendahnya harga API baharu; penggunaan token AI harian di China pula dilaporkan melepasi 140 trilion.
Token yang lebih murah tidak semestinya mengecilkan bajet AI: organisasi boleh menjalankan lebih banyak aliran kerja, ejen AI dan tugas penjanaan kod sehingga jumlah perbelanjaan meningkat.