Model open weight mencapai 62% daripada jumlah token AI Gateway Vercel pada Sabtu sebelumnya, sebelum mencatat 54% pada Selasa, 25 Ogos, berbanding 46% untuk model proprietari. DeepSeek V4 Flash menjadi pemangkin utama selepas kemas kini berat model meningkatkan prestasi tugasan berasaskan ejen tanpa menghilangkan k...
Research answer

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Pertukaran antara kos dan keupayaan sedang mengubah corak penggunaan di AI Gateway Vercel, iaitu perkhidmatan yang membolehkan pembangun mengakses pelbagai model AI melalui satu antara muka.
Model open-weight—model yang beratnya boleh dimuat turun dan digunakan oleh pihak lain—menyumbang 54% daripada jumlah token yang diproses melalui gateway pada Selasa, 25 Ogos 2026. Model proprietari pula menyumbang 46%. Pada Sabtu sebelumnya, bahagian model open-weight dilaporkan mencecah rekod 62%, meninggalkan model tertutup dengan 38%.4
| Titik laporan pada Ogos | Model open-weight | Model proprietari |
|---|---|---|
| Sabtu sebelumnya | 62% | 38% |
| Selasa, 25 Ogos | 54% | 46% |
Ini bermakna model open-weight mendahului model proprietari sebanyak 8 mata peratusan pada Selasa, dan 24 mata peratusan ketika rekod terdahulu dicatatkan.
Namun, angka ini khusus mengukur jumlah token yang diproses melalui gateway. Ia bukan ukuran hasil, keuntungan atau bilangan syarikat yang menggunakan setiap model.
Pemacu segera kepada lonjakan itu ialah DeepSeek V4 Flash. Vercel berkata model tersebut mula menggunakan berat yang dikemas kini secara lalai di AI Gateway. Skornya dalam Terminal-Bench meningkat kepada 82.7, berbanding 56.9 dalam pratonton April—peningkatan sebanyak 25.8 mata.19
Yang penting, pengguna sedia ada tidak perlu menukar ID model atau kod aplikasi untuk menerima berat baharu itu.19 Pengurangan geseran teknikal ini memudahkan pembangun terus menggunakan model yang sama sambil mendapat peningkatan prestasi.
Tarikan DeepSeek V4 Flash bukan sekadar harganya yang murah. Keupayaan yang lebih baik untuk tugasan berasaskan ejen menjadikannya lebih sesuai bagi kerja pengekodan, penggunaan alat dan aliran kerja automatik yang memproses permintaan dalam jumlah besar. Kedudukannya sebagai model berfokuskan kecekapan pula memberi pembangun lebih banyak ruang untuk mengawal kos inferens.
Menurut penerangan produk Vercel, model itu menyokong penaakulan, penggunaan alat dan caching tersirat, selain menawarkan tetingkap konteks sehingga 1 juta token.27
Harga turut mengukuhkan kedudukan tersebut. Reuters melaporkan DeepSeek V4 Pro dilancarkan dengan harga input kira-kira sembilan kali ganda dan harga output 14 kali ganda berbanding V4 Flash. Perbezaan itu menyerlahkan jurang antara model kecekapan DeepSeek dengan tawaran premiumnya.17 Perbandingan bebas juga menunjukkan kelebihan harga yang besar untuk V4 Flash, walaupun keputusan penanda aras berbeza mengikut ujian dan konfigurasi.25
Laporan yang tersedia mengaitkan kemerosotan jumlah penggunaan model proprietari dengan permintaan perniagaan yang lebih lemah terhadap Fable 5 keluaran Anthropic, yang berharga lebih tinggi.4
Penjelasan itu munasabah untuk tugasan yang lebih mementingkan kelajuan pemprosesan dan kos seunit berbanding keupayaan maksimum model. Namun, angka gateway yang tersedia tidak membuktikan bahawa satu faktor sahaja menjadi punca bagi setiap pelanggan atau permintaan.
Fable 5 masih diposisikan Vercel sebagai model untuk tugasan berpanjangan, kabur dan berbilang langkah.3 Oleh itu, perubahan trafik pada Ogos lebih tepat dilihat sebagai keputusan penghalaan model: gunakan model kos rendah untuk kerja berskala besar yang sesuai, dan simpan model proprietari premium untuk tugasan yang benar-benar memerlukan keupayaan tambahan.
Perbezaan antara penggunaan dan hasil ialah perkara paling penting untuk difahami. Dalam laporan Vercel sebelum ini, model open-weight meningkat kepada 29% daripada jumlah token gateway tetapi menyumbang kurang daripada 4% perbelanjaan.44
Jurang itu wujud kerana jumlah token tidak mengambil kira harga yang dibayar bagi setiap token input atau output. Maka, persilangan pada bulan Ogos menunjukkan model open-weight memproses bahagian kerja gateway yang lebih besar—bukan semestinya menjana lebih banyak perniagaan untuk penyedia model.
Model proprietari masih boleh menguasai bahagian perbelanjaan yang tidak seimbang walaupun model open-weight mengendalikan lebih banyak token.
Data ini menunjukkan bahawa strategi pemilihan dan penghalaan model perlu dibuat dengan lebih teliti:
Kesimpulan yang lebih besar daripada data trafik Vercel pada Ogos ialah model open-weight boleh memenangi jumlah penggunaan produksi apabila ia menawarkan keupayaan yang mencukupi pada kos yang jauh lebih rendah. DeepSeek V4 Flash ialah contoh paling jelas, tetapi arah aliran yang lebih luas adalah usaha memadankan setiap tugasan dengan model paling murah yang masih mampu melaksanakannya dengan boleh dipercayai—bukannya menggantikan semua model proprietari dalam satu langkah.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Model open weight mencapai 62% daripada jumlah token AI Gateway Vercel pada Sabtu sebelumnya, sebelum mencatat 54% pada Selasa, 25 Ogos, berbanding 46% untuk model proprietari.
Model open weight mencapai 62% daripada jumlah token AI Gateway Vercel pada Sabtu sebelumnya, sebelum mencatat 54% pada Selasa, 25 Ogos, berbanding 46% untuk model proprietari. DeepSeek V4 Flash menjadi pemangkin utama selepas kemas kini berat model meningkatkan prestasi tugasan berasaskan ejen tanpa menghilangkan kelebihan kosnya.
Peralihan ini tidak bermakna model open weight menguasai kebanyakan perbelanjaan gateway; data Vercel sebelum ini menunjukkan model proprietari masih boleh mendominasi perbelanjaan walaupun memproses lebih sedikit token.