Model open weight mencapai 62% volume token Vercel AI Gateway pada Sabtu sebelum 25 Agustus, lalu mencatat 54% pada Selasa dibandingkan 46% untuk model proprietary. DeepSeek V4 Flash menjadi katalis utama setelah pembaruan bobot meningkatkan performa agentic secara signifikan, tanpa menghilangkan keunggulan harganya.
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Peta penggunaan model AI di Vercel AI Gateway berubah cepat pada Agustus 2026. Model open-weight—model yang bobotnya dapat diakses atau diunduh untuk penggunaan dan pengembangan lebih lanjut—menangani 54% volume token pada Selasa, 25 Agustus. Model proprietary atau closed-weight berada di angka 46%.4
Beberapa hari sebelumnya, pangsa model open-weight bahkan mencapai rekor 62%, meninggalkan model proprietary dengan 38%.4 Pemicu terdekatnya adalah DeepSeek V4 Flash, yang mendapat pembaruan bobot dan menunjukkan peningkatan pada coding, penggunaan alat, serta alur kerja berbasis agen tanpa diposisikan sebagai model premium berharga tinggi.19
| Periode yang dilaporkan pada Agustus | Model open-weight | Model proprietary |
|---|---|---|
| Sabtu sebelum 25 Agustus | 62% | 38% |
| Selasa, 25 Agustus | 54% | 46% |
Dengan demikian, model open-weight unggul 8 poin persentase pada Selasa dan 24 poin pada rekor sebelumnya. Namun, angka ini secara khusus mengukur jumlah token yang diproses melalui gateway. Angka tersebut bukan ukuran pendapatan, laba, maupun jumlah perusahaan yang menggunakan masing-masing model.
Vercel menyatakan DeepSeek V4 Flash mulai menggunakan bobot yang diperbarui secara default di AI Gateway. Skornya pada Terminal-Bench naik menjadi 82,7, dari 56,9 pada pratinjau April—peningkatan sebesar 25,8 poin.19
Pembaruan itu juga tidak mengharuskan pengguna mengubah ID model atau kode aplikasi. Artinya, pengguna lama dapat menerima bobot terbaru tanpa perlu melakukan perubahan di tingkat aplikasi.19
Daya tarik V4 Flash bukan sekadar harga murah. Peningkatan kemampuan agentic membuatnya lebih cocok untuk pekerjaan coding bervolume tinggi dan penggunaan alat, sementara posisinya sebagai model efisiensi membantu pengembang mengendalikan biaya inferensi. Menurut deskripsi Vercel, model ini mendukung reasoning, penggunaan alat, serta implicit caching, dengan konteks hingga 1 juta token.27
Perbedaan harga dengan penawaran premium DeepSeek turut memperkuat posisi tersebut. Reuters melaporkan V4 Pro diluncurkan dengan harga input sekitar sembilan kali lipat dan harga output 14 kali lipat dibandingkan V4 Flash.17 Perbandingan independen juga menunjukkan keunggulan harga V4 Flash yang cukup besar, meski hasil benchmark dapat berbeda berdasarkan pengujian dan konfigurasinya.25
Laporan yang tersedia mengaitkan penurunan volume model proprietary dengan melemahnya permintaan bisnis terhadap Fable 5 dari Anthropic, yang harganya lebih mahal.4 Penjelasan ini masuk akal untuk pekerjaan yang lebih mengutamakan throughput dan efisiensi biaya daripada kemampuan model maksimum. Namun, data gateway yang tersedia belum membuktikan bahwa faktor tersebut menjadi satu-satunya penyebab untuk semua pelanggan atau permintaan.
Fable 5 tetap ditujukan untuk tugas yang panjang, ambigu, dan terdiri atas banyak tahapan, menurut deskripsi produk Vercel.3 Karena itu, perubahan trafik pada Agustus lebih tepat dibaca sebagai strategi pemilihan model berdasarkan kebutuhan—bukan bukti bahwa model open-weight selalu lebih baik.
Pengembang dapat memakai model berbiaya rendah untuk pekerjaan dalam jumlah besar, lalu menyimpan model proprietary premium untuk tugas yang memang membutuhkan kemampuan lebih tinggi dan sepadan dengan biayanya.
Perbedaan antara penggunaan dan pendapatan menjadi catatan paling penting dalam membaca data ini. Dalam laporan Vercel sebelumnya, model open-weight mencapai 29% volume token AI Gateway, tetapi menyumbang kurang dari 4% total pengeluaran.44
Kesenjangan itu muncul karena jumlah token tidak memperhitungkan harga yang dibayarkan untuk setiap token input atau output. Jadi, lonjakan pada Agustus menunjukkan bahwa model open-weight memproses porsi pekerjaan yang lebih besar di gateway—bukan berarti model tersebut otomatis menghasilkan belanja atau pendapatan yang lebih besar bagi penyedia.
Model proprietary masih dapat menguasai porsi pengeluaran yang tidak proporsional meski model open-weight memproses lebih banyak token.
Data Vercel mengarah pada strategi routing model yang lebih selektif:
Pelajaran yang lebih luas dari data Vercel pada Agustus adalah bahwa model open-weight dapat memenangkan volume produksi ketika mampu menggabungkan kemampuan yang memadai dengan biaya yang jauh lebih rendah. DeepSeek V4 Flash menjadi contoh paling jelas, tetapi arah perubahannya lebih besar: setiap beban kerja cenderung diarahkan ke model termurah yang tetap dapat bekerja secara andal, bukan langsung menggantikan semua model proprietary.
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Model open weight mencapai 62% volume token Vercel AI Gateway pada Sabtu sebelum 25 Agustus, lalu mencatat 54% pada Selasa dibandingkan 46% untuk model proprietary.
Model open weight mencapai 62% volume token Vercel AI Gateway pada Sabtu sebelum 25 Agustus, lalu mencatat 54% pada Selasa dibandingkan 46% untuk model proprietary. DeepSeek V4 Flash menjadi katalis utama setelah pembaruan bobot meningkatkan performa agentic secara signifikan, tanpa menghilangkan keunggulan harganya.
Pergeseran volume token ini tidak berarti model open weight menguasai sebagian besar belanja AI; data Vercel sebelumnya menunjukkan model tersebut menangani 29% token, tetapi menyumbang kurang dari 4% pengeluaran.