Harga: $0.435 per juta token input, $0.87 per juta token output pada kadar standard, dengan diskaun cache sehingga 97% . Dalam mod penaakulan usaha maksimum, harganya ialah $1.32/$3.96 per juta token
.
Moonshot AI mengeluarkan apa yang dipanggilnya "model terbuka pertama di dunia dalam kelas 3 trilion parameter" — model Mixture-of-Experts dengan 2.8 trilion parameter yang mengaktifkan 16 daripada 896 pakar setiap token, dengan tetingkap konteks 1 juta token dan multimodal asli (penglihatan + teks) . Berat penuh dikeluarkan di Hugging Face pada 27 Julai di bawah lesen MIT Diubah Suai
. Ia tersedia di Kimi.com, Kimi Work, Kimi Code, dan Kimi API
.
Model yang memulakan gelombang. GLM-5.2 adalah MoE dengan 744 bilion parameter, kira-kira 40 bilion aktif setiap token, tetingkap konteks 1 juta token, dan lesen MIT . Penilaian CAISI NIST menilai keupayaan keseluruhannya serupa dengan GPT-5.2 (Disember 2025) dan keupayaan sibernya serupa dengan Claude Opus
. Ia mendapat skor 81.0 pada Terminal-Bench 2.1 dan 62.1 pada SWE-bench Pro — skor berat terbuka tertinggi pada Indeks Kecerdasan Analisis Buatan
. Harga API kira-kira 10 kali lebih murah daripada Claude atau GPT-5
.
Model MoE dengan 1.6 trilion parameter (48 bilion aktif setiap token), tetingkap konteks 1 juta token, dikeluarkan di bawah lesen MIT . Perbezaan kritikalnya: model trilion-parameter pertama yang dilatih dan dijalankan sepenuhnya pada cip domestik China — sekumpulan 50,000 cip Huawei Ascend 910B/C
. Mengikut ujian Meituan, ia mengatasi GPT-5.5 pada penanda aras kejuruteraan perisian
. Ia secara senyap mendahului papan pendahulu OpenLLM sebagai "Owl Alpha" sebelum keluaran rasmi
. Harga API: $0.75/$2.95 per juta token input/output, dengan promosi pelancaran pada $0.30/$1.20
.
Perusahaan di luar China kini mempunyai alternatif berat terbuka, kos rendah dan boleh dipercayai kepada model API AS. Lesen MIT GLM-5.2 tanpa sekatan serantau bermakna mana-mana syarikat boleh menghoskan sendiri secara komersial tanpa sekatan . Ini mengubah keputusan perolehan di Asia Tenggara, Timur Tengah, Afrika, dan sebahagian Eropah.
Bukti kukuh menyokong tesis bahawa kawalan eksport cip AS telah menjadi bumerang dalam sekurang-kurangnya dua cara:
Tiada sumber pengesahan ditemui untuk harga khusus setiap tugasan $0.06 untuk DeepSeek V4 Pro atau $2.34 untuk Claude Opus 5. Tencent Hy3 dan Alibaba Qwen3.8-Max juga kekurangan spesifikasi atau tarikh keluaran yang disahkan dalam bukti yang tersedia. Tuntutan mengenai manifesto sumber terbuka terkini Mark Zuckerberg tidak dapat disahkan.
Artikel ini berdasarkan bukti yang tersedia setakat pertengahan Ogos 2026. Semua tuntutan tentang keupayaan model datang daripada penanda aras yang dilaporkan oleh pemaju dan penilaian pihak ketiga (termasuk CAISI NIST). Pengesahan bebas semua skor penanda aras sedang dijalankan di seluruh industri. Perbandingan kos adalah berdasarkan harga token API yang diterbitkan; kos sebenar setiap tugasan berbeza dengan ketara mengikut kerumitan tugasan, panjang konteks, dan kadar capaian cache.