Qwen 3.7 Max dari Alibaba, diluncurkan pada Mei 2026, adalah model unggulan mixture-of-experts (MoE) dengan 2,8 triliun parameter yang tampaknya menyamai atau melampaui Fable 5 milik Anthropic dalam berbagai tolok ukur, dengan biaya sekitar seperenamnya . Untuk penggunaan volume tinggi, Qwen3.6 Flash dari Alibaba hanya berharga $0,19 per juta token input .
GLM-5.2 dari Zhipu AI, dirilis pada 13 Juni 2026, menggunakan arsitektur MoE dengan 744 miliar parameter (40 miliar aktif) dan jendela konteks 1 juta token. Model ini menempati peringkat #1 model open-weight di Indeks Kecerdasan Buatan (Artificial Analysis Intelligence Index) . Dengan harga $1,40 per juta token input dan $4,40 per juta token output, model ini mengungguli model frontier AS dengan harga sekitar 5-6 kali lebih murah .
Kimi K3 dari Moonshot AI, diperkenalkan pada 16 Juli 2026, adalah sistem AI open-weight terbesar yang pernah diumumkan: 2,8 triliun parameter total, jendela konteks 1 juta token, dan pemahaman visual native. Moonshot berjanji akan merilis bobot penuh (open weights) pada 27 Juli 2026 . Harga API-nya berada di $3 per juta token input dan $15 per juta token output, menjadikannya model China termahal—namun masih di bawah penawaran AS yang sebanding .
Kesenjangan biaya antara model frontier China dan AS sangat ekstrem:
| Model | Harga Input (per 1M token) | Harga Output (per 1M token) |
|---|---|---|
| DeepSeek V4-Flash | $0,14 | $0,28 |
| Alibaba Qwen3.6 Flash | $0,19 | $1,13 |
| Zhipu GLM-5.2 | $1,40 | $4,40 |
| Alibaba Qwen3.7 Max | $1,25 | $3,75 |
| Moonshot Kimi K3 | $3,00 | $15,00 |
| Anthropic Claude Fable 5 (estimasi) | ~$15,00 | ~$50,00 |
| OpenAI GPT-5.5 (estimasi) | ~$5,00 | ~$15,00 |
Sumber: Mengutip tabel sebelumnya dan
Angka-angka ini berbicara dengan jelas: DeepSeek V4-Flash diperkirakan hanya memakan biaya 3 sen per pengujian tolok ukur, dibandingkan dengan $1,86 untuk GPT-5.5 dan $3,33 untuk Claude Fable 5 . Kapitalis ventura Marc Andreessen mencatat bahwa GLM-5.2 adalah "model AI China pertama yang menyamai dan seringkali mengalahkan model AI publik dari laboratorium besar Amerika tanpa kompromi"—dengan harga yang jauh lebih murah .
Prong kedua dari strategi China adalah perilisan bobot terbuka (open-weight). Model-model seperti GLM-5.2 (dengan lisensi MIT), Kimi K3 (dijanjikan dengan lisensi Modified MIT), dan seri Qwen dapat diunduh secara gratis. Ini berarti siapa pun dapat menjalankan, memodifikasi, atau menyempurnakan (fine-tune) model-model tersebut tanpa biaya per token . Strategi "memberikan model secara gratis" ini menggerus pasar menengah di mana perusahaan AS biasanya mematok harga premium .
Titik balik kunci terjadi pada Juni 2026, ketika pemerintahan Trump meminta Anthropic untuk menghentikan operasi dua sistem AI tercanggihnya (Fable dan Mythos) dengan alasan keamanan nasional . Dalam waktu dua minggu, Z.ai meluncurkan model yang sangat mirip dengan penawaran Anthropic—lebih terjangkau dan tanpa batasan dari AS . Perusahaan China melihat celah ini dan bergegas mengisinya .
Respons AS masih terfragmentasi. Anthropic mematuhi permintaan pemerintah. Google dilaporkan kesulitan dengan versi terbaru model Gemini-nya di tengah model China yang semakin mendekati kemampuannya . Belum ada kebijakan balasan terkoordinasi dari AS yang diumumkan; analis mencatat bahwa kontrol ekspor pada chip tidak menghentikan perusahaan China untuk mencapai performa kompetitif melalui efisiensi arsitektur (misalnya, MoE, hybrid attention) daripada daya komputasi mentah .
Sementara itu, perusahaan-perusahaan AS semakin banyak menguji dan mengadopsi model China karena alasan biaya, yang semakin mengikis keunggulan kandang (home-field advantage) laboratorium AI Amerika .