| Varian | Jumlah Parameter | Parameter Aktif | Tetingkap Konteks | Output Maksimum |
|---|---|---|---|---|
| V4-Pro | 1.6 trilion (MoE) | ~49B per token | 1M token | 384K token |
| V4-Flash | 284 bilion (MoE) | ~13B per token | 1M token | 384K token |
Kedua-dua varian adalah multimodal (teks, imej, video), menyokong output JSON dan panggilan alat, dan tersedia melalui API dan web .
| Varian | Input (luar puncak) | Output (luar puncak) | Cache Hit |
|---|---|---|---|
| V4-Pro | $0.435 | $0.87 | Diskaun 90% |
| V4-Flash | $0.14 | $0.28 | Diskaun 90% |
DeepSeek juga menjalankan promosi diskaun 75% pada V4-Pro sehingga awal Mei 2026 . Sebagai perbandingan, harga output GPT-5.5 adalah ~$30/MTok, menjadikan V4-Flash kira-kira 107 kali lebih murah untuk output .
Keputusan penanda aras DeepSeek V4 menceritakan kisah yang bernuansa:
Amaran penting daripada penilaian NIST CAISI (Mei 2026): Penanda aras laporan sendiri DeepSeek mendakwa setanding dengan GPT-5.4 dan Opus 4.6, tetapi penilaian bebas CAISI mendapati V4 "jauh kurang berkemampuan" pada penanda aras bukan awam, menunjukkan beberapa skor laporan sendiri mungkin terlalu tinggi . Indeks Kecerdasan Analisis Tiruan menilai GPT-5.5 (tinggi) pada 53 berbanding DeepSeek V4 Pro (Penaakulan, Usaha Tinggi) pada 41* — GPT-5.5 lebih pintar dan lebih pantas (69 berbanding 56 tok/s), tetapi DeepSeek jauh lebih murah ($0.18 berbanding $4.35/MTok dalam mod penaakulan) .
Pasukan Qwen Alibaba memperkenalkan Qwen 3.8 Max di Persidangan AI Dunia di Shanghai pada 19 Julai 2026 . Ia adalah model perdana pertama pasukan itu melebihi 1 trilion parameter.
| Atribut | Butiran |
|---|---|
| Jumlah parameter | 2.4 trilion (sparse MoE) |
| Seni bina | Mixture-of-Experts, multimodal (teks + penglihatan disahkan) |
| Tetingkap konteks | 983,616 token setiap titik akhir Qwen Cloud ; diulang sebagai ~1M dalam beberapa sumber |
| Output maksimum | 64,000 token |
| Lesen | Belum diterbitkan; Alibaba kata pemberat terbuka "tidak lama lagi" |
Tiada harga bayar semasa guna telah diterbitkan. Akses kini melalui langganan melalui Qwen Chat dan rakan kongsi API terpilih. BenchLM menyenaraikan harga Qwen 3.8 Max Preview sebagai "Tidak disenaraikan" . Beberapa penjejak pihak ketiga menunjukkan harga auto pada $1.50/$5.00 setiap juta token input/output, tetapi ini tidak disahkan oleh Alibaba .
Alibaba menyatakan Qwen 3.8 adalah "hanya kedua selepas Fable 5" (model Claude teratas Anthropic), yang akan meletakkannya di hadapan GPT-5.5 dan DeepSeek V4 dalam ranking Alibaba sendiri . Keuntungan didakwa dalam pengekodan, produktiviti profesional, pembangunan penuh timbunan, analisis data, dan aliran kerja pejabat berbanding Qwen 3.7 Max .
Walau bagaimanapun, tiada penanda aras bebas telah diterbitkan. BenchLM, tapak penjejakan penanda aras, mengesan 321 penanda aras untuk Qwen 3.8 Max Preview dengan 0 keputusan disahkan setakat 20 Julai 2026 . Seperti yang dinyatakan oleh satu analisis, "Qwen 3.8 patut diuji, tetapi terlalu awal untuk menganggapnya sebagai pengganti pengeluaran yang stabil untuk Kimi K3, GPT-5.6 Sol, atau Claude Fable 5" .
Untuk konteks, pendahulu Qwen menetapkan asas yang kukuh: Qwen 3.6-Max-Preview (20 April 2026) ialah model khusus teks 35B jumlah / 3B parameter aktif dengan konteks 262K yang mendakwa #1 pada enam penanda aras pengekodan dan ejen . Qwen 3.7-Max (Mei 2026) berkembang kepada tetingkap konteks 1M token dengan keupayaan ejen penaakulan . Tetapi kedua-duanya secara amnya tidak dianggap peringkat sempadan di luar pengekodan ejen.
Alibaba secara eksplisit meletakkan Qwen 3.8 sebagai "hanya kedua selepas Fable 5" . Jika dakwaan ini tahan di bawah penilaian bebas, ia akan meletakkan Qwen 3.8 di hadapan GPT-5.5 dan jauh di hadapan DeepSeek V4. Tetapi dengan sifar penanda aras yang disahkan, ini kekal sebagai dakwaan pemasaran, bukan fakta yang ditetapkan. Fable 5 Anthropic nampaknya adalah pemimpin sempadan yang diiktiraf semasa mengikut rangka kerja Alibaba sendiri .
Harga agresif DeepSeek telah mendorong perlumbaan ke bawah pada kos API. V4-Flash pada $0.14/M input jauh lebih murah daripada mana-mana model sempadan Barat. Alibaba masih belum menetapkan harga Qwen 3.8, tetapi Qwen 3.6 sudah pun berharga agresif (~$1.25/$7.50 input/output) .
Lesen MIT sumber terbuka untuk DeepSeek V4 bermakna pengehosan sendiri juga boleh dilakukan, seterusnya memampatkan margin untuk pembekal sumber tertutup . Seperti yang dinyatakan oleh satu analisis, kesan praktikalnya ialah "pembangun kini boleh mengakses keupayaan hampir sempadan (untuk tugasan pengekodan) pada sebahagian kecil daripada kos GPT-5.5 atau Claude."