| GLM-5.2 |
| 13 giugno 2026 |
| 744B parametri totali, 40B attivi, contesto di 1 milione di token; primo modello open-weight nell'Artificial Analysis Intelligence Index |
| DeepSeek | V4-Flash / V4-Pro | Giugno–Agosto 2026 | V4-Flash a $0,14/M token in input; V4-Pro a $0,435/M dopo il taglio dei prezzi di giugno |
| Alibaba | Qwen 3.7 Max / Plus / Flash | Maggio–Giugno 2026 | Modello di punta con 2.800 miliardi di parametri MoE; Qwen3.7 Max a $1,25/$3,75 per M token; Qwen3.6 Flash a $0,19/$1,13 |
| Moonshot AI | Kimi K3 | 16 luglio 2026 | 2.800 miliardi di parametri totali, ~50B attivi, 1 milione di contesto; promesso completamente open-source entro il 27 luglio |
| Z.ai | Rivale di Fable 5 | Fine giugno 2026 | Svelato poco dopo che Anthropic ha interrotto due modelli avanzati su richiesta del governo USA |
Il divario di costo è estremo. DeepSeek V4-Flash costa $0,14 per milione di token in input — più di 100 volte più economico da eseguire rispetto ad Anthropic Claude Fable 5 . Qwen3.6 Flash di Alibaba costa $0,19/M in input, mentre modelli di frontiera statunitensi come GPT-5.5 e Claude Opus 4.8 costano circa 7-12 volte di più a livelli di capacità comparabili . K3 di Moonshot, un modello di frontiera, offre un prezzo API di $3/M in input e $15/M in output, con pesi aperti promessi per l'auto-hosting gratuito .