| Unternehmen | Modell | Veröffentlichung | Wichtigste Eigenschaften |
|---|---|---|---|
| Zhipu AI (Z.ai) | GLM-5.2 | 13. Juni 2026 | 744 Mrd. Parameter (40 Mrd. aktiv), 1 Mio. Token Kontext; Rang 1 unter den Open-Weight-Modellen im Artificial Analysis Intelligence Index |
| DeepSeek | V4-Flash / V4-Pro | Juni–August 2026 | V4-Flash: 0,14 $/Mio. Input-Tokens; V4-Pro: 0,435 $/Mio. nach Preissenkung im Juni |
| Alibaba | Qwen 3.7 Max / Plus / Flash | Mai–Juni 2026 | 2,8 Billionen Parameter (MoE); Qwen3.7 Max: 1,25 $/3,75 $ pro Mio. Tokens; Qwen3.6 Flash: 0,19 $/1,13 $ |
| Moonshot AI | Kimi K3 | 16. Juli 2026 | 2,8 Billionen Parameter (~50 Mrd. aktiv), 1 Mio. Token Kontext; versprochene vollständige Open-Source-Veröffentlichung bis 27. Juli 2026 |
| Z.ai | Fable-5-Konkurrent | Ende Juni 2026 | Kurz nachdem Anthropic auf Anfrage der US-Regierung zwei fortschrittliche Modelle einstellte, vorgestellt |
Die Kostendifferenz ist extrem. DeepSeek V4-Flash verlangt 0,14 US-Dollar pro Million Input-Tokens – das ist mehr als 100-mal günstiger als der Betrieb von Anthropics Claude Fable 5 . Alibabas Qwen3.6 Flash kostet 0,19 US-Dollar pro Million Input-Tokens, während US-Spitzenmodelle wie GPT-5.5 und Claude Opus 4.8 bei vergleichbarer Leistung etwa das 7- bis 12-fache kosten . Moonshots K3, ein Modell der Spitzenklasse, bietet API-Preise von 3 US-Dollar pro Million Input- und 15 US-Dollar pro Million Output-Tokens, wobei die offenen Gewichte für den kostenlosen Eigenbetrieb versprochen wurden .