| Variante | Gesamtparameter | Aktive Parameter | Kontextfenster | Max. Ausgabe |
|---|---|---|---|---|
| V4-Pro | 1,6 Billionen (MoE) | ~49 Mrd. pro Token | 1 Mio. Tokens | 384.000 Tokens |
| V4-Flash | 284 Mrd. (MoE) | ~13 Mrd. pro Token | 1 Mio. Tokens | 384.000 Tokens |
Beide Varianten sind multimodal (Text, Bild, Video), unterstützen JSON-Ausgabe und Tool-Aufrufe und sind über API und Web zugänglich .
| Variante | Eingabe (außerhalb Spitze) | Ausgabe (außerhalb Spitze) | Cache-Treffer |
|---|---|---|---|
| V4-Pro | 0,435 $ | 0,87 $ | 90 % Rabatt |
| V4-Flash | 0,14 $ | 0,28 $ | 90 % Rabatt |
DeepSeek hatte zudem eine 75-Prozent-Rabattaktion auf V4-Pro bis Anfang Mai 2026 durchgeführt . Zum Vergleich: Die Ausgabepreise von GPT-5.5 liegen bei etwa 30 $/Mio. Tokens, womit V4-Flash etwa 107-mal günstiger ist .
Die Benchmark-Ergebnisse von DeepSeek V4 zeichnen ein differenziertes Bild:
Wichtige Einschränkung aus der NIST-CAISI-Evaluierung (Mai 2026): DeepSeeks selbstberichtete Benchmarks suggerieren eine Gleichwertigkeit mit GPT-5.4 und Opus 4.6. Die unabhängige CAISI-Evaluierung fand jedoch, dass V4 bei nicht-öffentlichen Benchmarks „deutlich weniger leistungsfähig“ sei, was auf eine mögliche Überhöhung einiger selbstberichteter Werte hindeutet . Der Intelligence Index von Artificial Analysis bewertet GPT-5.5 (hoch) mit 53 Punkten, DeepSeek V4 Pro (Reasoning, hoher Aufwand) mit 41*. GPT-5.5 ist demnach intelligenter und schneller (69 gegenüber 56 Tokens/s), aber DeepSeek ist dramatisch günstiger (0,18 $ gegenüber 4,35 $/Mio. Tokens im Reasoning-Modus) .
Das Qwen-Team von Alibaba stellte Qwen 3.8 Max auf der World AI Conference in Shanghai am 19. Juli 2026 vor . Es ist das erste Flaggschiffmodell des Teams mit mehr als einer Billion Parametern.
| Merkmal | Detail |
|---|---|
| Gesamtparameter | 2,4 Billionen (sparse MoE) |
| Architektur | Mixture-of-Experts, multimodal (Text + Vision bestätigt) |
| Kontextfenster | 983.616 Tokens laut Qwen-Cloud-Endpunkt ; in einigen Quellen als etwa 1 Mio. wiederholt |
| Max. Ausgabe | 64.000 Tokens |
| Lizenz | Noch nicht veröffentlicht; Alibaba kündigt Open-Weight „bald“ an |
Es wurden noch keine Pay-as-you-go-Preise veröffentlicht. Der Zugang erfolgt derzeit im Abonnement über Qwen Chat und ausgewählte API-Partner. BenchLM listet die Preise für Qwen 3.8 Max Preview als „Nicht gelistet“ . Einige Drittanbieter-Tracker zeigen automatische Preise von 1,50 $/5,00 $ pro Million Eingabe-/Ausgabe-Tokens, was jedoch nicht von Alibaba bestätigt ist .
Alibaba gibt an, Qwen 3.8 sei „nur von Fable 5“ (Anthropics bestem Claude-Modell) übertroffen, was es laut Alibabas eigener Rangliste vor GPT-5.5 und DeepSeek V4 platzieren würde . Verbesserungen gegenüber Qwen 3.7 Max werden in den Bereichen Programmieren, professionelle Produktivität, Full-Stack-Entwicklung, Datenanalyse und Büro-Workflows behauptet .
Allerdings wurden keine unabhängigen Benchmarks veröffentlicht. BenchLM, eine Benchmark-Tracking-Seite, verfolgt 321 Benchmarks für Qwen 3.8 Max Preview, von denen bis zum 20. Juli 2026 genau 0 Ergebnisse verifiziert waren . Wie eine Analyse es ausdrückte: „Qwen 3.8 ist einen Test wert, aber es ist noch zu früh, es als stabilen Produktionsersatz für Kimi K3, GPT-5.6 Sol oder Claude Fable 5 zu betrachten“ .
Zum Vergleich: Qwens Vorgänger hatten solide Grundlagen gelegt: Qwen 3.6-Max-Preview (20. April 2026) war ein reines Textmodell mit 35 Mrd. Gesamt-/3 Mrd. aktiven Parametern und 262.000 Tokens Kontext, das den ersten Platz bei sechs Programmier- und Agenten-Benchmarks beanspruchte . Qwen 3.7-Max (Mai 2026) erweiterte das Kontextfenster auf 1 Mio. Tokens und führte Reasoning-Agent-Fähigkeiten ein . Keines der beiden Modelle galt jedoch außerhalb des agentischen Programmierens allgemein als Spitzenmodell.
Alibaba positioniert Qwen 3.8 explizit als „nur von Fable 5 übertroffen“ . Sollte sich diese Behauptung in unabhängigen Tests bewahrheiten, läge Qwen 3.8 vor GPT-5.5 und weit vor DeepSeek V4. Aber ohne einen einzigen verifizierten Benchmark bleibt dies eine Marketingaussage, keine gesicherte Tatsache. Anthropics Fable 5 scheint laut Alibabas eigener Darstellung der aktuelle anerkannte Spitzenreiter zu sein .
DeepSeek aggressive Preisgestaltung hat einen Wettlauf nach unten bei den API-Kosten ausgelöst. V4-Flash zu 0,14 $/Mio. Tokens Eingabe ist radikal günstiger als jedes westliche Spitzenmodell. Alibaba hat noch keine Preise für Qwen 3.8 festgelegt, aber Qwen 3.6 war bereits aggressiv bepreist (etwa 1,25 $/7,50 $ Eingabe/Ausgabe) .
Die offene MIT-Lizenz für DeepSeek V4 macht zudem den Selbstbetrieb möglich, was die Margen für Closed-Source-Anbieter weiter drückt . Wie eine Analyse es auf den Punkt brachte: Der praktische Effekt ist, dass „Entwickler jetzt nahe an der Spitzenleistung liegende Fähigkeiten (bei Programmieraufgaben) zu einem Bruchteil der Kosten von GPT-5.5 oder Claude nutzen können.“