VerdictPal · Redaktions-Desk · 2026VerdictPal
Vergleich · Zwei Modelle, direkt
Wähle zwei Modelle. Sieh den Unterschied.
Composite-Scores, Benchmark-Ränge, Fähigkeitsraster und Preis pro Million Tokens. Alles aus denselben Daten wie der Modell-Atlas.
Mistral Large 3 vs DeepSeek V4 Pro Max
Mistral Large 32Stats gewonnen
Gleichstand0Stats
DeepSeek V4 Pro Max5Stats gewonnen
Spec-Showdown
Kapazität, Preis, Aktualität.
Mistral Large 3vsDeepSeek V4 Pro Max
DeepSeek V4 Pro Max führt beim Composite-Score (74 vs 48) mit tieferer Benchmark-Abdeckung über mehr Families. DeepSeek V4 Pro Max hat den höheren Vals/AA-Intelligence-Score (56 vs 16).
- Composite-ScoreMistral Large 348DeepSeek V4 Pro Max74Gewinner in dieser Zeile
- Intelligence (Vals/AA)Mistral Large 316DeepSeek V4 Pro Max56Gewinner in dieser Zeile
- KontextfensterMistral Large 3262KGewinner in dieser ZeileDeepSeek V4 Pro Max256K
- Max. OutputMistral Large 38KDeepSeek V4 Pro Max66KGewinner in dieser Zeile
- Input-Preis / 1M (niedriger gewinnt)Mistral Large 3$0.50DeepSeek V4 Pro Max$0.40Gewinner in dieser Zeile
- Output-Geschwindigkeit (AA Default-API)Mistral Large 365 t/sGewinner in dieser ZeileDeepSeek V4 Pro Max—
- Zeit bis zum ersten Token (AA Default-API)Mistral Large 30.67sDeepSeek V4 Pro Max—Gewinner in dieser Zeile
Composite-Score
vs
Intelligence (Vals/AA)
vs
Kontextfenster
vs
Max. Output
vs
Input-Preis / 1M (niedriger gewinnt)
vs
Output-Geschwindigkeit (AA Default-API)
vs
Zeit bis zum ersten Token (AA Default-API)
vs
Fähigkeitsraster
Was jedes Modell kann.
Modalitäten
Zugang
Family-Radar
Top-Score pro Benchmark-Family.
Wissen
vs
Reasoning
vs
Mathe
vs
Coding
vs
Agentisch
vs
Langer Kontext
vs
Tool-Nutzung
vs
Benchmark-Ränge
Jeder gemeinsame Benchmark, nebeneinander.
Wissen
MMLU#13/22 · #8/22
vs
MMLU-Pro#31/34 · #27/34
vs
Reasoning
GPQA Diamond#135/151 · #124/151
vs
LiveBench#11/21 · #14/21
vs
Coding
HumanEval#12/15 · #9/15
vs
SWE-bench Verified#21/23 · #7/23
vs
Agentisch
Terminal-Bench#141/150 · #35/150
vs
Langer Kontext
LongBench v2#11/19 · #14/19
vs
Tool-Nutzung
BFCL#8/20 · #16/20
vs
MCP Atlas#8/10 · #6/10
vs
Dossier-Fakten
Daten, Quellen, Kleingedrucktes.
Ökosystem
Welche Tools jedes Modell einwickeln.
DeepSeek V4 Pro Max
Urteil
Welches Modell du wirklich wählen solltest.
DeepSeek V4 Pro Max führt beim Composite-Score (74 vs 48) mit tieferer Benchmark-Abdeckung über mehr Families. DeepSeek V4 Pro Max hat den höheren Vals/AA-Intelligence-Score (56 vs 16).