VerdictPal · Redaktions-Desk · Stand 14. Sept. 2026VerdictPal
Vergleich · Zwei Modelle, direkt
Wähle zwei Modelle. Sieh den Unterschied.
Composite-Scores, Benchmark-Ränge, Fähigkeitsraster und Preis pro Million Tokens. Alles aus denselben Daten wie der Modell-Atlas.
Mistral Large 3 vs DeepSeek V4 Pro Max
Mistral Large 32Stats gewonnen
Gleichstand0Stats
DeepSeek V4 Pro Max5Stats gewonnen
Spec-Showdown
Kapazität, Preis, Aktualität.
Mistral Large 3vsDeepSeek V4 Pro Max
DeepSeek V4 Pro Max führt beim Composite-Score (73 vs 48) mit tieferer Benchmark-Abdeckung über mehr Families. DeepSeek V4 Pro Max hat den höheren Vals/AA-Intelligence-Score (73 vs 10).
- Composite-ScoreMistral Large 348DeepSeek V4 Pro Max73Gewinner in dieser Zeile
- Intelligence (Vals/AA)Mistral Large 310DeepSeek V4 Pro Max73Gewinner in dieser Zeile
- KontextfensterMistral Large 3262KGewinner in dieser ZeileDeepSeek V4 Pro Max256K
- Max. OutputMistral Large 38KDeepSeek V4 Pro Max66KGewinner in dieser Zeile
- Input-Preis / 1M (niedriger gewinnt)Mistral Large 3$0.50DeepSeek V4 Pro Max$0.40Gewinner in dieser Zeile
- Output-Geschwindigkeit (AA Default-API)Mistral Large 376 t/sGewinner in dieser ZeileDeepSeek V4 Pro Max—
- Zeit bis zum ersten Token (AA Default-API)Mistral Large 30.75sDeepSeek V4 Pro Max—Gewinner in dieser Zeile
Composite-Score
vs
Intelligence (Vals/AA)
vs
Kontextfenster
vs
Max. Output
vs
Input-Preis / 1M (niedriger gewinnt)
vs
Output-Geschwindigkeit (AA Default-API)
vs
Zeit bis zum ersten Token (AA Default-API)
vs
Fähigkeitsraster
Was jedes Modell kann.
Modalitäten
Zugang
Familienprofil
Top-Score pro Benchmark-Family.
Wissen
vs
Reasoning
vs
Mathe
vs
Coding
vs
Agentisch
vs
Langer Kontext
vs
Tool-Nutzung
vs
Benchmark-Ränge
Jeder gemeinsame Benchmark, nebeneinander.
Wissen
MMLU#13/22 · #8/22
vs
MMLU-Pro#36/39 · #32/39
vs
Reasoning
GPQA Diamond#168/190 · #156/190
vs
LiveBench#11/21 · #14/21
vs
Coding
HumanEval#12/15 · #9/15
vs
SWE-bench Verified#21/22 · #7/22
vs
Agentisch
Terminal-Bench#178/189 · #54/189
vs
Langer Kontext
LongBench v2#11/19 · #14/19
vs
Tool-Nutzung
BFCL#8/20 · #16/20
vs
MCP Atlas#8/10 · #6/10
vs
Dossier-Fakten
Daten, Quellen, Kleingedrucktes.
Ökosystem
Welche Tools jedes Modell einwickeln.
DeepSeek V4 Pro Max
Urteil
Welches Modell du wirklich wählen solltest.
DeepSeek V4 Pro Max führt beim Composite-Score (73 vs 48) mit tieferer Benchmark-Abdeckung über mehr Families. DeepSeek V4 Pro Max hat den höheren Vals/AA-Intelligence-Score (73 vs 10).