VerdictPal · Redaktions-Desk · 2026VerdictPal
Vergleich · Zwei Modelle, direkt

Wähle zwei Modelle. Sieh den Unterschied.

Composite-Scores, Benchmark-Ränge, Fähigkeitsraster und Preis pro Million Tokens. Alles aus denselben Daten wie der Modell-Atlas.

Mistral Large 3 vs DeepSeek V4 Pro Max

Mistral Large 32Stats gewonnen
Gleichstand0Stats
DeepSeek V4 Pro Max5Stats gewonnen
Spec-Showdown

Kapazität, Preis, Aktualität.

Mistral Large 3vsDeepSeek V4 Pro Max

DeepSeek V4 Pro Max führt beim Composite-Score (74 vs 48) mit tieferer Benchmark-Abdeckung über mehr Families. DeepSeek V4 Pro Max hat den höheren Vals/AA-Intelligence-Score (56 vs 16).

  1. Composite-Score
    Mistral Large 348DeepSeek V4 Pro Max74Gewinner in dieser Zeile
  2. Intelligence (Vals/AA)
    Mistral Large 316DeepSeek V4 Pro Max56Gewinner in dieser Zeile
  3. Kontextfenster
    Mistral Large 3262KGewinner in dieser ZeileDeepSeek V4 Pro Max256K
  4. Max. Output
    Mistral Large 38KDeepSeek V4 Pro Max66KGewinner in dieser Zeile
  5. Input-Preis / 1M (niedriger gewinnt)
    Mistral Large 3$0.50DeepSeek V4 Pro Max$0.40Gewinner in dieser Zeile
  6. Output-Geschwindigkeit (AA Default-API)
    Mistral Large 365 t/sGewinner in dieser ZeileDeepSeek V4 Pro Max
  7. Zeit bis zum ersten Token (AA Default-API)
    Mistral Large 30.67sDeepSeek V4 Pro MaxGewinner in dieser Zeile
Composite-Score
48
vs
74Gewinner in dieser Zeile
Intelligence (Vals/AA)
16
vs
56Gewinner in dieser Zeile
Kontextfenster
262KGewinner in dieser Zeile
vs
256K
Max. Output
8K
vs
66KGewinner in dieser Zeile
Input-Preis / 1M (niedriger gewinnt)
$0.50
vs
$0.40Gewinner in dieser Zeile
Output-Geschwindigkeit (AA Default-API)
65 t/sGewinner in dieser Zeile
vs
Zeit bis zum ersten Token (AA Default-API)
0.67s
vs
Gewinner in dieser Zeile
Fähigkeitsraster

Was jedes Modell kann.

Modalitäten

Mistral Large 3DeepSeek V4 Pro Max
Text
Bild
Audio
Video
Code
Tool-Nutzung
Reasoning

Zugang

Mistral Large 3DeepSeek V4 Pro Max
API
Consumer-App
Open Weights
Managed Cloud
On-Device
Family-Radar

Top-Score pro Benchmark-Family.

Wissen
88
vs
90Gewinner in dieser Zeile
Reasoning
71
vs
76Gewinner in dieser Zeile
Mathe
38
vs
84Gewinner in dieser Zeile
Coding
92
vs
93Gewinner in dieser Zeile
Agentisch
12
vs
68Gewinner in dieser Zeile
Langer Kontext
51Gewinner in dieser Zeile
vs
49
Tool-Nutzung
80Gewinner in dieser Zeile
vs
75
Benchmark-Ränge

Jeder gemeinsame Benchmark, nebeneinander.

Wissen

MMLU#13/22 · #8/22
87.8%
vs
89.7%Gewinner in dieser Zeile
MMLU-Pro#31/34 · #27/34
72.8%
vs
76.4%Gewinner in dieser Zeile

Reasoning

GPQA Diamond#135/151 · #124/151
71.2%
vs
75.6%Gewinner in dieser Zeile
LiveBench#11/21 · #14/21
62.8%Gewinner in dieser Zeile
vs
61.9%

Coding

HumanEval#12/15 · #9/15
92.4% pass@1
vs
93.4% pass@1Gewinner in dieser Zeile
SWE-bench Verified#21/23 · #7/23
76.2%
vs
80.6%Gewinner in dieser Zeile

Agentisch

Terminal-Bench#141/150 · #35/150
11.99%
vs
67.9%Gewinner in dieser Zeile

Langer Kontext

LongBench v2#11/19 · #14/19
50.8%Gewinner in dieser Zeile
vs
48.6%

Tool-Nutzung

BFCL#8/20 · #16/20
80.1%Gewinner in dieser Zeile
vs
74.6%
MCP Atlas#8/10 · #6/10
70.4%
vs
72.6%Gewinner in dieser Zeile
Dossier-Fakten

Daten, Quellen, Kleingedrucktes.

Mistral Large 3DeepSeek V4 Pro Max
AnbieterMistralDeepSeek
FamilyMistral LargeDeepSeek
Veröffentlichung2025-12-022026-04-24
Wissensstichtag2025-06-012026-02-01
Kontextfenster262K256K
Max. Output8K66K
Input-Preis /1M$0.50$0.40
Output-Preis /1M$1.5$1.6
Statussolidflagship
Composite-Score4874
Intelligence-Score1656
Intel-Quelleaavals
Benchmark-Zeilen2014
Quellenanzahl610
Aktualitätfreshfresh
Preis geprüft2026-06-092026-06-01
Ökosystem

Welche Tools jedes Modell einwickeln.

Urteil

Welches Modell du wirklich wählen solltest.

DeepSeek V4 Pro Max führt beim Composite-Score (74 vs 48) mit tieferer Benchmark-Abdeckung über mehr Families. DeepSeek V4 Pro Max hat den höheren Vals/AA-Intelligence-Score (56 vs 16).