VerdictPal · Redaktions-Desk · 2026VerdictPal
Vergleich · Zwei Modelle, direkt

Wähle zwei Modelle. Sieh den Unterschied.

Composite-Scores, Benchmark-Ränge, Fähigkeitsraster und Preis pro Million Tokens. Alles aus denselben Daten wie der Modell-Atlas.

Mistral Large 3 vs Llama 4 Maverick

Mistral Large 32Stats gewonnen
Gleichstand0Stats
Llama 4 Maverick5Stats gewonnen
Spec-Showdown

Kapazität, Preis, Aktualität.

Mistral Large 3vsLlama 4 Maverick

Composite-Scores liegen innerhalb von 5 Punkten — 48 für Mistral Large 3 vs 49 für Llama 4 Maverick. Die Wahl hängt von Fähigkeitsprofil und Preis ab. Mistral Large 3 hat den höheren Vals/AA-Intelligence-Score (16 vs 14). Llama 4 Maverick ist erschwinglicher bei $0.17/1M Input — etwa 3× günstiger als $0.50/1M. Llama 4 Mavericks 1M Kontextfenster übertrifft Mistral Large 3s 262K deutlich — relevant für lange Dokumente oder Codebasen.

  1. Composite-Score
    Mistral Large 348Llama 4 Maverick49Gewinner in dieser Zeile
  2. Intelligence (Vals/AA)
    Mistral Large 316Gewinner in dieser ZeileLlama 4 Maverick14
  3. Kontextfenster
    Mistral Large 3262KLlama 4 Maverick1MGewinner in dieser Zeile
  4. Max. Output
    Mistral Large 38KLlama 4 Maverick16KGewinner in dieser Zeile
  5. Input-Preis / 1M (niedriger gewinnt)
    Mistral Large 3$0.50Llama 4 Maverick$0.17Gewinner in dieser Zeile
  6. Output-Geschwindigkeit (AA Default-API)
    Mistral Large 364 t/sLlama 4 Maverick110 t/sGewinner in dieser Zeile
  7. Zeit bis zum ersten Token (AA Default-API)
    Mistral Large 30.59sGewinner in dieser ZeileLlama 4 Maverick0.60s
Composite-Score
48
vs
49Gewinner in dieser Zeile
Intelligence (Vals/AA)
16Gewinner in dieser Zeile
vs
14
Kontextfenster
262K
vs
1MGewinner in dieser Zeile
Max. Output
8K
vs
16KGewinner in dieser Zeile
Input-Preis / 1M (niedriger gewinnt)
$0.50
vs
$0.17Gewinner in dieser Zeile
Output-Geschwindigkeit (AA Default-API)
64 t/s
vs
110 t/sGewinner in dieser Zeile
Zeit bis zum ersten Token (AA Default-API)
0.59sGewinner in dieser Zeile
vs
0.60s
Fähigkeitsraster

Was jedes Modell kann.

Modalitäten

Mistral Large 3Llama 4 Maverick
Text
Bild
Audio
Video
Code
Tool-Nutzung
Reasoning

Zugang

Mistral Large 3Llama 4 Maverick
API
Consumer-App
Open Weights
Managed Cloud
On-Device
Family-Radar

Top-Score pro Benchmark-Family.

Wissen
88Gewinner in dieser Zeile
vs
86
Reasoning
71Gewinner in dieser Zeile
vs
69
Mathe
38
vs
89Gewinner in dieser Zeile
Coding
92
vs
92
Agentisch
12Gewinner in dieser Zeile
vs
8
Langer Kontext
51Gewinner in dieser Zeile
vs
50
Tool-Nutzung
80Gewinner in dieser Zeile
vs
76
Benchmark-Ränge

Jeder gemeinsame Benchmark, nebeneinander.

Wissen

MMLU#13/22 · #19/22
87.8%Gewinner in dieser Zeile
vs
86.1%
MMLU-Pro#18/21 · #11/21
72.8%
vs
80.9%Gewinner in dieser Zeile

Reasoning

Artificial Analysis Intelligence Index#58/67 · #59/67
15.9%Gewinner in dieser Zeile
vs
14.3%
GPQA Diamond#62/69 · #63/69
71.2%Gewinner in dieser Zeile
vs
69.4%
Humanity's Last Exam#64/65 · #61/65
4.1%
vs
4.8%Gewinner in dieser Zeile
IFBench#57/57 · #53/57
36.19%
vs
42.99%Gewinner in dieser Zeile
LiveBench#11/21 · #13/21
62.8%Gewinner in dieser Zeile
vs
62.1%

Mathe

AIME#15/19 · #16/19
38%Gewinner in dieser Zeile
vs
19.33%

Coding

HumanEval#12/15 · #14/15
92.4% pass@1Gewinner in dieser Zeile
vs
91.8% pass@1
LiveCodeBench#9/13 · #10/13
46.5%Gewinner in dieser Zeile
vs
39.7%
SciCode#55/65 · #58/65
36.2%Gewinner in dieser Zeile
vs
33.1%
SWE-bench Verified#21/23 · #22/23
76.2%Gewinner in dieser Zeile
vs
74.8%

Agentisch

Terminal-Bench#64/69 · #66/69
11.99%Gewinner in dieser Zeile
vs
7.87%
τ³-Bench Banking#61/64 · #63/64
5.77%Gewinner in dieser Zeile
vs
3.92%

Langer Kontext

AA-LCR#57/64 · #56/64
34.67%
vs
46%Gewinner in dieser Zeile
LongBench v2#11/19 · #12/19
50.8%Gewinner in dieser Zeile
vs
49.8%

Tool-Nutzung

BFCL#8/20 · #15/20
80.1%Gewinner in dieser Zeile
vs
75.9%

Performance

AA output speed#44/69 · #24/69
64 t/s
vs
110 t/sGewinner in dieser Zeile
AA time to first token#55/69 · #54/69
0.59sGewinner in dieser Zeile
vs
0.60s
Dossier-Fakten

Daten, Quellen, Kleingedrucktes.

Mistral Large 3Llama 4 Maverick
AnbieterMistralMeta
FamilyMistral LargeLlama 4
Veröffentlichung2025-12-022026-04-05
Wissensstichtag2025-06-012024-08-01
Kontextfenster262K1M
Max. Output8K16K
Input-Preis /1M$0.50$0.17
Output-Preis /1M$1.5$0.60
Statussolidflagship
Composite-Score4849
Intelligence-Score1614
Intel-Quelleaaaa
Benchmark-Zeilen2021
Quellenanzahl66
Aktualitätfreshfresh
Preis geprüft2026-06-092026-06-09
Ökosystem

Welche Tools jedes Modell einwickeln.

Llama 4 Maverick

In keinem Tool gelistet.

Urteil

Welches Modell du wirklich wählen solltest.

Composite-Scores liegen innerhalb von 5 Punkten — 48 für Mistral Large 3 vs 49 für Llama 4 Maverick. Die Wahl hängt von Fähigkeitsprofil und Preis ab. Mistral Large 3 hat den höheren Vals/AA-Intelligence-Score (16 vs 14). Llama 4 Maverick ist erschwinglicher bei $0.17/1M Input — etwa 3× günstiger als $0.50/1M. Llama 4 Mavericks 1M Kontextfenster übertrifft Mistral Large 3s 262K deutlich — relevant für lange Dokumente oder Codebasen.