VerdictPal · Redaktions-Desk · 2026VerdictPal
Vergleich · Zwei Modelle, direkt

Wähle zwei Modelle. Sieh den Unterschied.

Composite-Scores, Benchmark-Ränge, Fähigkeitsraster und Preis pro Million Tokens. Alles aus denselben Daten wie der Modell-Atlas.

Grok 4.3 vs Gemini 3.1 Pro

Grok 4.34Stats gewonnen
Gleichstand0Stats
Gemini 3.1 Pro3Stats gewonnen
Spec-Showdown

Kapazität, Preis, Aktualität.

Grok 4.3vsGemini 3.1 Pro

Gemini 3.1 Pro führt beim Composite-Score (76 vs 60) mit tieferer Benchmark-Abdeckung über mehr Families. Gemini 3.1 Pro hat den höheren Vals/AA-Intelligence-Score (53 vs 47).

  1. Composite-Score
    Grok 4.360Gemini 3.1 Pro76Gewinner in dieser Zeile
  2. Intelligence (Vals/AA)
    Grok 4.347Gemini 3.1 Pro53Gewinner in dieser Zeile
  3. Kontextfenster
    Grok 4.32MGewinner in dieser ZeileGemini 3.1 Pro1M
  4. Max. Output
    Grok 4.3128KGewinner in dieser ZeileGemini 3.1 Pro66K
  5. Input-Preis / 1M (niedriger gewinnt)
    Grok 4.3$5.0Gewinner in dieser ZeileGemini 3.1 Pro$7.0
  6. Output-Geschwindigkeit (AA Default-API)
    Grok 4.3124 t/sGewinner in dieser ZeileGemini 3.1 Pro
  7. Zeit bis zum ersten Token (AA Default-API)
    Grok 4.331.32sGemini 3.1 ProGewinner in dieser Zeile
Composite-Score
60
vs
76Gewinner in dieser Zeile
Intelligence (Vals/AA)
47
vs
53Gewinner in dieser Zeile
Kontextfenster
2MGewinner in dieser Zeile
vs
1M
Max. Output
128KGewinner in dieser Zeile
vs
66K
Input-Preis / 1M (niedriger gewinnt)
$5.0Gewinner in dieser Zeile
vs
$7.0
Output-Geschwindigkeit (AA Default-API)
124 t/sGewinner in dieser Zeile
vs
Zeit bis zum ersten Token (AA Default-API)
31.32s
vs
Gewinner in dieser Zeile
Fähigkeitsraster

Was jedes Modell kann.

Modalitäten

Grok 4.3Gemini 3.1 Pro
Text
Bild
Audio
Video
Code
Tool-Nutzung
Reasoning

Zugang

Grok 4.3Gemini 3.1 Pro
API
Consumer-App
Open Weights
Managed Cloud
On-Device
Family-Radar

Top-Score pro Benchmark-Family.

Wissen
89
vs
90Gewinner in dieser Zeile
Reasoning
88Gewinner in dieser Zeile
vs
78
Coding
78
vs
81Gewinner in dieser Zeile
Agentisch
64
vs
65Gewinner in dieser Zeile
Langer Kontext
64Gewinner in dieser Zeile
vs
55
Tool-Nutzung
77
vs
82Gewinner in dieser Zeile
Menschliche Präferenz
88Gewinner in dieser Zeile
vs
80
Benchmark-Ränge

Jeder gemeinsame Benchmark, nebeneinander.

Wissen

MMLU#11/22 · #5/22
88.5%
vs
90.3%Gewinner in dieser Zeile

Reasoning

GPQA Diamond#31/69 · #52/69
88%Gewinner in dieser Zeile
vs
78.4%
LiveBench#17/21 · #7/21
60.8%
vs
65.8%Gewinner in dieser Zeile

Coding

SWE-bench Verified#19/23 · #8/23
77.6%
vs
80.6%Gewinner in dieser Zeile

Agentisch

Terminal-Bench#33/69 · #30/69
63.8%
vs
65.4%Gewinner in dieser Zeile
Vals Index#15/20 · #11/20
46.63%
vs
53.42%Gewinner in dieser Zeile

Langer Kontext

LongBench v2#17/19 · #4/19
46.2%
vs
55.4%Gewinner in dieser Zeile

Tool-Nutzung

BFCL#12/20 · #7/20
77.2%
vs
81.6%Gewinner in dieser Zeile

Menschliche Präferenz

LMArena (Chatbot Arena)#4/13 · #9/13
1441Gewinner in dieser Zeile
vs
1402
Dossier-Fakten

Daten, Quellen, Kleingedrucktes.

Grok 4.3Gemini 3.1 Pro
AnbieterxAIGoogle
FamilyGrokGemini
Veröffentlichung2026-04-302026-02-19
Wissensstichtag2026-03-152026-01-31
Kontextfenster2M1M
Max. Output128K66K
Input-Preis /1M$5.0$7.0
Output-Preis /1M$25$21
Statussolidflagship
Composite-Score6076
Intelligence-Score4753
Intel-Quellevalsvals
Benchmark-Zeilen1716
Quellenanzahl99
Aktualitätfreshfresh
Preis geprüft2026-06-012026-06-01
Ökosystem

Welche Tools jedes Modell einwickeln.

Grok 4.3

In keinem Tool gelistet.

Urteil

Welches Modell du wirklich wählen solltest.

Gemini 3.1 Pro führt beim Composite-Score (76 vs 60) mit tieferer Benchmark-Abdeckung über mehr Families. Gemini 3.1 Pro hat den höheren Vals/AA-Intelligence-Score (53 vs 47).