VerdictPal · Redaktions-Desk · 2026VerdictPal
Vergleich · Zwei Modelle, direkt

Wähle zwei Modelle. Sieh den Unterschied.

Composite-Scores, Benchmark-Ränge, Fähigkeitsraster und Preis pro Million Tokens. Alles aus denselben Daten wie der Modell-Atlas.

Gemini 3.5 Flash vs Claude Sonnet 4.6

Gemini 3.5 Flash3Stats gewonnen
Gleichstand1Stats
Claude Sonnet 4.63Stats gewonnen
Spec-Showdown

Kapazität, Preis, Aktualität.

Gemini 3.5 FlashvsClaude Sonnet 4.6

Composite-Scores liegen innerhalb von 5 Punkten — 67 für Gemini 3.5 Flash vs 66 für Claude Sonnet 4.6. Die Wahl hängt von Fähigkeitsprofil und Preis ab. Claude Sonnet 4.6 hat den höheren Vals/AA-Intelligence-Score (60 vs 49). Gemini 3.5 Flash ist deutlich günstiger bei $0.30/1M Input vs $3.0/1M Input.

  1. Composite-Score
    Gemini 3.5 Flash67Gewinner in dieser ZeileClaude Sonnet 4.666
  2. Intelligence (Vals/AA)
    Gemini 3.5 Flash49Claude Sonnet 4.660Gewinner in dieser Zeile
  3. Kontextfenster
    Gemini 3.5 Flash1MClaude Sonnet 4.61M
  4. Max. Output
    Gemini 3.5 Flash66KClaude Sonnet 4.6128KGewinner in dieser Zeile
  5. Input-Preis / 1M (niedriger gewinnt)
    Gemini 3.5 Flash$0.30Gewinner in dieser ZeileClaude Sonnet 4.6$3.0
  6. Output-Geschwindigkeit (AA Default-API)
    Gemini 3.5 Flash287 t/sGewinner in dieser ZeileClaude Sonnet 4.660 t/s
  7. Zeit bis zum ersten Token (AA Default-API)
    Gemini 3.5 Flash12.11sClaude Sonnet 4.61.18sGewinner in dieser Zeile
Composite-Score
67Gewinner in dieser Zeile
vs
66
Intelligence (Vals/AA)
49
vs
60Gewinner in dieser Zeile
Kontextfenster
1M
vs
1M
Max. Output
66K
vs
128KGewinner in dieser Zeile
Input-Preis / 1M (niedriger gewinnt)
$0.30Gewinner in dieser Zeile
vs
$3.0
Output-Geschwindigkeit (AA Default-API)
287 t/sGewinner in dieser Zeile
vs
60 t/s
Zeit bis zum ersten Token (AA Default-API)
12.11s
vs
1.18sGewinner in dieser Zeile
Fähigkeitsraster

Was jedes Modell kann.

Modalitäten

Gemini 3.5 FlashClaude Sonnet 4.6
Text
Bild
Audio
Video
Code
Tool-Nutzung
Reasoning

Zugang

Gemini 3.5 FlashClaude Sonnet 4.6
API
Consumer-App
Open Weights
Managed Cloud
On-Device
Family-Radar

Top-Score pro Benchmark-Family.

Wissen
88
vs
91Gewinner in dieser Zeile
Reasoning
76
vs
77Gewinner in dieser Zeile
Coding
95Gewinner in dieser Zeile
vs
94
Agentisch
76
vs
80Gewinner in dieser Zeile
Multimodal
69Gewinner in dieser Zeile
vs
66
Langer Kontext
69Gewinner in dieser Zeile
vs
58
Tool-Nutzung
84
vs
89Gewinner in dieser Zeile
Menschliche Präferenz
91Gewinner in dieser Zeile
vs
79
Benchmark-Ränge

Jeder gemeinsame Benchmark, nebeneinander.

Wissen

MMLU#12/22 · #4/22
88.4%
vs
90.6%Gewinner in dieser Zeile

Reasoning

ARC-AGI#7/14 · #8/14
72.1%Gewinner in dieser Zeile
vs
58.3%
Artificial Analysis Intelligence Index#16/67 · #43/67
50.2%Gewinner in dieser Zeile
vs
35.9%
GPQA Diamond#59/69 · #54/69
74.1%
vs
77.2%Gewinner in dieser Zeile
Humanity's Last Exam#11/65 · #54/65
41%Gewinner in dieser Zeile
vs
13.2%
IFBench#11/57 · #54/57
76.33%Gewinner in dieser Zeile
vs
41.16%
LiveBench#8/21 · #5/21
64.2%
vs
67.2%Gewinner in dieser Zeile

Coding

HumanEval#6/15 · #7/15
94.6% pass@1Gewinner in dieser Zeile
vs
94.1% pass@1
SciCode#18/65 · #37/65
53.1%Gewinner in dieser Zeile
vs
46.9%
SWE-bench Verified#20/23 · #13/23
77.2%
vs
79.6%Gewinner in dieser Zeile

Agentisch

Terminal-Bench#16/69 · #24/69
76.2%Gewinner in dieser Zeile
vs
68.4%
τ³-Bench Banking#35/64 · #12/64
25.36%
vs
79.53%Gewinner in dieser Zeile

Multimodal

MMMU#4/8 · #5/8
68.9%Gewinner in dieser Zeile
vs
66.2%

Langer Kontext

AA-LCR#25/64 · #51/64
69.33%Gewinner in dieser Zeile
vs
57.67%
LongBench v2#7/19 · #8/19
53.8%Gewinner in dieser Zeile
vs
52.6%

Tool-Nutzung

BFCL#6/20 · #1/20
82.3%
vs
88.7%Gewinner in dieser Zeile
MCP Atlas#1/10 · #4/10
83.6%Gewinner in dieser Zeile
vs
75.4%

Menschliche Präferenz

LMArena (Chatbot Arena)#3/13 · #10/13
1455Gewinner in dieser Zeile
vs
1396

Performance

AA output speed#6/69 · #48/69
287 t/sGewinner in dieser Zeile
vs
60 t/s
AA time to first token#19/69 · #39/69
12.11s
vs
1.18sGewinner in dieser Zeile
Dossier-Fakten

Daten, Quellen, Kleingedrucktes.

Gemini 3.5 FlashClaude Sonnet 4.6
AnbieterGoogleAnthropic
FamilyGeminiClaude Sonnet
Veröffentlichung2026-05-192026-02-17
Wissensstichtag2026-03-012025-12-01
Kontextfenster1M1M
Max. Output66K128K
Input-Preis /1M$0.30$3.0
Output-Preis /1M$1.2$15
Statusflagshipflagship
Composite-Score6766
Intelligence-Score4960
Intel-Quellevalsvals
Benchmark-Zeilen2724
Quellenanzahl1111
Aktualitätfreshfresh
Preis geprüft2026-06-012026-06-01
Ökosystem

Welche Tools jedes Modell einwickeln.

Urteil

Welches Modell du wirklich wählen solltest.

Composite-Scores liegen innerhalb von 5 Punkten — 67 für Gemini 3.5 Flash vs 66 für Claude Sonnet 4.6. Die Wahl hängt von Fähigkeitsprofil und Preis ab. Claude Sonnet 4.6 hat den höheren Vals/AA-Intelligence-Score (60 vs 49). Gemini 3.5 Flash ist deutlich günstiger bei $0.30/1M Input vs $3.0/1M Input.