88.4%
MMLU
Modelle / Google
Gemini · Release 2026-05-19
Googles schnellstes Frontier-Modell. Führt das MCP-Atlas-Tool-Use-Benchmark (83,6 %) an und kombiniert 1M-Token-Kontext mit unter 200ms First-Token-Latenz. Terminal-Bench 2.0 76,2 %, ARC-AGI-2 72,1 %. $0,30 / $1,20 pro 1M Tokens.
Default-Modell für hohen Durchsatz und niedrige Latenz: Such-Agents, Batch-Klassifikation, Echtzeit-Kunden-Apps. Die Kosten-pro-1M-Lücke zu Opus 4.8 beträgt etwa 50× beim Input und 60× beim Output.
81average across 8 tested families
Wo Gemini 3.5 Flash auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.
Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Gemini 3.5 Flash auftaucht, ist es hervorgehoben.
Benchmark-Zeilen im öffentlichen Ledger für Gemini 3.5 Flash in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.
Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.
Hover or tab any dot for name, score, and input price.
Jeder Katalog-Benchmark für Gemini 3.5 Flash. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.
21 of 32 catalog benchmarks have a sourced row for Gemini 3.5 Flash.
88.4%
MMLU
72.1%
ARC-AGI-2 semi-private
50.2%
AA Intelligence Index v4.1
74.1%
GPQA Diamond
41%
HLE (AA run)
76.33%
IFBench (AA run)
64.2%
LiveBench
76.2%
Terminal-Bench 2.0 (audited harness)
25.36%
τ³-Bench Banking (AA run)
68.9%
MMMU
69.33%
AA-LCR (AA run)
53.8%
LongBench v2
287 t/s
Median output tokens/s (1k prompt, default provider)
12.11s
Median time to first token (1k prompt, default provider)
1455
LMArena Elo (Style Controlled)