Googles schnellstes Frontier-Modell. Führt das MCP-Atlas-Tool-Use-Benchmark (83,6 %) an und kombiniert 1M-Token-Kontext mit unter 200ms First-Token-Latenz. Terminal-Bench 2.0 76,2 %, ARC-AGI-2 72,1 %. $0,30 / $1,20 pro 1M Tokens.
Default-Modell für hohen Durchsatz und niedrige Latenz: Such-Agents, Batch-Klassifikation, Echtzeit-Kunden-Apps. Die Kosten-pro-1M-Lücke zu Opus 4.8 beträgt etwa 50× beim Input und 60× beim Output.
#16 von 24 im Vals Index · aktueller Snapshot
49 Vals Index · 30 Benchmark-Zeilen · 11 QuellenPosition ist benchmark-spezifisch — kein Cross-Family- oder Cross-Source-Ranking.
Bester veröffentlichter Score je abgedeckter Benchmark-Familie.
79/100 Ø
050100
Wissen
88
Reasoning
76
Mathe
39
Coding
95
Agentisch
76
Multimodal
84
Langer Kontext
81
Tool-Nutzung
84
Menschliche Präferenz
91
9 getestete Benchmark-Familien
Redaktionsnotiz
3.5 Flash ist das Modell, das wir für Tool-Use mit hohem Volumen empfehlen. Die Kosten-pro-1M-Lücke zu Opus 4.8 beträgt etwa 50× beim Input und 60× beim Output — eine relevante Position für jedes Team, das Agents im Maßstab betreibt. Die MCP-Atlas-83,6 % machen es zum stärksten Tool-Use-Modell auf dem öffentlichen Markt.
Benchmark-Platzierungen
Positionen pro Benchmark
Wo Gemini 3.5 Flash auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.
Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.
Wissen88
Reasoning76
Mathe39
Coding95
Agentisch76
Multimodal84
Langer Kontext81
Tool-Nutzung84
Menschliche Präferenz91
Preis vs. Performance
Wo Gemini 3.5 Flash im Scatter liegt
Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.