Modelle / Google

Gemini 3 Flash Preview

Gemini 3 · Release 2025-12-17

Googles Geschwindigkeits-Tier Dezember 2025. 1M-Kontext, $0,50/$3 pro 1M Tokens. Vals-Index 49,31 (#9), SWE-bench Verified 78,0 %. Pro-Niveau-Reasoning zum Flash-Preis.

Standard-Gemini-Route, wenn 3.5 Flash zu viel und 3.1 Pro zu teuer ist. Stark bei agentischem Coding zum Mittelklasse-Preis.

#143 von 184 im AA Index · aktueller Snapshot
18 AA Index · 17 Benchmark-Zeilen · 7 QuellenPosition ist benchmark-spezifisch — kein Cross-Family- oder Cross-Source-Ranking.
Composite58
Kontext1M
Input / 1M$0.50
Output / 1M$3.0
Wissensstichtag2025-01-31
Statussolid

Familienprofil

Bester veröffentlichter Score je abgedeckter Benchmark-Familie.

70/100 Ø
Wissen
88
Reasoning
81
Mathe
56
Coding
80
Agentisch
49
Langer Kontext
55
Tool-Nutzung
79

7 getestete Benchmark-Familien

Benchmark-Platzierungen

Wo Gemini 3 Flash Preview auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.

BenchmarkFamilyRangScoreQuelleDatum
MMLU-ProKnowledge#6/ 3988Artificial Analysis2026-09-10
LiveCodeBenchCoding#18/ 3180Artificial Analysis2026-09-10
AIMEMath#32/ 3756Artificial Analysis2026-09-10
IFBenchReasoning#92/ 12755Artificial Analysis2026-09-10
AA output speedPerformance#111/ 190Artificial Analysis2026-09-10
AA time to first tokenPerformance#111/ 190Artificial Analysis2026-09-10
GPQA DiamondReasoning#137/ 19081Artificial Analysis2026-09-10
Humanity's Last ExamReasoning#143/ 18515Artificial Analysis2026-09-10
Artificial Analysis Intelligence IndexReasoning#149/ 18818Artificial Analysis2026-09-10
Terminal-BenchAgentic#151/ 18932Artificial Analysis2026-09-10
AA-LCRLong context#152/ 18255Artificial Analysis2026-09-10
Family-Kontext

Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Gemini 3 Flash Preview auftaucht, ist es hervorgehoben.

KnowledgeGemini 3 Flash Preview · 88
  1. 1
    91
  2. 2
    91
  3. 3
    91
ReasoningGemini 3 Flash Preview · 81
  1. 1
    96
  2. 2
    95
  3. 3
    95
MathGemini 3 Flash Preview · 56
  1. 1
    99
  2. 2
    99
  3. 3
    99
CodingGemini 3 Flash Preview · 80
  1. 1
    96
  2. 2
    96
  3. 3
    96
AgenticGemini 3 Flash Preview · 49
  1. 1
    100
  2. 2
    100
  3. 3
    100
Long contextGemini 3 Flash Preview · 55
  1. 1
    89
  2. 2
    85
  3. 3
    84
Tool useGemini 3 Flash Preview · 79
  1. 1
    89
  2. 2
    87
  3. 3
    87
Neueste Belege

Benchmark-Zeilen im öffentlichen Ledger für Gemini 3 Flash Preview in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.

13 neu
Family-Abdeckung

Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.

Wissen88
Reasoning81
Mathe56
Coding80
Agentisch49
Langer Kontext55
Tool-Nutzung79
Preis vs. Performance
0255075100$0.10$0.30$1$3$10$30Input-USD / 1M Tokens · log-Skala →← Intelligenz

Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.

AnthropicOpenAIMistralAlibabaDeepSeekGoogleMoonshotMetaxAIMiniMaxZhipuXiaomiOtherMeituanCohereNVIDIA

Volles Benchmark-Ledger

Jeder Katalog-Benchmark für Gemini 3 Flash Preview. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.

17 Quell-Zeilen

17 von 37 Katalog-Benchmarks haben eine belegte Zeile für Gemini 3 Flash Preview.

Knowledge

Reasoning

Math

Coding

Agentic

Long context

Tool use

Performance

Quellen

The Pack · Redaktionsnewsletter

Neue Tools in dein Postfach. Kostenlos.

Eine kurze E-Mail, wenn ein Tool erscheint oder den Status wechselt. Kein Tracking, keine Drittanbieter-Analytics. Abmeldung mit einem Klick.