Modelle / Google

Gemini 3.8 Flash

Gemini 3.8 · Release 2026-09-02

Googles Flash-Arbeitspferd vom 2. Sep. 2026. Gleicher Intro-API-Preis wie 3.7 Flash: $0,75 / $3,75 pro 1M Tokens bis 31. Dez. 2026. 1M-Kontext, 64K-Output. AA-Intelligence-Index v4.3 ist 41,2 in der kanonischen High-Effort-Zeile — weiter zwei Punkte über 3.7 Flash (39,4) auf derselben Skala.

Aktuelles Google-Flash-Modell für Coding-Agents und Tool-Use mit hohem Durchsatz. Bevorzuge belegte AA-Ledger-Zeilen gegenüber Launch-Claims zu DeepSWE, HLE-Verified und Vals Finance.

#14 von 184 im AA Index · aktueller Snapshot
41 AA Index · 9 Benchmark-Zeilen · 1 QuellenPosition ist benchmark-spezifisch — kein Cross-Family- oder Cross-Source-Ranking.
Composite64
Kontext1M
Input / 1M$0.75
Output / 1M$3.8
Wissensstichtag2026-03-01
Output-Speed343 t/s
TTFT (Default-API)9.30s
Statusflagship

Familienprofil

Bester veröffentlichter Score je abgedeckter Benchmark-Familie.

80/100 Ø
Reasoning
95
Coding
57
Agentisch
88
Langer Kontext
81

4 getestete Benchmark-Familien

Redaktionsnotiz
Erfasst aus Googles Launch-Post vom 2. Sep. 2026, der DeepMind-Modellkarte (1M Kontext, 64K Output, Cutoff März 2026, manche Domänen noch Jan. 2025) und dem AA-API-Snapshot vom 10. Sep. 2026 (v4.3 High-Effort-Index 41,2). Von Google gemeldete DeepSWE-, HLE-Verified-54,9-%-, Vals-Finance-Agent-V2- und Harvey-Legal-Zahlen bleiben Vendor-Claims. Redaktionelle Tiefe braucht noch einen Desk-Pass.
Benchmark-Platzierungen

Wo Gemini 3.8 Flash auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.

BenchmarkFamilyRangScoreQuelleDatum
GPQA DiamondReasoning#2/ 19095Artificial Analysis2026-09-10
AA output speedPerformance#4/ 190Artificial Analysis2026-09-10
Terminal-BenchAgentic#9/ 18988Artificial Analysis2026-09-10
SciCodeCoding#11/ 9357Artificial Analysis2026-09-10
τ³-Bench BankingAgentic#11/ 11045Artificial Analysis2026-09-10
Humanity's Last ExamReasoning#12/ 18548Artificial Analysis2026-09-10
Artificial Analysis Intelligence IndexReasoning#17/ 18841Artificial Analysis2026-09-10
AA time to first tokenPerformance#20/ 190Artificial Analysis2026-09-10
AA-LCRLong context#25/ 18281Artificial Analysis2026-09-10
Family-Kontext

Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Gemini 3.8 Flash auftaucht, ist es hervorgehoben.

Neueste Belege

Benchmark-Zeilen im öffentlichen Ledger für Gemini 3.8 Flash in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.

9 neu
Family-Abdeckung

Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.

Reasoning95
Coding57
Agentisch88
Langer Kontext81
Preis vs. Performance
0255075100$0.10$0.30$1$3$10$30Input-USD / 1M Tokens · log-Skala →← Intelligenz

Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.

AnthropicOpenAIMistralAlibabaDeepSeekGoogleMoonshotMetaxAIMiniMaxZhipuXiaomiOtherMeituanCohereNVIDIA

Volles Benchmark-Ledger

Jeder Katalog-Benchmark für Gemini 3.8 Flash. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.

9 Quell-Zeilen

9 von 37 Katalog-Benchmarks haben eine belegte Zeile für Gemini 3.8 Flash.

Reasoning

Coding

Agentic

Long context

Performance

Changelog
  1. AA-API-Snapshot: Intelligence Index v4.3 ist 41,2 in der kanonischen High-Effort-Zeile.
  2. Gemini 3.8 Flash allgemein verfügbar. AA-High-Effort-Intelligence-Index v4.2 ist 47; Intro-Preis unverändert gegenüber 3.7 Flash.
Quellen

The Pack · Redaktionsnewsletter

Neue Tools in dein Postfach. Kostenlos.

Eine kurze E-Mail, wenn ein Tool erscheint oder den Status wechselt. Kein Tracking, keine Drittanbieter-Analytics. Abmeldung mit einem Klick.