45.1%
ARC-AGI-2 semi-private
Modelle / Google
Gemini 3 · Release 2025-12-01
Googles Extended-Reasoning-Variante von Gemini 3 Pro. ARC-AGI-2 semi-private 45,1 %. Für härteste Puzzle-Reasoning-Aufgaben, nicht für Standard-Chat.
Reasoning-lastige Gemini-Route, wenn Standard-Pro bei ARC-ähnlichen Aufgaben nicht reicht.
Wo Gemini 3 Pro Deep Think auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.
| Benchmark | Family | Rang | Score | Quelle | Datum |
|---|---|---|---|---|---|
| ARC-AGI | Reasoning | #11/ 14 | 45 | ARC Prize leaderboard | 2026-05-15 |
Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Gemini 3 Pro Deep Think auftaucht, ist es hervorgehoben.
Benchmark-Zeilen im öffentlichen Ledger für Gemini 3 Pro Deep Think in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.
| Benchmark | Family | Score | Quelle | Tage her |
|---|---|---|---|---|
| ARC-AGI | Reasoning | 45.1% | ARC Prize leaderboard | 69 |
Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.
Hover or tab any dot for name, score, and input price.
Jeder Katalog-Benchmark für Gemini 3 Pro Deep Think. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.
1 of 32 catalog benchmarks have a sourced row for Gemini 3 Pro Deep Think.
45.1%
ARC-AGI-2 semi-private