88.7%
HELM Safety
Modelle / Google
Gemini 1.5 · Release 2024-06-01
Gemini-1.5-Pro-Checkpoint Juni 2024. HELM Safety 88,7 % im öffentlichen Ledger. Langkontext-Vorgänger von Gemini 2/3.
Historische Google-Pro-Baseline für HELM- und MMLU-Vergleiche — kein aktueller API-Standard.
Wo Gemini 1.5 Pro (2024-06) auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.
| Benchmark | Family | Rang | Score | Quelle | Datum |
|---|---|---|---|---|---|
| HELM Safety | Safety | #7/ 9 | 89 | Stanford HELM leaderboard | 2024-08-15 |
Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Gemini 1.5 Pro (2024-06) auftaucht, ist es hervorgehoben.
Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.
Hover or tab any dot for name, score, and input price.
Jeder Katalog-Benchmark für Gemini 1.5 Pro (2024-06). Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.
1 of 32 catalog benchmarks have a sourced row for Gemini 1.5 Pro (2024-06).
88.7%
HELM Safety