Modelle / OpenAI

o3-pro

o3 · Release 2025-06-10

AA Intelligence Index 32.5. Auf Artificial Analysis gelistet mit API-Preisen $20/$80 pro 1M Tokens. Benchmark-Zeilen werden aus dem AA-Snapshot synchronisiert — siehe Ledger auf dieser Seite.

Frontier-Modell auf Artificial Analysis. Nutze das Benchmark-Ledger unten für belegte Scores; wir leiten keine Zahlen über veröffentlichte Zeilen hinaus ab.

#89 von 131 im AA Index · aktueller Snapshot
33 AA Index · 4 Benchmark-Zeilen · 1 QuellenPosition ist benchmark-spezifisch — kein Cross-Family- oder Cross-Source-Ranking.
Composite58
KontextUnlisted
Input / 1M$20
Output / 1M$80
Wissensstichtagunpublished
Output-Speed0 t/s
TTFT (Default-API)0.00s
Statussolid
Not enough families covered yet.Add more benchmark rows for o3-pro to see the radar.
Benchmark-Platzierungen

Wo o3-pro auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.

BenchmarkFamilyRangScoreQuelleDatum
GPQA DiamondReasoning#82/ 14985Artificial Analysis2026-07-28
Artificial Analysis Intelligence IndexReasoning#104/ 14733Artificial Analysis2026-07-28
AA output speedPerformance#146/ 149Artificial Analysis2026-07-28
AA time to first tokenPerformance#146/ 149Artificial Analysis2026-07-28
Family-Kontext

Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo o3-pro auftaucht, ist es hervorgehoben.

Neueste Belege

Benchmark-Zeilen im öffentlichen Ledger für o3-pro in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.

4 neu
Family-Abdeckung

Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.

Reasoning85
Preis vs. Performance
0255075100$0.10$0.30$1$3$10$30input USD / 1M tokens · log scale →← intelligence

Hover or tab any dot for name, score, and input price.

AnthropicOpenAIMistralAlibabaDeepSeekGoogleMoonshotxAIMiniMaxMetaZhipuXiaomiOtherMeituanCohereNVIDIA

Volles Benchmark-Ledger

Jeder Katalog-Benchmark für o3-pro. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.

4 Quell-Zeilen

4 of 32 catalog benchmarks have a sourced row for o3-pro.

Reasoning

Performance

Quellen