VerdictPal · Redaktions-Desk · 2026VerdictPal
Vergleich · Zwei Modelle, direkt

Wähle zwei Modelle. Sieh den Unterschied.

Composite-Scores, Benchmark-Ränge, Fähigkeitsraster und Preis pro Million Tokens. Alles aus denselben Daten wie der Modell-Atlas.

OpenAI o3 vs GPT-5.2

OpenAI o32Stats gewonnen
Gleichstand0Stats
GPT-5.25Stats gewonnen
Spec-Showdown

Kapazität, Preis, Aktualität.

OpenAI o3vsGPT-5.2

Composite-Scores liegen innerhalb von 5 Punkten — 70 für OpenAI o3 vs 71 für GPT-5.2. Die Wahl hängt von Fähigkeitsprofil und Preis ab. GPT-5.2 hat den höheren Vals/AA-Intelligence-Score (42 vs 30). GPT-5.2s 410K Kontextfenster übertrifft OpenAI o3s 200K deutlich — relevant für lange Dokumente oder Codebasen.

  1. Composite-Score
    OpenAI o370GPT-5.271Gewinner in dieser Zeile
  2. Intelligence (Vals/AA)
    OpenAI o330GPT-5.242Gewinner in dieser Zeile
  3. Kontextfenster
    OpenAI o3200KGPT-5.2410KGewinner in dieser Zeile
  4. Max. Output
    OpenAI o3100KGPT-5.2128KGewinner in dieser Zeile
  5. Input-Preis / 1M (niedriger gewinnt)
    OpenAI o3GPT-5.2$1.8Gewinner in dieser Zeile
  6. Output-Geschwindigkeit (AA Default-API)
    OpenAI o3155 t/sGewinner in dieser ZeileGPT-5.287 t/s
  7. Zeit bis zum ersten Token (AA Default-API)
    OpenAI o34.84sGewinner in dieser ZeileGPT-5.297.23s
Composite-Score
70
vs
71Gewinner in dieser Zeile
Intelligence (Vals/AA)
30
vs
42Gewinner in dieser Zeile
Kontextfenster
200K
vs
410KGewinner in dieser Zeile
Max. Output
100K
vs
128KGewinner in dieser Zeile
Input-Preis / 1M (niedriger gewinnt)
vs
$1.8Gewinner in dieser Zeile
Output-Geschwindigkeit (AA Default-API)
155 t/sGewinner in dieser Zeile
vs
87 t/s
Zeit bis zum ersten Token (AA Default-API)
4.84sGewinner in dieser Zeile
vs
97.23s
Fähigkeitsraster

Was jedes Modell kann.

Modalitäten

OpenAI o3GPT-5.2
Text
Bild
Audio
Video
Code
Tool-Nutzung
Reasoning

Zugang

OpenAI o3GPT-5.2
API
Consumer-App
Open Weights
Managed Cloud
On-Device
Family-Radar

Top-Score pro Benchmark-Family.

Wissen
85
vs
87Gewinner in dieser Zeile
Reasoning
88
vs
90Gewinner in dieser Zeile
Mathe
99Gewinner in dieser Zeile
vs
89
Coding
95
vs
95
Agentisch
81
vs
85Gewinner in dieser Zeile
Langer Kontext
69
vs
73Gewinner in dieser Zeile
Benchmark-Ränge

Jeder gemeinsame Benchmark, nebeneinander.

Wissen

MMLU-Pro#6/21 · #4/21
85.3%
vs
87.4%Gewinner in dieser Zeile

Reasoning

Artificial Analysis Intelligence Index#48/67 · #29/67
30.4%
vs
42.2%Gewinner in dieser Zeile
GPQA Diamond#43/69 · #22/69
82.7%
vs
90.3%Gewinner in dieser Zeile
Humanity's Last Exam#45/65 · #27/65
20%
vs
35.4%Gewinner in dieser Zeile
IFBench#30/57 · #19/57
71.43%
vs
75.44%Gewinner in dieser Zeile

Mathe

AIME#8/19 · #6/19
88.33%
vs
89.2%Gewinner in dieser Zeile
MATH#1/20 · #7/20
99.2%Gewinner in dieser Zeile
vs
87.2%

Coding

LiveCodeBench#4/13 · #2/13
80.8%
vs
88.9%Gewinner in dieser Zeile
SciCode#49/65 · #21/65
41%
vs
52.1%Gewinner in dieser Zeile

Agentisch

Terminal-Bench#55/69 · #46/69
37.12%
vs
46.97%Gewinner in dieser Zeile
τ³-Bench Banking#11/64 · #9/64
80.7%
vs
84.8%Gewinner in dieser Zeile

Langer Kontext

AA-LCR#27/64 · #12/64
69.33%
vs
72.67%Gewinner in dieser Zeile

Performance

AA output speed#16/69 · #30/69
155 t/sGewinner in dieser Zeile
vs
87 t/s
AA time to first token#26/69 · #3/69
4.84sGewinner in dieser Zeile
vs
97.23s
Dossier-Fakten

Daten, Quellen, Kleingedrucktes.

OpenAI o3GPT-5.2
AnbieterOpenAIOpenAI
FamilyOpenAI oGPT-5
Veröffentlichung2025-04-162025-12-11
Wissensstichtag2024-06-012025-08-01
Kontextfenster200K410K
Max. Output100K128K
Input-Preis /1M$1.8
Output-Preis /1M$14
Statussolidsolid
Composite-Score7071
Intelligence-Score3042
Intel-Quelleaaaa
Benchmark-Zeilen2118
Quellenanzahl75
Aktualitätfreshfresh
Preis geprüft2026-06-092026-06-02
Ökosystem

Welche Tools jedes Modell einwickeln.

GPT-5.2

In keinem Tool gelistet.

Urteil

Welches Modell du wirklich wählen solltest.

Composite-Scores liegen innerhalb von 5 Punkten — 70 für OpenAI o3 vs 71 für GPT-5.2. Die Wahl hängt von Fähigkeitsprofil und Preis ab. GPT-5.2 hat den höheren Vals/AA-Intelligence-Score (42 vs 30). GPT-5.2s 410K Kontextfenster übertrifft OpenAI o3s 200K deutlich — relevant für lange Dokumente oder Codebasen.