Modelle / OpenAI

GPT-5.2

GPT-5 · Release 2025-12-11

Openais Frontier-Modell Dezember 2025. 410K-Kontext, 128K-Output, konfigurierbarer Reasoning-Aufwand. $1,75/$14 pro 1M Tokens.

Vorherige GPT-5-Generation für komplexe professionelle Arbeit. Durch GPT-5.4/5.5 abgelöst, aber noch verfügbar zum niedrigeren Preis.

#48 von 184 im AA Index · aktueller Snapshot
30 AA Index · 17 Benchmark-Zeilen · 5 QuellenPosition ist benchmark-spezifisch — kein Cross-Family- oder Cross-Source-Ranking.
Composite70
Kontext410K
Input / 1M$1.8
Output / 1M$14
Wissensstichtag2025-08-01
Statussolid

Familienprofil

Bester veröffentlichter Score je abgedeckter Benchmark-Familie.

86/100 Ø
Wissen
87
Reasoning
90
Mathe
89
Coding
95
Agentisch
72
Langer Kontext
83

6 getestete Benchmark-Familien

Benchmark-Platzierungen

Wo GPT-5.2 auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.

BenchmarkFamilyRangScoreQuelleDatum
HumanEvalCoding#4/ 1595CodeSOTA HumanEval leaderboard2025-12-01
LiveCodeBenchCoding#5/ 3189Artificial Analysis2026-09-10
GDPvalAgentic#6/ 672OpenAI GDPval2025-12-11
ARC-AGIReasoning#7/ 953ARC Prize leaderboard2026-05-15
FrontierMathMath#8/ 1541Epoch AI FrontierMath Tiers 1-3 (v2) CSV2026-08-15
MMLU-ProKnowledge#10/ 3987Artificial Analysis2026-09-10
SWE-bench VerifiedCoding#11/ 2280SWE-bench official leaderboard2026-05-30
MATHMath#12/ 2587OpenAI model release notes2025-12-01
AA-LCRLong context#13/ 18283Artificial Analysis2026-09-10
AIMEMath#18/ 3789OpenAI model release notes2025-12-01
IFBenchReasoning#27/ 12775Artificial Analysis2026-09-10
GPQA DiamondReasoning#45/ 19090Artificial Analysis2026-09-10
Humanity's Last ExamReasoning#47/ 18538Artificial Analysis2026-09-10
Artificial Analysis Intelligence IndexReasoning#54/ 18830Artificial Analysis2026-09-10
Terminal-BenchAgentic#98/ 18947Artificial Analysis2026-09-10
AA output speedPerformance#131/ 190Artificial Analysis2026-09-10
AA time to first tokenPerformance#131/ 190Artificial Analysis2026-09-10
Family-Kontext

Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo GPT-5.2 auftaucht, ist es hervorgehoben.

Neueste Belege

Benchmark-Zeilen im öffentlichen Ledger für GPT-5.2 in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.

12 neu
Family-Abdeckung

Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.

Wissen87
Reasoning90
Mathe89
Coding95
Agentisch72
Langer Kontext83
Preis vs. Performance
0255075100$0.10$0.30$1$3$10$30Input-USD / 1M Tokens · log-Skala →← Intelligenz

Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.

AnthropicOpenAIMistralAlibabaDeepSeekGoogleMoonshotMetaxAIMiniMaxZhipuXiaomiOtherMeituanCohereNVIDIA

Volles Benchmark-Ledger

Jeder Katalog-Benchmark für GPT-5.2. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.

17 Quell-Zeilen

17 von 37 Katalog-Benchmarks haben eine belegte Zeile für GPT-5.2.

Knowledge

Reasoning

Math

Coding

Agentic

Long context

Performance

Changelog
  1. GPT-5.2 veröffentlicht — 410K-Kontext, konfigurierbares Reasoning, $1,75/$14.
Quellen

The Pack · Redaktionsnewsletter

Neue Tools in dein Postfach. Kostenlos.

Eine kurze E-Mail, wenn ein Tool erscheint oder den Status wechselt. Kein Tracking, keine Drittanbieter-Analytics. Abmeldung mit einem Klick.