VerdictPal · Redaktions-Desk · 2026VerdictPal
Vergleich · Zwei Modelle, direkt

Wähle zwei Modelle. Sieh den Unterschied.

Composite-Scores, Benchmark-Ränge, Fähigkeitsraster und Preis pro Million Tokens. Alles aus denselben Daten wie der Modell-Atlas.

Claude Sonnet 4.6 vs GPT 5.4

Claude Sonnet 4.66Stats gewonnen
Gleichstand0Stats
GPT 5.41Stats gewonnen
Spec-Showdown

Kapazität, Preis, Aktualität.

Claude Sonnet 4.6vsGPT 5.4

Composite-Scores liegen innerhalb von 5 Punkten — 66 für Claude Sonnet 4.6 vs 61 für GPT 5.4. Die Wahl hängt von Fähigkeitsprofil und Preis ab. Claude Sonnet 4.6 hat den höheren Vals/AA-Intelligence-Score (60 vs 51). Claude Sonnet 4.6 ist erschwinglicher bei $3.0/1M Input — etwa 2× günstiger als $7.0/1M. Claude Sonnet 4.6s 1M Kontextfenster übertrifft GPT 5.4s 256K deutlich — relevant für lange Dokumente oder Codebasen.

  1. Composite-Score
    Claude Sonnet 4.666Gewinner in dieser ZeileGPT 5.461
  2. Intelligence (Vals/AA)
    Claude Sonnet 4.660Gewinner in dieser ZeileGPT 5.451
  3. Kontextfenster
    Claude Sonnet 4.61MGewinner in dieser ZeileGPT 5.4256K
  4. Max. Output
    Claude Sonnet 4.6128KGewinner in dieser ZeileGPT 5.466K
  5. Input-Preis / 1M (niedriger gewinnt)
    Claude Sonnet 4.6$3.0Gewinner in dieser ZeileGPT 5.4$7.0
  6. Output-Geschwindigkeit (AA Default-API)
    Claude Sonnet 4.660 t/sGPT 5.4152 t/sGewinner in dieser Zeile
  7. Zeit bis zum ersten Token (AA Default-API)
    Claude Sonnet 4.61.18sGewinner in dieser ZeileGPT 5.4129.43s
Composite-Score
66Gewinner in dieser Zeile
vs
61
Intelligence (Vals/AA)
60Gewinner in dieser Zeile
vs
51
Kontextfenster
1MGewinner in dieser Zeile
vs
256K
Max. Output
128KGewinner in dieser Zeile
vs
66K
Input-Preis / 1M (niedriger gewinnt)
$3.0Gewinner in dieser Zeile
vs
$7.0
Output-Geschwindigkeit (AA Default-API)
60 t/s
vs
152 t/sGewinner in dieser Zeile
Zeit bis zum ersten Token (AA Default-API)
1.18sGewinner in dieser Zeile
vs
129.43s
Fähigkeitsraster

Was jedes Modell kann.

Modalitäten

Claude Sonnet 4.6GPT 5.4
Text
Bild
Audio
Video
Code
Tool-Nutzung
Reasoning

Zugang

Claude Sonnet 4.6GPT 5.4
API
Consumer-App
Open Weights
Managed Cloud
On-Device
Family-Radar

Top-Score pro Benchmark-Family.

Wissen
91Gewinner in dieser Zeile
vs
90
Reasoning
77
vs
92Gewinner in dieser Zeile
Coding
94Gewinner in dieser Zeile
vs
80
Agentisch
80
vs
82Gewinner in dieser Zeile
Langer Kontext
58
vs
74Gewinner in dieser Zeile
Tool-Nutzung
89Gewinner in dieser Zeile
vs
84
Menschliche Präferenz
79
vs
81Gewinner in dieser Zeile
Benchmark-Ränge

Jeder gemeinsame Benchmark, nebeneinander.

Wissen

MMLU#4/22 · #7/22
90.6%Gewinner in dieser Zeile
vs
89.8%

Reasoning

ARC-AGI#8/14 · #14/14
58.3%Gewinner in dieser Zeile
vs
0.2%
Artificial Analysis Intelligence Index#43/67 · #11/67
35.9%
vs
51.4%Gewinner in dieser Zeile
GPQA Diamond#54/69 · #13/69
77.2%
vs
92%Gewinner in dieser Zeile
Humanity's Last Exam#54/65 · #10/65
13.2%
vs
41.6%Gewinner in dieser Zeile
IFBench#54/57 · #22/57
41.16%
vs
73.95%Gewinner in dieser Zeile
LiveBench#5/21 · #6/21
67.2%Gewinner in dieser Zeile
vs
66.4%

Coding

SciCode#37/65 · #5/65
46.9%
vs
56.6%Gewinner in dieser Zeile
SWE-bench Verified#13/23 · #12/23
79.6%
vs
80%Gewinner in dieser Zeile

Agentisch

Terminal-Bench#24/69 · #7/69
68.4%
vs
81.8%Gewinner in dieser Zeile
τ³-Bench Banking#12/64 · #26/64
79.53%Gewinner in dieser Zeile
vs
30.31%

Langer Kontext

AA-LCR#51/64 · #3/64
57.67%
vs
74%Gewinner in dieser Zeile
LongBench v2#8/19 · #6/19
52.6%
vs
54.2%Gewinner in dieser Zeile

Tool-Nutzung

BFCL#1/20 · #5/20
88.7%Gewinner in dieser Zeile
vs
83.8%

Menschliche Präferenz

LMArena (Chatbot Arena)#10/13 · #8/13
1396
vs
1405Gewinner in dieser Zeile

Performance

AA output speed#48/69 · #17/69
60 t/s
vs
152 t/sGewinner in dieser Zeile
AA time to first token#39/69 · #1/69
1.18sGewinner in dieser Zeile
vs
129.43s
Dossier-Fakten

Daten, Quellen, Kleingedrucktes.

Claude Sonnet 4.6GPT 5.4
AnbieterAnthropicOpenAI
FamilyClaude SonnetGPT 5
Veröffentlichung2026-02-172026-03-05
Wissensstichtag2025-12-012026-01-31
Kontextfenster1M256K
Max. Output128K66K
Input-Preis /1M$3.0$7.0
Output-Preis /1M$15$28
Statusflagshipflagship
Composite-Score6661
Intelligence-Score6051
Intel-Quellevalsaa
Benchmark-Zeilen2418
Quellenanzahl1110
Aktualitätfreshfresh
Preis geprüft2026-06-012026-06-01
Ökosystem

Welche Tools jedes Modell einwickeln.

Urteil

Welches Modell du wirklich wählen solltest.

Composite-Scores liegen innerhalb von 5 Punkten — 66 für Claude Sonnet 4.6 vs 61 für GPT 5.4. Die Wahl hängt von Fähigkeitsprofil und Preis ab. Claude Sonnet 4.6 hat den höheren Vals/AA-Intelligence-Score (60 vs 51). Claude Sonnet 4.6 ist erschwinglicher bei $3.0/1M Input — etwa 2× günstiger als $7.0/1M. Claude Sonnet 4.6s 1M Kontextfenster übertrifft GPT 5.4s 256K deutlich — relevant für lange Dokumente oder Codebasen.