Modelle / Anthropic

Claude Opus 4 (2024-07)

Claude Opus · Release 2024-07-01

Claude-Opus-4-Checkpoint Juli 2024. HELM Safety 92,1 % im öffentlichen Ledger. Vorgänger von Opus 4.5+.

Früher Opus-4-API-Snapshot für Leaderboard-Kontinuität.

Composite88
Kontext200K
Input / 1M$15
Output / 1M$75
Wissensstichtag2024-04-01
Statuslightweight
Noch nicht genug Familien abgedeckt.Mehr Benchmark-Zeilen für Claude Opus 4 (2024-07) eintragen, damit das Familienprofil erscheint.
Benchmark-Platzierungen

Wo Claude Opus 4 (2024-07) auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.

BenchmarkFamilyRangScoreQuelleDatum
HELM SafetySafety#1/ 992Stanford HELM leaderboard2024-08-15
MATHMath#14/ 2586Anthropic model card2025-06-01
Family-Kontext

Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Claude Opus 4 (2024-07) auftaucht, ist es hervorgehoben.

Family-Abdeckung

Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.

Mathe86
Sicherheit92
Preis vs. Performance
0255075100$0.10$0.30$1$3$10$30Input-USD / 1M Tokens · log-Skala →← Intelligenz

Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.

AnthropicOpenAIMistralAlibabaDeepSeekGoogleMoonshotMetaMiniMaxxAIZhipuXiaomiOtherMeituanCohereNVIDIA

Volles Benchmark-Ledger

Jeder Katalog-Benchmark für Claude Opus 4 (2024-07). Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.

2 Quell-Zeilen

2 von 37 Katalog-Benchmarks haben eine belegte Zeile für Claude Opus 4 (2024-07).

Math

Safety

Quellen