Modelle / Anthropic

Claude 3.5 Sonnet (2024-06)

Claude Sonnet · Release 2024-06-20

Claude-3.5-Sonnet-Checkpoint Juni 2024. HumanEval 92,0 % pass@1. Baseline zum Vergleich der Sonnet-4.x-Gewinne.

Historische Sonnet-Baseline auf öffentlichen Leaderboards — keine aktuelle Deployment-Wahl.

Composite82
Kontext200K
Input / 1M$3.0
Output / 1M$15
Wissensstichtag2024-04-01
Statuslightweight
Noch nicht genug Familien abgedeckt.Mehr Benchmark-Zeilen für Claude 3.5 Sonnet (2024-06) eintragen, damit das Familienprofil erscheint.
Benchmark-Platzierungen

Wo Claude 3.5 Sonnet (2024-06) auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.

BenchmarkFamilyRangScoreQuelleDatum
HumanEvalCoding#13/ 1592Anthropic Claude 3.5 Sonnet2024-06-20
MATHMath#23/ 2571Anthropic Claude 3.5 Sonnet2024-06-20
Family-Kontext

Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Claude 3.5 Sonnet (2024-06) auftaucht, ist es hervorgehoben.

Family-Abdeckung

Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.

Mathe71
Coding92
Preis vs. Performance
0255075100$0.10$0.30$1$3$10$30Input-USD / 1M Tokens · log-Skala →← Intelligenz

Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.

AnthropicOpenAIMistralAlibabaDeepSeekGoogleMoonshotMetaMiniMaxxAIZhipuXiaomiOtherMeituanCohereNVIDIA

Volles Benchmark-Ledger

Jeder Katalog-Benchmark für Claude 3.5 Sonnet (2024-06). Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.

2 Quell-Zeilen

2 von 37 Katalog-Benchmarks haben eine belegte Zeile für Claude 3.5 Sonnet (2024-06).

Math

Coding

Quellen