Modelle / Anthropic

Claude 3.5 Sonnet (2024-06)

Claude Sonnet · Release 2024-06-20

Claude-3.5-Sonnet-Checkpoint Juni 2024. HumanEval 92,0 % pass@1. Baseline zum Vergleich der Sonnet-4.x-Gewinne.

Historische Sonnet-Baseline auf öffentlichen Leaderboards — keine aktuelle Deployment-Wahl.

Composite82
Kontext200K
Input / 1M$3.0
Output / 1M$15
Wissensstichtag2024-04-01
Statuslightweight
Not enough families covered yet.Add more benchmark rows for Claude 3.5 Sonnet (2024-06) to see the radar.
Benchmark-Platzierungen

Wo Claude 3.5 Sonnet (2024-06) auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.

BenchmarkFamilyRangScoreQuelleDatum
HumanEvalCoding#13/ 1592Anthropic Claude 3.5 Sonnet2024-06-20
MATHMath#18/ 2071Anthropic Claude 3.5 Sonnet2024-06-20
Family-Kontext

Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Claude 3.5 Sonnet (2024-06) auftaucht, ist es hervorgehoben.

MathClaude 3.5 Sonnet (2024-06) · 71
  1. 1
    99
  2. 2
    97
  3. 3
    96
CodingClaude 3.5 Sonnet (2024-06) · 92
  1. 1
    96
  2. 2
    96
  3. 3
    96
Long context
  1. 1
    75
  2. 2
    75
  3. 3
    74
Family-Abdeckung

Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.

Math71
Coding92
Preis vs. Performance
0255075100$0.10$0.30$1$3$10$30input USD / 1M tokens · log scale →← intelligence

Hover or tab any dot for name, score, and input price.

AnthropicOpenAIMistralAlibabaDeepSeekGoogleMoonshotMiniMaxxAIMetaZhipuXiaomiMeituanCohere

Volles Benchmark-Ledger

Jeder Katalog-Benchmark für Claude 3.5 Sonnet (2024-06). Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.

2 Quell-Zeilen

2 of 32 catalog benchmarks have a sourced row for Claude 3.5 Sonnet (2024-06).

Math

Coding

Quellen