Anthropics Sonnet Februar 2025 mit Extended Thinking. AIME 2024 93,7 % (Extended Thinking). Von Sonnet 4.6 abgelöst, aber weiterhin auf Legacy-Leaderboards referenziert.
Legacy-Anthropic-Mittelklasse — neue Arbeit auf Claude Sonnet 4.6 migrieren.
Not enough families covered yet.Add more benchmark rows for Claude 3.7 Sonnet to see the radar.
Benchmark-Platzierungen
Positionen pro Benchmark
Wo Claude 3.7 Sonnet auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.
Noch keine Benchmark-Zeilen für Claude 3.7 Sonnet.
Family-Kontext
Stärkste Zeilen pro Family
Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Claude 3.7 Sonnet auftaucht, ist es hervorgehoben.
Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.
Math94
Preis vs. Performance
Wo Claude 3.7 Sonnet im Scatter liegt
Hover or tab any dot for name, score, and input price.