Anthropics Sonnet Februar 2025 mit Extended Thinking. AIME 2024 93,7 % (Extended Thinking). Von Sonnet 4.6 abgelöst, aber weiterhin auf Legacy-Leaderboards referenziert.
Legacy-Anthropic-Mittelklasse — neue Arbeit auf Claude Sonnet 4.6 migrieren.
Noch nicht genug Familien abgedeckt.Mehr Benchmark-Zeilen für Claude 3.7 Sonnet eintragen, damit das Familienprofil erscheint.
Benchmark-Platzierungen
Positionen pro Benchmark
Wo Claude 3.7 Sonnet auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.
Noch keine Benchmark-Zeilen für Claude 3.7 Sonnet.
Family-Kontext
Stärkste Zeilen pro Family
Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Claude 3.7 Sonnet auftaucht, ist es hervorgehoben.
Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.
Mathe94
Preis vs. Performance
Wo Claude 3.7 Sonnet im Scatter liegt
Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.