65%
AA-Omniscience Accuracy
Modelle / Anthropic
Claude Fable · Release 2026-06-09
Anthropics Mythos-class-GA-Release Juni 2026. 1M-Kontext, 128K-Output, Safety-Klassifikatoren leiten Hochrisiko-Anfragen an Opus 4.8. $10 / $50 pro 1M Tokens. Vals-Index 66,04 % im Snapshot vom 1. Sep. 2026 — hinter Fable 5.1 (67,87 %) und Opus 5 (67,21 %).
Langfristige Agent-Arbeit — mehrtägige Coding-Migrationen, Finance-Analyse, vision-lastige Rebuilds und Research-Pipelines, die Sonnet- oder Opus-Sessions überdauern.
Familienprofil
Bester veröffentlichter Score je abgedeckter Benchmark-Familie.
5 getestete Benchmark-Familien
Wo Claude Fable 5 auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.
Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Claude Fable 5 auftaucht, ist es hervorgehoben.
Benchmark-Zeilen im öffentlichen Ledger für Claude Fable 5 in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.
| Benchmark | Family | Score | Quelle | Tage her |
|---|---|---|---|---|
| Vals Index | Agentic | 66.04% | Vals AI — Vals Index | 5 |
| CritPt | Reasoning | 28.6% | Artificial Analysis — CritPt | 5 |
| AA-Omniscience | Knowledge | 65% | Artificial Analysis — AA-Omniscience | 5 |
| AA-LCR | Long context | 76.67% | Artificial Analysis | 5 |
| AA output speed | Performance | 58 t/s | Artificial Analysis | 5 |
| AA time to first token | Performance | 54.75s | Artificial Analysis | 5 |
| Artificial Analysis Intelligence Index | Reasoning | 62.1% | Artificial Analysis | 5 |
| GPQA Diamond | Reasoning | 92.6% | Artificial Analysis | 5 |
| Humanity's Last Exam | Reasoning | 55.5% | Artificial Analysis | 5 |
| IFBench | Reasoning | 63.47% | Artificial Analysis | 5 |
| SciCode | Coding | 60.2% | Artificial Analysis | 5 |
| τ³-Bench Banking | Agentic | 38.14% | Artificial Analysis | 5 |
| Terminal-Bench | Agentic | 84.64% | Artificial Analysis | 5 |
| Terminal-Bench-Science | Agentic | 21.4% | Terminal-Bench-Science 0.1 announcement | 10 |
| DeepSWE | Coding | 70% | DeepSWE leaderboard | 33 |
| GDPval | Agentic | 1818 | Artificial Analysis — GDPval-AA v2 | 81 |
Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.
Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.
Jeder Katalog-Benchmark für Claude Fable 5. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.
16 von 37 Katalog-Benchmarks haben eine belegte Zeile für Claude Fable 5.
65%
AA-Omniscience Accuracy
62.1%
AA Intelligence Index v4.1
28.6%
CritPt composite (AA run)
92.6%
GPQA Diamond (AA run)
55.5%
HLE (AA run)
63.47%
IFBench (AA run)
1818
GDPval-AA v2
84.64%
Terminal-Bench v2.1 (AA run)
21.4%
TB-Science 0.1 resolution (Claude Code)
66.04%
Vals Index
38.14%
τ³-Bench Banking (AA run)
76.67%
AA-LCR (AA run)
58 t/s
Median output tokens/s (1k prompt, default provider)
54.75s
Median time to first token (1k prompt, default provider)