Modelle / Anthropic

Claude Fable 5

Claude Fable · Release 2026-06-09

Anthropics Mythos-class-GA-Release Juni 2026. 1M-Kontext, 128K-Output, Safety-Klassifikatoren leiten Hochrisiko-Anfragen an Opus 4.8. $10 / $50 pro 1M Tokens. Vals-Index 66,04 % im Snapshot vom 1. Sep. 2026 — hinter Fable 5.1 (67,87 %) und Opus 5 (67,21 %).

Langfristige Agent-Arbeit — mehrtägige Coding-Migrationen, Finance-Analyse, vision-lastige Rebuilds und Research-Pipelines, die Sonnet- oder Opus-Sessions überdauern.

#10 von 24 im Vals Index · aktueller Snapshot
66 Vals Index · 16 Benchmark-Zeilen · 4 QuellenPosition ist benchmark-spezifisch — kein Cross-Family- oder Cross-Source-Ranking.
Composite63
Kontext1M
Input / 1M$10
Output / 1M$50
Wissensstichtag2026-04-01
Output-Speed58 t/s
TTFT (Default-API)54.75s
Statusflagship

Familienprofil

Bester veröffentlichter Score je abgedeckter Benchmark-Familie.

81/100 Ø
Wissen
65
Reasoning
93
Coding
70
Agentisch
100
Langer Kontext
77

5 getestete Benchmark-Familien

Redaktionsnotiz
Fable 5 ist das Modell, zu dem wir greifen, wenn eine Aufgabe Tage autonomer Arbeit braucht, nicht Minuten. Die Safety-Klassifikatoren sind konservativ — Cyber-, Biologie- und Chemie-Prompts können auf Opus 4.8 zurückfallen — also System Card lesen, bevor man es auf sensible Workflows pinnt. Fable 5.1 führt den aktuellen Vals-Index; diese Seite bleibt der GA-Checkpoint vom Juni.
Benchmark-Platzierungen

Wo Claude Fable 5 auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.

BenchmarkFamilyRangScoreQuelleDatum
GDPvalAgentic#1/ 6100Artificial Analysis — GDPval-AA v22026-06-17
Humanity's Last ExamReasoning#1/ 18056Artificial Analysis2026-09-01
SciCodeCoding#1/ 18060Artificial Analysis2026-09-01
AA-OmniscienceKnowledge#2/ 1265Artificial Analysis — AA-Omniscience2026-09-01
Artificial Analysis Intelligence IndexReasoning#2/ 18762Artificial Analysis2026-09-01
DeepSWECoding#3/ 870DeepSWE leaderboard2026-08-04
Terminal-Bench-ScienceAgentic#3/ 921Terminal-Bench-Science 0.1 announcement2026-08-27
AA time to first tokenPerformance#6/ 186Artificial Analysis2026-09-01
CritPtReasoning#6/ 1229Artificial Analysis — CritPt2026-09-01
Vals IndexAgentic#10/ 2366Vals AI — Vals Index2026-09-01
Terminal-BenchAgentic#11/ 18485Artificial Analysis2026-09-01
GPQA DiamondReasoning#17/ 18593Artificial Analysis2026-09-01
τ³-Bench BankingAgentic#22/ 10638Artificial Analysis2026-09-01
AA-LCRLong context#31/ 17977Artificial Analysis2026-09-01
AA output speedPerformance#59/ 187Artificial Analysis2026-09-01
IFBenchReasoning#74/ 12763Artificial Analysis2026-09-01
Family-Kontext

Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Claude Fable 5 auftaucht, ist es hervorgehoben.

Neueste Belege

Benchmark-Zeilen im öffentlichen Ledger für Claude Fable 5 in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.

16 neu
Family-Abdeckung

Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.

Wissen65
Reasoning93
Coding70
Agentisch100
Langer Kontext77
Preis vs. Performance
0255075100$0.10$0.30$1$3$10$30Input-USD / 1M Tokens · log-Skala →← Intelligenz

Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.

AnthropicOpenAIMistralAlibabaDeepSeekGoogleMoonshotMetaMiniMaxxAIZhipuXiaomiOtherMeituanCohereNVIDIA

Volles Benchmark-Ledger

Jeder Katalog-Benchmark für Claude Fable 5. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.

16 Quell-Zeilen

16 von 37 Katalog-Benchmarks haben eine belegte Zeile für Claude Fable 5.

Knowledge

Reasoning

Coding

Agentic

Long context

Performance

Changelog
  1. Claude Fable 5 veröffentlicht — erstes GA Mythos-class-Modell.
  2. Vals-Index 66,04 % im Snapshot vom 1. Sep.; Fable 5.1 übernimmt die Führung mit 67,87 %.
Quellen