Modelle / xAI

Grok 4.6

Grok · Release 2026-08-12

xAIs Flaggschiff August 2026. AA-Intelligence-Index v4.3 ist 44,4 bei High Effort. API-Liste $2 / $6 pro 1M Tokens; AA listet 500k Kontext.

Aktuelles xAI-Frontier-Modell für agentisches Coding und Knowledge-Work. Bevorzuge belegte Ledger-Zeilen gegenüber Launch-Claims; AA-Scores kommen aus dem öffentlichen Snapshot.

#8 von 184 im AA Index · aktueller Snapshot
44 AA Index · 12 Benchmark-Zeilen · 2 QuellenPosition ist benchmark-spezifisch — kein Cross-Family- oder Cross-Source-Ranking.
Composite53
Kontext500K
Input / 1M$2.0
Output / 1M$6.0
Wissensstichtagopen
Output-Speed63 t/s
TTFT (Default-API)38.97s
Statusflagship

Familienprofil

Bester veröffentlichter Score je abgedeckter Benchmark-Familie.

74/100 Ø
Wissen
48
Reasoning
95
Coding
57
Agentisch
88
Langer Kontext
80

5 getestete Benchmark-Familien

Redaktionsnotiz
Launch-Erfassung aus dem AA-Snapshot vom 2026-08-12 (v4.1 High-Effort-Index 60,9). Der AA-API-Snapshot vom 10. Sep. 2026 scored 44,4 auf Intelligence Index v4.3 bei High Effort und listet 500k Kontext. Redaktionelle Tiefe braucht noch einen Desk-Pass.
Benchmark-Platzierungen

Wo Grok 4.6 auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.

BenchmarkFamilyRangScoreQuelleDatum
τ³-Bench BankingAgentic#2/ 11051Artificial Analysis2026-09-10
GPQA DiamondReasoning#3/ 19095Artificial Analysis2026-09-10
Terminal-BenchAgentic#4/ 18988Artificial Analysis2026-09-10
Terminal-Bench-ScienceAgentic#8/ 97Terminal-Bench-Science 0.1 announcement2026-08-27
AA time to first tokenPerformance#9/ 190Artificial Analysis2026-09-10
AA-OmniscienceKnowledge#10/ 1248Artificial Analysis — AA-Omniscience2026-09-01
Artificial Analysis Intelligence IndexReasoning#11/ 18844Artificial Analysis2026-09-10
CritPtReasoning#12/ 1217Artificial Analysis — CritPt2026-09-01
SciCodeCoding#13/ 9357Artificial Analysis2026-09-10
Humanity's Last ExamReasoning#23/ 18543Artificial Analysis2026-09-10
AA-LCRLong context#32/ 18280Artificial Analysis2026-09-10
AA output speedPerformance#64/ 190Artificial Analysis2026-09-10
Family-Kontext

Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Grok 4.6 auftaucht, ist es hervorgehoben.

Neueste Belege

Benchmark-Zeilen im öffentlichen Ledger für Grok 4.6 in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.

12 neu
Family-Abdeckung

Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.

Wissen48
Reasoning95
Coding57
Agentisch88
Langer Kontext80
Preis vs. Performance
0255075100$0.10$0.30$1$3$10$30Input-USD / 1M Tokens · log-Skala →← Intelligenz

Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.

AnthropicOpenAIMistralAlibabaDeepSeekGoogleMoonshotMetaxAIMiniMaxZhipuXiaomiOtherMeituanCohereNVIDIA

Volles Benchmark-Ledger

Jeder Katalog-Benchmark für Grok 4.6. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.

12 Quell-Zeilen

12 von 37 Katalog-Benchmarks haben eine belegte Zeile für Grok 4.6.

Knowledge

Reasoning

Coding

Agentic

Long context

Performance

Changelog
  1. AA-API-Snapshot: Intelligence Index v4.3 ist 44,4 bei High Effort.
  2. Live-AA-Intelligence-Index v4.2 ist 51 bei High Effort; AA listet jetzt 500k Kontext.
  3. Grok 4.6 erscheint auf Artificial Analysis (High-Effort-Index 60,9, $2 / $6 pro 1M Tokens).
Quellen

The Pack · Redaktionsnewsletter

Neue Tools in dein Postfach. Kostenlos.

Eine kurze E-Mail, wenn ein Tool erscheint oder den Status wechselt. Kein Tracking, keine Drittanbieter-Analytics. Abmeldung mit einem Klick.