Benchmarks / Performance

AA time to first token

TTFT

Median-Sekunden bis zum ersten Token am Default-API-Provider mit ~1k Input-Tokens.

Artificial AnalysisPerformanceFlagshipAktivUnbekanntes KontaminationsrisikoSeit 2026
Was dieser Benchmark nicht misst
  • End-to-End-Aufgabenzeit für Agent-Loops — TTFT ist ein Hop, keine ganze Coding-Session.
  • Nicht-Default-Provider — AA pinnt eine Default-Route pro Modell für Vergleichbarkeit.
Analyse

Warum dieser Benchmark nützlich ist

Redaktionelle Einordnung ausstehendWir veröffentlichen zuerst Methodik und Ledger. Die benchmark-spezifische Analyse folgt nach der Desk-Prüfung.

Umfang

Abdeckung

Aufgabenfamilie
Performance
Format
Einzel-API-Request mit Streaming; Median P50 über 72 Stunden.
Bewertung
Weniger Sekunden ist schneller.
Verantwortliche Stelle
Artificial Analysis
Lesehilfe

So liest du die Scores

Die Lesehilfe steht noch aus. Nutze bis zur Desk-Einordnung Aufgabenformat, Bewertungsmethode und Quelldaten im Ledger.

Blinde Flecken

Was er nicht abdeckt

  • End-to-End-Aufgabenzeit für Agent-Loops — TTFT ist ein Hop, keine ganze Coding-Session.
  • Nicht-Default-Provider — AA pinnt eine Default-Route pro Modell für Vergleichbarkeit.
Scores

Evidenz-Ledger

69 Zeilen
6969 Zeilen
129.43sbester Score
69quellgeprüft
1Quellen
2026-07-21Quelldatum
69

api · api

Verteilung

Wo die Zeilen liegen

0255075100

Auf die Skala dieses Benchmarks normalisiert (0–100). Die Tabelle zeigt die Rohwerte.

Zeitverlauf

Neueste Belege

  1. GPT 5.4129.43s ·
  2. GPT-5.6 Terra100.45s ·
  3. GPT-5.297.23s ·
  4. Claude Sonnet 588.49s ·
  5. GPT-5.6 Luna83.80s ·

Scores nutzen die eigene Einheit und Skala dieses Benchmarks, keinen universellen Qualitätswert.

#ModellVeröffentlichungScoreHerkunftBeleglage
1GPT 5.4OpenAI2026-03-05129.43s
2026-07-21
Quelle geprüft
2GPT-5.6 TerraOpenAI2026-07-09100.45s
2026-07-21
Quelle geprüft
3GPT-5.2OpenAI2025-12-1197.23s
2026-07-21
Quelle geprüft
4Claude Sonnet 5Anthropic2026-06-3088.49s
2026-07-21
Quelle geprüft
5GPT-5.6 LunaOpenAI2026-07-0983.80s
2026-07-21
Quelle geprüft
6GPT-5.6 SolOpenAI2026-07-0976.91s
2026-07-21
Quelle geprüft
7Claude Fable 5Anthropic2026-06-0968.33s
2026-07-21
Quelle geprüft
8Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)Anthropic2026-02-1757.98s
2026-07-21
Quelle geprüft
9GPT-5.3 Codex (xhigh)OpenAI2026-02-0541.56s
2026-07-21
Quelle geprüft
10GPT-5.1OpenAI2025-11-1338.96s
2026-07-21
Quelle geprüft
11GPT 5.5OpenAI2026-04-2331.38s
2026-07-21
Quelle geprüft
12Grok 4.3xAI2026-04-3031.32s
2026-07-21
Quelle geprüft
13Claude Opus 4.8Anthropic2026-05-2830.13s
2026-07-21
Quelle geprüft
14Gemini 3.1 Pro PreviewGoogle2026-02-1921.91s
2026-07-21
Quelle geprüft
15Grok 4.20 ReasoningxAI2026-03-0516.81s
2026-07-21
Quelle geprüft
16Claude Opus 4.7Anthropic2026-04-1616.72s
2026-07-21
Quelle geprüft
17Claude Opus 4.6 (Adaptive Reasoning, Max Effort)Anthropic2026-02-0514.02s
2026-07-21
Quelle geprüft
18GPT-5.5 (high)OpenAI2026-04-2313.95s
2026-07-21
Quelle geprüft
19Gemini 3.5 FlashGoogle2026-05-1912.11s
2026-07-21
Quelle geprüft
20Grok 4.5xAI2026-07-089.69s
2026-07-21
Quelle geprüft
21Gemini 3.5 Flash (medium)Google2026-05-198.89s
2026-07-21
Quelle geprüft
22GPT-5.4 MiniOpenAI2026-03-178.20s
2026-07-21
Quelle geprüft
23GPT-5.5 (medium)OpenAI2026-04-236.88s
2026-07-21
Quelle geprüft
24Kimi K3Moonshot2026-07-166.19s
2026-07-21
Quelle geprüft
25Gemini 3.1 Flash LiteGoogle2026-05-074.90s
2026-07-21
Quelle geprüft
26OpenAI o3OpenAI2025-04-164.84s
2026-07-21
Quelle geprüft
27GPT-5.4 NanoOpenAI2026-03-173.46s
2026-07-21
Quelle geprüft
28MiMo-V2.5-ProXiaomi2026-04-222.38s
2026-07-21
Quelle geprüft
29Claude Opus 4.6Anthropic2026-02-051.85s
2026-07-21
Quelle geprüft
30LFM2.5-8B-A1BLiquid2026-06-081.79s
2026-07-21
Quelle geprüft
31Qwen 3.7 PlusAlibaba2026-06-021.69s
2026-07-21
Quelle geprüft
32GPT-5.5 (low)OpenAI2026-04-231.61s
2026-07-21
Quelle geprüft
33Claude Opus 4.7 (Non-reasoning, High Effort)Anthropic2026-04-161.55s
2026-07-21
Quelle geprüft
34Qwen3.7 MaxAlibaba2026-05-191.55s
2026-07-21
Quelle geprüft
35Gemma 4 12B (Non-reasoning)Google2026-06-101.49s
2026-07-21
Quelle geprüft
36Gemma 4 12B (Reasoning)Google2026-06-071.46s
2026-07-21
Quelle geprüft
37Claude Opus 4.5Anthropic2025-11-241.32s
2026-07-21
Quelle geprüft
38MiniMax M3MiniMax2026-05-311.26s
2026-07-21
Quelle geprüft
39Claude Sonnet 4.6Anthropic2026-02-171.18s
2026-07-21
Quelle geprüft
40Kimi K2.7 CodeMoonshot2026-06-121.17s
2026-07-21
Quelle geprüft
41MiniMax M2.7MiniMax2026-04-151.17s
2026-07-21
Quelle geprüft
42Kimi K2.6Moonshot2026-04-201.08s
2026-07-21
Quelle geprüft
43Kimi K2.5Moonshot2026-01-271.02s
2026-07-21
Quelle geprüft
44MiniMax M2.5MiniMax2026-04-011.02s
2026-07-21
Quelle geprüft
45DeepSeek V4 Pro (Reasoning, Max Effort)DeepSeek2026-04-241.01s
2026-07-21
Quelle geprüft
46Gemma 4 31B ITGoogle2026-03-010.98s
2026-07-21
Quelle geprüft
47Nemotron 3 Ultra 550B A55B (Reasoning)NVIDIA2026-06-040.88s
2026-07-21
Quelle geprüft
48GLM-5.1Zhipu2026-04-070.86s
2026-07-21
Quelle geprüft
49GLM-5.2Zhipu2026-06-130.84s
2026-07-21
Quelle geprüft
50Muse Spark 1.1Meta2026-07-090.83s
2026-07-21
Quelle geprüft
51Gemini 3 Flash PreviewGoogle2025-12-170.72s
2026-07-21
Quelle geprüft
52Step 3.7 FlashStepFun2026-06-010.72s
2026-07-21
Quelle geprüft
53HyperNova 60B 2605Multiverse2026-05-060.60s
2026-07-21
Quelle geprüft
54Llama 4 MaverickMeta2026-04-050.60s
2026-07-21
Quelle geprüft
55Mistral Large 3Mistral2025-12-020.59s
2026-07-21
Quelle geprüft
56Llama 4 ScoutMeta2026-04-050.56s
2026-07-21
Quelle geprüft
57Command ACohere2026-03-150.36s
2026-07-21
Quelle geprüft
58North Mini CodeCohere2026-06-090.23s
2026-07-21
Quelle geprüft
59Claude 3 OpusAnthropic2024-03-040.00s
2026-07-21
Quelle geprüft
60DeepSeek Coder V2DeepSeek2024-05-150.00s
2026-07-21
Quelle geprüft
61DeepSeek R1DeepSeek2025-01-200.00s
2026-07-21
Quelle geprüft
62Gemini 1.0 UltraGoogle2024-02-080.00s
2026-07-21
Quelle geprüft
63Gemini 3 ProGoogle2025-11-180.00s
2026-07-21
Quelle geprüft
64GPT-5.4 ProOpenAI2026-03-050.00s
2026-07-21
Quelle geprüft
65GPT-5.5 ProOpenAI2026-04-230.00s
2026-07-21
Quelle geprüft
66LongCat-2.0Meituan2026-06-290.00s
2026-07-21
Quelle geprüft
67MiniCPM5-1B (Reasoning)OpenBMB2026-06-040.00s
2026-07-21
Quelle geprüft
68Muse SparkOther2026-01-010.00s
2026-07-21
Quelle geprüft
69OpenAI o1OpenAI2024-09-120.00s
2026-07-21
Quelle geprüft
Methode

Was er abdeckt

Die Notiz zur Datenqualität steht aus. Jede Ledger-Zeile trägt weiterhin Quellen-URL, Quelldatum und Zeitpunkt des Einlesens.

Score-Obergrenze

Wo er an Grenzen stößt

Noch ist keine Obergrenze erfasst. Wenn sich Scores oben bündeln, kann der Benchmark Frontier-Modelle möglicherweise nicht mehr trennen.

Tools, die ihn ausweisen

Belege

Quellen und weiterführende Lektüre

The Pack · Redaktionsnewsletter

Neue Karten in dein Postfach. Kostenlos.

Eine kurze E-Mail, wenn eine Karte erscheint oder den Status wechselt. Kein Tracking, keine Drittanbieter-Analytics. Abmeldung mit einem Klick.