Benchmarks / Performance

AA time to first token

TTFT

Median-Sekunden bis zum ersten Token am Default-API-Provider mit ~1k Input-Tokens.

Was dieser Benchmark nicht misst
  • End-to-End-Aufgabenzeit für Agent-Loops — TTFT ist ein Hop, keine ganze Coding-Session.
  • Nicht-Default-Provider — AA pinnt eine Default-Route pro Modell für Vergleichbarkeit.
Analyse

Warum dieser Benchmark nützlich ist

Time-to-first-token ist die Pause vor dem ersten sichtbaren Token — relevant, wenn schneller Start wichtiger ist als anhaltende Generierungsgeschwindigkeit.

Umfang

Abdeckung

Aufgabenfamilie
Performance
Format
Einzel-API-Request mit Streaming; Median P50 über 72 Stunden.
Bewertung
Weniger Sekunden ist schneller.
Verantwortliche Stelle
Artificial Analysis
Lesehilfe

So liest du die Scores

Niedrigere Median-Sekunden sind besser. Ein Hop auf der Default-API-Route mit ~1k Prompt; keine End-to-End-Agent- oder Chat-App-Latenz.

Blinde Flecken

Was er nicht abdeckt

  • End-to-End-Aufgabenzeit für Agent-Loops — TTFT ist ein Hop, keine ganze Coding-Session.
  • Nicht-Default-Provider — AA pinnt eine Default-Route pro Modell für Vergleichbarkeit.
Scores

Evidenz-Ledger

186 Zeilen
186186 Zeilen
384.30sbester Score
186quellgeprüft
1Quellen
2026-09-05bis 2026-09-01
186

api · api

Verteilung

Wo die Zeilen liegen

0255075100

Auf die Skala dieses Benchmarks normalisiert (0–100). Die Tabelle zeigt die Rohwerte.

Zeitverlauf

Neueste Belege

  1. GPT-6 Astra384.30s ·
  2. Claude Sonnet 5142.07s ·
  3. GPT-5.6 Terra94.25s ·
  4. GPT-5.6 Sol91.64s ·
  5. GPT-5.6 Luna83.33s ·

Scores nutzen die eigene Einheit und Skala dieses Benchmarks, keinen universellen Qualitätswert.

#ModellVeröffentlichungScoreHerkunftBeleglage
1GPT-6 AstraOpenAIAA-FAQ-Zahl für Max Effort. Enthält Thinking-Zeit vor dem ersten Antwort-Token.2026-09-03384.30s
2026-09-05
Quelle geprüft
2Claude Sonnet 5Anthropic2026-06-30142.07s
2026-09-01
Quelle geprüft
3GPT-5.6 TerraOpenAI2026-07-0994.25s
2026-09-01
Quelle geprüft
4GPT-5.6 SolOpenAI2026-07-0991.64s
2026-09-01
Quelle geprüft
5GPT-5.6 LunaOpenAI2026-07-0983.33s
2026-09-01
Quelle geprüft
6Claude Fable 5Anthropic2026-06-0954.75s
2026-09-01
Quelle geprüft
7Claude Opus 5 (Adaptive Reasoning, Max Effort)Anthropic2026-07-2436.30s
2026-09-01
Quelle geprüft
8GPT-5.3 Codex (xhigh)OpenAI2026-02-0535.84s
2026-09-01
Quelle geprüft
9Grok 4.6xAI2026-08-1235.04s
2026-09-01
Quelle geprüft
10Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)Anthropic2026-07-2424.72s
2026-09-01
Quelle geprüft
11Gemini 3.1 Pro PreviewGoogle2026-02-1922.68s
2026-09-01
Quelle geprüft
12Grok 4.3 (medium)xAI2026-04-3017.39s
2026-09-01
Quelle geprüft
13Gemini 3.6 Flash (high)Google2026-07-2112.64s
2026-09-01
Quelle geprüft
14Grok 4.5xAI2026-07-0811.48s
2026-09-01
Quelle geprüft
15Claude Opus 5 (Adaptive Reasoning, High Effort)Anthropic2026-07-2410.32s
2026-09-01
Quelle geprüft
16Gemini 3.5 Flash (medium)Google2026-05-198.27s
2026-09-01
Quelle geprüft
17Gemini 3.7 FlashGoogle2026-08-137.00s
2026-09-01
Quelle geprüft
18Gemini 3.5 Flash-LiteGoogle2026-07-216.81s
2026-09-01
Quelle geprüft
19Grok 4.3 (low)xAI2026-04-306.67s
2026-09-01
Quelle geprüft
20Claude Opus 5 (Adaptive Reasoning, Medium Effort)Anthropic2026-07-246.33s
2026-09-01
Quelle geprüft
21OpenAI o3OpenAI2025-04-165.65s
2026-09-01
Quelle geprüft
22MiMo-V2.5Xiaomi2026-04-223.76s
2026-09-01
Quelle geprüft
23MiMo-V2.5-ProXiaomi2026-04-223.74s
2026-09-01
Quelle geprüft
24MiMo-V2.5-Pro (Non-reasoning)Xiaomi2026-04-223.62s
2026-09-01
Quelle geprüft
25Claude Opus 5 (Adaptive Reasoning, Low Effort)Anthropic2026-07-242.66s
2026-09-01
Quelle geprüft
26Kimi K3Moonshot2026-07-162.39s
2026-09-01
Quelle geprüft
27Ring-2.6-1TOther2026-05-082.33s
2026-09-01
Quelle geprüft
28Inkling SmallOther2026-07-302.32s
2026-09-01
Quelle geprüft
29Kimi K3 (low)Moonshot2026-07-162.31s
2026-09-01
Quelle geprüft
30Inkling (xhigh)Other2026-07-152.28s
2026-09-01
Quelle geprüft
31Nemotron 3 Ultra 550B A55B (Reasoning)NVIDIA2026-06-042.23s
2026-09-01
Quelle geprüft
32LongCat-2.0Meituan2026-06-292.13s
2026-09-01
Quelle geprüft
33Ling 3.0 TinyOther2026-08-061.91s
2026-09-01
Quelle geprüft
34Qwen3.8 2.4T A95BAlibaba2026-08-121.76s
2026-09-01
Quelle geprüft
35Step 3.7 FlashStepFun2026-06-011.72s
2026-09-01
Quelle geprüft
36Qwen3.5 397B A17B (Reasoning)Alibaba2026-02-161.71s
2026-09-01
Quelle geprüft
37Hy3Other2026-07-061.69s
2026-09-01
Quelle geprüft
38Qwen3.5 397B A17B (Non-reasoning)Alibaba2026-02-161.66s
2026-09-01
Quelle geprüft
39Agnes 2.5 Pro AlphaOther2026-07-241.63s
2026-09-01
Quelle geprüft
40Ling 3.0 FlashOther2026-08-041.63s
2026-09-01
Quelle geprüft
41GLM-5.2 (Non-reasoning)Zhipu2026-06-161.57s
2026-09-01
Quelle geprüft
42GLM-5.3Zhipu2026-08-141.56s
2026-09-01
Quelle geprüft
43LFM2.5-8B-A1BLiquid2026-06-081.54s
2026-09-01
Quelle geprüft
44Qwen3.6 27B (Reasoning)Alibaba2026-04-221.48s
2026-09-01
Quelle geprüft
45Qwen3.6 27B (Non-reasoning)Alibaba2026-04-221.46s
2026-09-01
Quelle geprüft
46Qwen3.8 MaxAlibaba2026-08-031.46s
2026-09-01
Quelle geprüft
47Gemma 4 12B (Reasoning)Google2026-06-071.45s
2026-09-01
Quelle geprüft
48Qwen 3.7 PlusAlibaba2026-06-021.42s
2026-09-01
Quelle geprüft
49GLM-5.3-FlashZhipu2026-08-261.41s
2026-09-01
Quelle geprüft
50GLM-5.2Zhipu2026-06-131.36s
2026-09-01
Quelle geprüft
51Claude Sonnet 4.6 (Non-reasoning, Low Effort)Anthropic2026-02-171.34s
2026-09-01
Quelle geprüft
52DeepSeek V4 Pro (Non-reasoning)DeepSeek2026-04-241.33s
2026-09-01
Quelle geprüft
53Gemma 4 12B (Non-reasoning)Google2026-06-101.33s
2026-09-01
Quelle geprüft
54Kimi K2.7 CodeMoonshot2026-06-121.30s
2026-09-01
Quelle geprüft
55Qwen3.8-Flash-NextAlibaba2026-08-261.27s
2026-09-01
Quelle geprüft
56Solar Pro 4Other2026-08-061.27s
2026-09-01
Quelle geprüft
57KAT Coder Pro V2Other2026-03-271.26s
2026-09-01
Quelle geprüft
58Qwen3.8 27BAlibaba2026-08-141.21s
2026-09-01
Quelle geprüft
59DeepSeek V4 Pro (Reasoning, High Effort)DeepSeek2026-04-241.16s
2026-09-01
Quelle geprüft
60Agnes 2.5 Pro BetaOther2026-08-261.14s
2026-09-01
Quelle geprüft
61Qwen3.6 35B A3B (Non-reasoning)Alibaba2026-04-161.07s
2026-09-01
Quelle geprüft
62Qwen3.6 35B A3B (Reasoning)Alibaba2026-04-161.06s
2026-09-01
Quelle geprüft
63Qwen3.5 122B A10B (Reasoning)Alibaba2026-02-241.01s
2026-09-01
Quelle geprüft
64DeepSeek V4 Pro 0813 (Reasoning, Max Effort)DeepSeek2026-08-130.98s
2026-09-01
Quelle geprüft
65Gemma 4 31B ITGoogle2026-03-010.97s
2026-09-01
Quelle geprüft
66DeepSeek V4 Flash 0731 (Reasoning, Max Effort)DeepSeek2026-07-310.96s
2026-09-01
Quelle geprüft
67MiniMax M3MiniMax2026-05-310.95s
2026-09-01
Quelle geprüft
68GPT-5.5 Instant (June 2026)OpenAI2026-06-250.93s
2026-09-01
Quelle geprüft
69Nex-N2-ProOther2026-06-020.92s
2026-09-01
Quelle geprüft
70Grok 4.3 (Non-reasoning)xAI2026-04-300.87s
2026-09-01
Quelle geprüft
71Mistral Large 3Mistral2025-12-020.77s
2026-09-01
Quelle geprüft
72Gemini 3.5 Flash (minimal)Google2026-05-190.70s
2026-09-01
Quelle geprüft
73HyperNova 60B 2605Multiverse2026-05-060.69s
2026-09-01
Quelle geprüft
74Mistral Medium 3.5Mistral2026-04-290.64s
2026-09-01
Quelle geprüft
75DeepSeek V4 Flash Vision (Reasoning, Max Effort)DeepSeek2026-08-210.61s
2026-09-01
Quelle geprüft
76Nemotron 3 Nano Omni 30B A3B ReasoningNVIDIA2026-04-290.59s
2026-09-01
Quelle geprüft
77Nemotron 3.5 LightningNVIDIA2026-08-110.55s
2026-09-01
Quelle geprüft
78Llama 4 MaverickMeta2026-04-050.54s
2026-09-01
Quelle geprüft
79Llama 4 ScoutMeta2026-04-050.54s
2026-09-01
Quelle geprüft
80Muse GlimmerMeta2026-08-100.46s
2026-09-01
Quelle geprüft
81Granite 4.2 30BOther2026-08-250.24s
2026-09-01
Quelle geprüft
82Granite 4.2 8BOther2026-08-250.22s
2026-09-01
Quelle geprüft
83North Mini CodeCohere2026-06-090.21s
2026-09-01
Quelle geprüft
84Granite 4.2 3BOther2026-08-250.19s
2026-09-01
Quelle geprüft
85Command ACohere2026-03-150.16s
2026-09-01
Quelle geprüft
86A.X-K2Other2026-08-120.00s
2026-09-01
Quelle geprüft
87Apodex 1.1Other2026-08-300.00s
2026-09-01
Quelle geprüft
88Claude 3 OpusAnthropic2024-03-040.00s
2026-09-01
Quelle geprüft
89Claude 4 Opus (Reasoning)Anthropic2025-05-220.00s
2026-09-01
Quelle geprüft
90Claude 4.1 Opus (Reasoning)Anthropic2025-08-050.00s
2026-09-01
Quelle geprüft
91Claude 4.5 Sonnet (Reasoning)Anthropic2025-09-290.00s
2026-09-01
Quelle geprüft
92Claude Opus 4.5Anthropic2025-11-240.00s
2026-09-01
Quelle geprüft
93Claude Opus 4.5 (Reasoning)Anthropic2025-11-240.00s
2026-09-01
Quelle geprüft
94Claude Opus 4.6Anthropic2026-02-050.00s
2026-09-01
Quelle geprüft
95Claude Opus 4.6 (Adaptive Reasoning, Max Effort)Anthropic2026-02-050.00s
2026-09-01
Quelle geprüft
96Claude Opus 4.7Anthropic2026-04-160.00s
2026-09-01
Quelle geprüft
97Claude Opus 4.7 (Non-reasoning, High Effort)Anthropic2026-04-160.00s
2026-09-01
Quelle geprüft
98Claude Opus 4.8Anthropic2026-05-280.00s
2026-09-01
Quelle geprüft
99Claude Sonnet 4.6Anthropic2026-02-170.00s
2026-09-01
Quelle geprüft
100Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)Anthropic2026-02-170.00s
2026-09-01
Quelle geprüft
101DeepSeek Coder V2DeepSeek2024-05-150.00s
2026-09-01
Quelle geprüft
102DeepSeek R1DeepSeek2025-01-200.00s
2026-09-01
Quelle geprüft
103DeepSeek V3.2 (Reasoning)DeepSeek2025-12-010.00s
2026-09-01
Quelle geprüft
104DeepSeek V4 Flash (Non-reasoning)DeepSeek2026-04-240.00s
2026-09-01
Quelle geprüft
105DeepSeek V4 Flash (Reasoning, High Effort)DeepSeek2026-04-240.00s
2026-09-01
Quelle geprüft
106DiffusionGemma 26B A4BGoogle2026-06-100.00s
2026-09-01
Quelle geprüft
107EXAONE 4.5 33BOther2026-04-090.00s
2026-09-01
Quelle geprüft
108G9v3-39A5BOther2026-08-030.00s
2026-09-01
Quelle geprüft
109G9v3-3BOther2026-07-230.00s
2026-09-01
Quelle geprüft
110Gemini 1.0 UltraGoogle2024-02-080.00s
2026-09-01
Quelle geprüft
111Gemini 3 Flash PreviewGoogle2025-12-170.00s
2026-09-01
Quelle geprüft
112Gemini 3 Flash Preview (Reasoning)Google2025-12-170.00s
2026-09-01
Quelle geprüft
113Gemini 3 ProGoogle2025-11-180.00s
2026-09-01
Quelle geprüft
114Gemini 3 Pro Preview (low)Google2025-11-180.00s
2026-09-01
Quelle geprüft
115Gemini 3.1 Flash LiteGoogle2026-05-070.00s
2026-09-01
Quelle geprüft
116Gemini 3.5 FlashGoogle2026-05-190.00s
2026-09-01
Quelle geprüft
117GLM 5V Turbo (Reasoning)Zhipu2026-04-010.00s
2026-09-01
Quelle geprüft
118GLM-4.7 (Reasoning)Zhipu2025-12-220.00s
2026-09-01
Quelle geprüft
119GLM-5 (Non-reasoning)Zhipu2026-02-110.00s
2026-09-01
Quelle geprüft
120GLM-5 (Reasoning)Zhipu2026-02-110.00s
2026-09-01
Quelle geprüft
121GLM-5-TurboZhipu2026-03-150.00s
2026-09-01
Quelle geprüft
122GLM-5.1Zhipu2026-04-070.00s
2026-09-01
Quelle geprüft
123GPT 5.4OpenAI2026-03-050.00s
2026-09-01
Quelle geprüft
124GPT 5.5OpenAI2026-04-230.00s
2026-09-01
Quelle geprüft
125GPT-5 (high)OpenAI2025-08-070.00s
2026-09-01
Quelle geprüft
126GPT-5 (low)OpenAI2025-08-070.00s
2026-09-01
Quelle geprüft
127GPT-5 (medium)OpenAI2025-08-070.00s
2026-09-01
Quelle geprüft
128GPT-5 Codex (high)OpenAI2025-09-230.00s
2026-09-01
Quelle geprüft
129GPT-5.1OpenAI2025-11-130.00s
2026-09-01
Quelle geprüft
130GPT-5.1 Codex (high)OpenAI2025-11-130.00s
2026-09-01
Quelle geprüft
131GPT-5.2OpenAI2025-12-110.00s
2026-09-01
Quelle geprüft
132GPT-5.2 (medium)OpenAI2025-12-110.00s
2026-09-01
Quelle geprüft
133GPT-5.2 Codex (xhigh)OpenAI2025-12-110.00s
2026-09-01
Quelle geprüft
134GPT-5.4 (low)OpenAI2026-03-050.00s
2026-09-01
Quelle geprüft
135GPT-5.4 MiniOpenAI2026-03-170.00s
2026-09-01
Quelle geprüft
136GPT-5.4 NanoOpenAI2026-03-170.00s
2026-09-01
Quelle geprüft
137GPT-5.4 ProOpenAI2026-03-050.00s
2026-09-01
Quelle geprüft
138GPT-5.5 (high)OpenAI2026-04-230.00s
2026-09-01
Quelle geprüft
139GPT-5.5 (low)OpenAI2026-04-230.00s
2026-09-01
Quelle geprüft
140GPT-5.5 (medium)OpenAI2026-04-230.00s
2026-09-01
Quelle geprüft
141GPT-5.5 (Non-reasoning)OpenAI2026-04-230.00s
2026-09-01
Quelle geprüft
142GPT-5.5 Instant (May 2026)OpenAI2026-05-050.00s
2026-09-01
Quelle geprüft
143GPT-5.5 ProOpenAI2026-04-230.00s
2026-09-01
Quelle geprüft
144Granite 4.1 30BOther2026-04-290.00s
2026-09-01
Quelle geprüft
145Grok 4xAI2025-07-100.00s
2026-09-01
Quelle geprüft
146Grok 4.20 0309 (Reasoning)xAI2026-03-100.00s
2026-09-01
Quelle geprüft
147Grok 4.20 0309 v2 (Non-reasoning)xAI2026-04-070.00s
2026-09-01
Quelle geprüft
148Grok 4.20 ReasoningxAI2026-03-050.00s
2026-09-01
Quelle geprüft
149Grok 4.3xAI2026-04-300.00s
2026-09-01
Quelle geprüft
150Grok Build 0.1 0616xAI2026-06-160.00s
2026-09-01
Quelle geprüft
151Hy3-preview (Non-reasoning)Other2026-04-230.00s
2026-09-01
Quelle geprüft
152Hy3-preview (Reasoning)Other2026-04-230.00s
2026-09-01
Quelle geprüft
153JT-35B-FlashOther2026-05-140.00s
2026-09-01
Quelle geprüft
154JT-4.1 Flash 236B A21BOther2026-07-090.00s
2026-09-01
Quelle geprüft
155JT-MINIOther2026-04-150.00s
2026-09-01
Quelle geprüft
156K-EXAONE 2.0 0803Other2026-08-120.00s
2026-09-01
Quelle geprüft
157Kimi K2 ThinkingMoonshot2025-11-060.00s
2026-09-01
Quelle geprüft
158Kimi K2.5Moonshot2026-01-270.00s
2026-09-01
Quelle geprüft
159Kimi K2.6Moonshot2026-04-200.00s
2026-09-01
Quelle geprüft
160Kimi K2.6 (Non-reasoning)Other2026-04-200.00s
2026-09-01
Quelle geprüft
161Ling 2.6 FlashOther2026-04-210.00s
2026-09-01
Quelle geprüft
162Ling-2.6-1TOther2026-04-230.00s
2026-09-01
Quelle geprüft
163MiMo-V2-Flash (Feb 2026)Xiaomi2025-12-160.00s
2026-09-01
Quelle geprüft
164MiMo-V2-Flash (Reasoning)Xiaomi2025-12-160.00s
2026-09-01
Quelle geprüft
165MiMo-V2-OmniXiaomi2026-03-190.00s
2026-09-01
Quelle geprüft
166MiMo-V2-Omni-0327Xiaomi2026-03-270.00s
2026-09-01
Quelle geprüft
167MiMo-V2-ProXiaomi2026-03-180.00s
2026-09-01
Quelle geprüft
168MiniCPM-V 4.6 1.3BOpenBMB2026-05-110.00s
2026-09-01
Quelle geprüft
169MiniCPM5-1B (Non-reasoning)OpenBMB2026-05-250.00s
2026-09-01
Quelle geprüft
170MiniCPM5-1B (Reasoning)OpenBMB2026-06-040.00s
2026-09-01
Quelle geprüft
171MiniMax M2.5MiniMax2026-04-010.00s
2026-09-01
Quelle geprüft
172MiniMax M2.7MiniMax2026-04-150.00s
2026-09-01
Quelle geprüft
173MiniMax-M2.1MiniMax2025-12-230.00s
2026-09-01
Quelle geprüft
174Motif 3Other2026-08-120.00s
2026-09-01
Quelle geprüft
175Motif 3 (Beta)Other2026-07-210.00s
2026-09-01
Quelle geprüft
176Muse SparkOther2026-01-010.00s
2026-09-01
Quelle geprüft
177Muse Spark 1.1Meta2026-07-090.00s
2026-09-01
Quelle geprüft
178Muse Spark 1.2Meta2026-08-050.00s
2026-09-01
Quelle geprüft
179o3-proOpenAI2025-06-100.00s
2026-09-01
Quelle geprüft
180OpenAI o1OpenAI2024-09-120.00s
2026-09-01
Quelle geprüft
181Qwen3 Max ThinkingAlibaba2026-01-260.00s
2026-09-01
Quelle geprüft
182Qwen3.5 27B (Reasoning)Alibaba2026-02-240.00s
2026-09-01
Quelle geprüft
183Qwen3.6 Max PreviewAlibaba2026-04-200.00s
2026-09-01
Quelle geprüft
184Qwen3.6 PlusAlibaba2026-04-020.00s
2026-09-01
Quelle geprüft
185Qwen3.7 MaxAlibaba2026-05-190.00s
2026-09-01
Quelle geprüft
186Solar Open2 250BOther2026-08-120.00s
2026-09-01
Quelle geprüft
Methode

Was er abdeckt

Dieser Benchmark gehört zur Familie performance. Sein Format: Einzel-API-Request mit Streaming; Median P50 über 72 Stunden. Der Score sollte immer mit Aufgabenformat, Bewertungsmethode, Quelldatum und Benchmark-Version gelesen werden.

Score-Obergrenze

Wo er an Grenzen stößt

Noch ist keine Obergrenze erfasst. Wenn sich Scores oben bündeln, kann der Benchmark Frontier-Modelle möglicherweise nicht mehr trennen.

Tools, die ihn ausweisen

Belege

Quellen und weiterführende Lektüre

Fragen zu diesem Benchmark

Jede Antwort unten stammt aus den datierten Feldern dieser Seite. Nichts davon ist zusätzlich für Suchmaschinen geschrieben.

Was misst AA time to first token?

Median-Sekunden bis zum ersten Token am Default-API-Provider mit ~1k Input-Tokens.

Was beweist ein hoher AA time to first token-Wert nicht?

Ein starkes AA time to first token-Ergebnis sagt nichts aus über:

  • End-to-End-Aufgabenzeit für Agent-Loops — TTFT ist ein Hop, keine ganze Coding-Session.
  • Nicht-Default-Provider — AA pinnt eine Default-Route pro Modell für Vergleichbarkeit.

Wie wird AA time to first token bewertet?

Weniger Sekunden ist schneller. Aufgabenformat: Einzel-API-Request mit Streaming; Median P50 über 72 Stunden.

Ist AA time to first token gesättigt?

AA time to first token ist im Atlas derzeit als Aktiv markiert.

Können AA time to first token-Ergebnisse durch Trainingsdaten verunreinigt sein?

Das Kontaminationsrisiko für AA time to first token ist als Kontamination unbekannt eingestuft. Behandle jede Zeile auf dieser Seite als öffentliche Angabe mit Quelle und Datum, nicht als kontrolliertes Experiment.

The Pack · Redaktionsnewsletter

Neue Tools in dein Postfach. Kostenlos.

Eine kurze E-Mail, wenn ein Tool erscheint oder den Status wechselt. Kein Tracking, keine Drittanbieter-Analytics. Abmeldung mit einem Klick.