Benchmarks / Performance

AA output speed

Output tokens per second

Medianer Output-Tokens pro Sekunde nach dem ersten Chunk, gemessen am Default-API-Provider jedes Modells mit ~1k Input-Tokens (AA-Medium-Workload).

Was dieser Benchmark nicht misst
  • IDE- oder Chat-App-Latenz — nur First-Party-API-Routen, die AA als Default-Provider trackt.
  • Qualität oder Reasoning-Tiefe — nur Speed. Ein schnelles Modell kann schwere Aufgaben trotzdem verfehlen.
Analyse

Warum dieser Benchmark nützlich ist

Wenn es um Streaming-Geschwindigkeit nach dem ersten Chunk geht — IDE-Gefühl, Chat-Responsivität, Batch-Durchsatz — nicht um Antwortqualität.

Umfang

Abdeckung

Aufgabenfamilie
Performance
Format
Streaming-Generierung nach erstem Token; Median der letzten 72 Stunden im AA-Harness.
Bewertung
Mehr Tokens/s ist schneller. AA nutzt OpenAI tiktoken o200k_base für Token-Zählung.
Verantwortliche Stelle
Artificial Analysis
Lesehilfe

So liest du die Scores

Höhere mediane Tokens/s sind schneller. AA pinnt den Default-API-Provider und eine ~1k-Token-Medium-Workload; IDE oder andere Provider können abweichen.

Blinde Flecken

Was er nicht abdeckt

  • IDE- oder Chat-App-Latenz — nur First-Party-API-Routen, die AA als Default-Provider trackt.
  • Qualität oder Reasoning-Tiefe — nur Speed. Ein schnelles Modell kann schwere Aufgaben trotzdem verfehlen.
Scores

Evidenz-Ledger

190 Zeilen
190190 Zeilen
365 t/sbester Score
190quellgeprüft
1Quellen
2026-09-10bis 2026-09-05
190

api · api

Verteilung

Wo die Zeilen liegen

0255075100

Auf die Skala dieses Benchmarks normalisiert (0–100). Die Tabelle zeigt die Rohwerte.

Zeitverlauf

Neueste Belege

  1. Gemini 3.5 Flash-Lite365 t/s ·
  2. Ling 3.0 Flash345 t/s ·
  3. Gemini 3.7 Flash343 t/s ·
  4. Gemini 3.8 Flash343 t/s ·
  5. Nemotron 3.5 Lightning293 t/s ·

Scores nutzen die eigene Einheit und Skala dieses Benchmarks, keinen universellen Qualitätswert.

#ModellVeröffentlichungScoreHerkunftBeleglage
1Gemini 3.5 Flash-LiteGoogle2026-07-21365 t/s
2026-09-10
Quelle geprüft
2Ling 3.0 FlashOther2026-08-04345 t/s
2026-09-10
Quelle geprüft
3Gemini 3.7 FlashGoogle2026-08-13343 t/s
2026-09-10
Quelle geprüft
4Gemini 3.8 FlashGoogle2026-09-02343 t/s
2026-09-10
Quelle geprüft
5Nemotron 3.5 LightningNVIDIA2026-08-11293 t/s
2026-09-10
Quelle geprüft
6Muse Spark 1.2Meta2026-08-05278 t/s
2026-09-10
Quelle geprüft
7Gemini 3.5 Flash (minimal)Google2026-05-19248 t/s
2026-09-10
Quelle geprüft
8Gemini 3.5 Flash (medium)Google2026-05-19240 t/s
2026-09-10
Quelle geprüft
9Granite 4.2 3BOther2026-08-25219 t/s
2026-09-10
Quelle geprüft
10Agnes 2.5 Pro AlphaOther2026-07-24196 t/s
2026-09-10
Quelle geprüft
11Muse Spark 1.3Meta2026-09-02190 t/s
2026-09-05
Quelle geprüft
12Gemini 3.6 Flash (high)Google2026-07-21185 t/s
2026-09-10
Quelle geprüft
13Ling 3.0 TinyOther2026-08-06175 t/s
2026-09-10
Quelle geprüft
14Nemotron 3 Ultra 550B A55B (Reasoning)NVIDIA2026-06-04164 t/s
2026-09-10
Quelle geprüft
15Mistral Medium 3.5Mistral2026-04-29158 t/s
2026-09-10
Quelle geprüft
16OpenAI o3OpenAI2025-04-16151 t/s
2026-09-10
Quelle geprüft
17GPT-5.5 Instant (June 2026)OpenAI2026-06-25145 t/s
2026-09-10
Quelle geprüft
18GPT-5.3 Codex (xhigh)OpenAI2026-02-05143 t/s
2026-09-10
Quelle geprüft
19Grok 4.3 (medium)xAI2026-04-30137 t/s
2026-09-10
Quelle geprüft
20Gemma 4 12B (Non-reasoning)Google2026-06-10137 t/s
2026-09-10
Quelle geprüft
21Qwen3.6 35B A3B (Reasoning)Alibaba2026-04-16136 t/s
2026-09-10
Quelle geprüft
22Qwen3.5 122B A10B (Reasoning)Alibaba2026-02-24134 t/s
2026-09-10
Quelle geprüft
23Qwen3.6 35B A3B (Non-reasoning)Alibaba2026-04-16134 t/s
2026-09-10
Quelle geprüft
24Gemma 4 12B (Reasoning)Google2026-06-07132 t/s
2026-09-10
Quelle geprüft
25Gemini 3.1 Pro PreviewGoogle2026-02-19128 t/s
2026-09-10
Quelle geprüft
26Granite 4.2 8BOther2026-08-25127 t/s
2026-09-10
Quelle geprüft
27Ring-2.6-1TOther2026-05-08126 t/s
2026-09-10
Quelle geprüft
28GPT-5.6 TerraOpenAI2026-07-09124 t/s
2026-09-10
Quelle geprüft
29GPT-5.6 LunaOpenAI2026-07-09123 t/s
2026-09-10
Quelle geprüft
30Inkling SmallOther2026-07-30123 t/s
2026-09-10
Quelle geprüft
31Grok 4.3 (Non-reasoning)xAI2026-04-30122 t/s
2026-09-10
Quelle geprüft
32GLM-5.2 (Non-reasoning)Zhipu2026-06-16119 t/s
2026-09-10
Quelle geprüft
33DeepSeek V4 Flash Vision (Reasoning, Max Effort)DeepSeek2026-08-21118 t/s
2026-09-10
Quelle geprüft
34DeepSeek V4 Flash 0731 (Reasoning, Max Effort)DeepSeek2026-07-31118 t/s
2026-09-10
Quelle geprüft
35Nex-N2-ProOther2026-06-02116 t/s
2026-09-10
Quelle geprüft
36Grok 4.3 (low)xAI2026-04-30112 t/s
2026-09-10
Quelle geprüft
37Muse GlimmerMeta2026-08-10106 t/s
2026-09-10
Quelle geprüft
38MiniMax M3MiniMax2026-05-31103 t/s
2026-09-10
Quelle geprüft
39Llama 4 MaverickMeta2026-04-0595 t/s
2026-09-10
Quelle geprüft
40Hy3Other2026-07-0693 t/s
2026-09-10
Quelle geprüft
41Step 3.7 FlashStepFun2026-06-0186 t/s
2026-09-10
Quelle geprüft
42Qwen3.5 397B A17B (Non-reasoning)Alibaba2026-02-1686 t/s
2026-09-10
Quelle geprüft
43Claude Sonnet 5Anthropic2026-06-3084 t/s
2026-09-10
Quelle geprüft
44Qwen3.5 397B A17B (Reasoning)Alibaba2026-02-1684 t/s
2026-09-10
Quelle geprüft
45Llama 4 ScoutMeta2026-04-0578 t/s
2026-09-10
Quelle geprüft
46Granite 4.2 30BOther2026-08-2577 t/s
2026-09-10
Quelle geprüft
47Mistral Large 3Mistral2025-12-0276 t/s
2026-09-10
Quelle geprüft
48Qwen3.8-Flash-NextAlibaba2026-08-2676 t/s
2026-09-10
Quelle geprüft
49Inkling (xhigh)Other2026-07-1573 t/s
2026-09-10
Quelle geprüft
50GPT-5.6 SolOpenAI2026-07-0973 t/s
2026-09-10
Quelle geprüft
51North Mini CodeCohere2026-06-0971 t/s
2026-09-10
Quelle geprüft
52Claude Fable 5.1Anthropic2026-09-0170 t/s
2026-09-10
Quelle geprüft
53Solar Pro 4Other2026-08-0670 t/s
2026-09-10
Quelle geprüft
54Claude Fable 5Anthropic2026-06-0968 t/s
2026-09-10
Quelle geprüft
55GLM-5.2Zhipu2026-06-1368 t/s
2026-09-10
Quelle geprüft
56DeepSeek V4 Pro (Reasoning, High Effort)DeepSeek2026-04-2467 t/s
2026-09-10
Quelle geprüft
57GLM-5.3Zhipu2026-08-1466 t/s
2026-09-10
Quelle geprüft
58MiMo-V2.5Xiaomi2026-04-2266 t/s
2026-09-10
Quelle geprüft
59Kimi K2.7 CodeMoonshot2026-06-1265 t/s
2026-09-10
Quelle geprüft
60Command ACohere2026-03-1565 t/s
2026-09-10
Quelle geprüft
61GPT-6 AstraOpenAI2026-09-0364 t/s
2026-09-05
Quelle geprüft
62DeepSeek V4 Pro 0813 (Reasoning, Max Effort)DeepSeek2026-08-1364 t/s
2026-09-10
Quelle geprüft
63DeepSeek V4 Pro (Non-reasoning)DeepSeek2026-04-2463 t/s
2026-09-10
Quelle geprüft
64Grok 4.6xAI2026-08-1263 t/s
2026-09-10
Quelle geprüft
65Qwen3.6 27B (Non-reasoning)Alibaba2026-04-2259 t/s
2026-09-10
Quelle geprüft
66Qwen3.6 27B (Reasoning)Alibaba2026-04-2258 t/s
2026-09-10
Quelle geprüft
67GLM-5.3-FlashZhipu2026-08-2658 t/s
2026-09-10
Quelle geprüft
68Qwen 3.7 PlusAlibaba2026-06-0256 t/s
2026-09-10
Quelle geprüft
69Claude Opus 5 (Adaptive Reasoning, Max Effort)Anthropic2026-07-2455 t/s
2026-09-10
Quelle geprüft
70Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)Anthropic2026-07-2454 t/s
2026-09-10
Quelle geprüft
71Claude Opus 5 (Adaptive Reasoning, High Effort)Anthropic2026-07-2453 t/s
2026-09-10
Quelle geprüft
72Claude Sonnet 4.6 (Non-reasoning, Low Effort)Anthropic2026-02-1753 t/s
2026-09-10
Quelle geprüft
73Grok 4.5xAI2026-07-0853 t/s
2026-09-10
Quelle geprüft
74Claude Opus 5 (Adaptive Reasoning, Medium Effort)Anthropic2026-07-2452 t/s
2026-09-10
Quelle geprüft
75Claude Opus 5 (Adaptive Reasoning, Low Effort)Anthropic2026-07-2452 t/s
2026-09-10
Quelle geprüft
76LongCat-2.0Meituan2026-06-2949 t/s
2026-09-10
Quelle geprüft
77Qwen3.8 27BAlibaba2026-08-1447 t/s
2026-09-10
Quelle geprüft
78Kimi K3 (low)Moonshot2026-07-1642 t/s
2026-09-10
Quelle geprüft
79MiMo-V2.5-ProXiaomi2026-04-2242 t/s
2026-09-10
Quelle geprüft
80Kimi K3Moonshot2026-07-1641 t/s
2026-09-10
Quelle geprüft
81Qwen3.8 2.4T A95BAlibaba2026-08-1240 t/s
2026-09-10
Quelle geprüft
82Qwen3.8 MaxAlibaba2026-08-0339 t/s
2026-09-10
Quelle geprüft
83MiMo-V2.5-Pro (Non-reasoning)Xiaomi2026-04-2238 t/s
2026-09-10
Quelle geprüft
84Gemma 4 31B ITGoogle2026-03-0135 t/s
2026-09-10
Quelle geprüft
85A.X-K2Other2026-08-120 t/s
2026-09-10
Quelle geprüft
86Agnes 2.5 Pro BetaOther2026-08-260 t/s
2026-09-10
Quelle geprüft
87Apodex 1.1Other2026-08-300 t/s
2026-09-10
Quelle geprüft
88Claude 3 OpusAnthropic2024-03-040 t/s
2026-09-10
Quelle geprüft
89Claude 4 Opus (Reasoning)Anthropic2025-05-220 t/s
2026-09-10
Quelle geprüft
90Claude 4.1 Opus (Reasoning)Anthropic2025-08-050 t/s
2026-09-10
Quelle geprüft
91Claude 4.5 Sonnet (Reasoning)Anthropic2025-09-290 t/s
2026-09-10
Quelle geprüft
92Claude Opus 4.5Anthropic2025-11-240 t/s
2026-09-10
Quelle geprüft
93Claude Opus 4.5 (Reasoning)Anthropic2025-11-240 t/s
2026-09-10
Quelle geprüft
94Claude Opus 4.6Anthropic2026-02-050 t/s
2026-09-10
Quelle geprüft
95Claude Opus 4.6 (Adaptive Reasoning, Max Effort)Anthropic2026-02-050 t/s
2026-09-10
Quelle geprüft
96Claude Opus 4.7Anthropic2026-04-160 t/s
2026-09-10
Quelle geprüft
97Claude Opus 4.7 (Non-reasoning, High Effort)Anthropic2026-04-160 t/s
2026-09-10
Quelle geprüft
98Claude Opus 4.8Anthropic2026-05-280 t/s
2026-09-10
Quelle geprüft
99Claude Sonnet 4.6Anthropic2026-02-170 t/s
2026-09-10
Quelle geprüft
100Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)Anthropic2026-02-170 t/s
2026-09-10
Quelle geprüft
101DeepSeek Coder V2DeepSeek2024-05-150 t/s
2026-09-10
Quelle geprüft
102DeepSeek R1DeepSeek2025-01-200 t/s
2026-09-10
Quelle geprüft
103DeepSeek V3.2 (Reasoning)DeepSeek2025-12-010 t/s
2026-09-10
Quelle geprüft
104DeepSeek V4 Flash (Non-reasoning)DeepSeek2026-04-240 t/s
2026-09-10
Quelle geprüft
105DeepSeek V4 Flash (Reasoning, High Effort)DeepSeek2026-04-240 t/s
2026-09-10
Quelle geprüft
106DiffusionGemma 26B A4BGoogle2026-06-100 t/s
2026-09-10
Quelle geprüft
107EXAONE 4.5 33BOther2026-04-090 t/s
2026-09-10
Quelle geprüft
108G9v3-39A5BOther2026-08-030 t/s
2026-09-10
Quelle geprüft
109G9v3-3BOther2026-07-230 t/s
2026-09-10
Quelle geprüft
110Gemini 1.0 UltraGoogle2024-02-080 t/s
2026-09-10
Quelle geprüft
111Gemini 3 Flash PreviewGoogle2025-12-170 t/s
2026-09-10
Quelle geprüft
112Gemini 3 Flash Preview (Reasoning)Google2025-12-170 t/s
2026-09-10
Quelle geprüft
113Gemini 3 ProGoogle2025-11-180 t/s
2026-09-10
Quelle geprüft
114Gemini 3 Pro Preview (low)Google2025-11-180 t/s
2026-09-10
Quelle geprüft
115Gemini 3.1 Flash LiteGoogle2026-05-070 t/s
2026-09-10
Quelle geprüft
116Gemini 3.5 FlashGoogle2026-05-190 t/s
2026-09-10
Quelle geprüft
117GLM 5V Turbo (Reasoning)Zhipu2026-04-010 t/s
2026-09-10
Quelle geprüft
118GLM-4.7 (Reasoning)Zhipu2025-12-220 t/s
2026-09-10
Quelle geprüft
119GLM-5 (Non-reasoning)Zhipu2026-02-110 t/s
2026-09-10
Quelle geprüft
120GLM-5 (Reasoning)Zhipu2026-02-110 t/s
2026-09-10
Quelle geprüft
121GLM-5-TurboZhipu2026-03-150 t/s
2026-09-10
Quelle geprüft
122GLM-5.1Zhipu2026-04-070 t/s
2026-09-10
Quelle geprüft
123GPT 5.4OpenAI2026-03-050 t/s
2026-09-10
Quelle geprüft
124GPT 5.5OpenAI2026-04-230 t/s
2026-09-10
Quelle geprüft
125GPT-5 (high)OpenAI2025-08-070 t/s
2026-09-10
Quelle geprüft
126GPT-5 (low)OpenAI2025-08-070 t/s
2026-09-10
Quelle geprüft
127GPT-5 (medium)OpenAI2025-08-070 t/s
2026-09-10
Quelle geprüft
128GPT-5 Codex (high)OpenAI2025-09-230 t/s
2026-09-10
Quelle geprüft
129GPT-5.1OpenAI2025-11-130 t/s
2026-09-10
Quelle geprüft
130GPT-5.1 Codex (high)OpenAI2025-11-130 t/s
2026-09-10
Quelle geprüft
131GPT-5.2OpenAI2025-12-110 t/s
2026-09-10
Quelle geprüft
132GPT-5.2 (medium)OpenAI2025-12-110 t/s
2026-09-10
Quelle geprüft
133GPT-5.2 Codex (xhigh)OpenAI2025-12-110 t/s
2026-09-10
Quelle geprüft
134GPT-5.4 (low)OpenAI2026-03-050 t/s
2026-09-10
Quelle geprüft
135GPT-5.4 MiniOpenAI2026-03-170 t/s
2026-09-10
Quelle geprüft
136GPT-5.4 NanoOpenAI2026-03-170 t/s
2026-09-10
Quelle geprüft
137GPT-5.4 ProOpenAI2026-03-050 t/s
2026-09-10
Quelle geprüft
138GPT-5.5 (high)OpenAI2026-04-230 t/s
2026-09-10
Quelle geprüft
139GPT-5.5 (low)OpenAI2026-04-230 t/s
2026-09-10
Quelle geprüft
140GPT-5.5 (medium)OpenAI2026-04-230 t/s
2026-09-10
Quelle geprüft
141GPT-5.5 (Non-reasoning)OpenAI2026-04-230 t/s
2026-09-10
Quelle geprüft
142GPT-5.5 Instant (May 2026)OpenAI2026-05-050 t/s
2026-09-10
Quelle geprüft
143GPT-5.5 ProOpenAI2026-04-230 t/s
2026-09-10
Quelle geprüft
144Granite 4.1 30BOther2026-04-290 t/s
2026-09-10
Quelle geprüft
145Grok 4xAI2025-07-100 t/s
2026-09-10
Quelle geprüft
146Grok 4.20 0309 (Reasoning)xAI2026-03-100 t/s
2026-09-10
Quelle geprüft
147Grok 4.20 0309 v2 (Non-reasoning)xAI2026-04-070 t/s
2026-09-10
Quelle geprüft
148Grok 4.20 ReasoningxAI2026-03-050 t/s
2026-09-10
Quelle geprüft
149Grok 4.3xAI2026-04-300 t/s
2026-09-10
Quelle geprüft
150Grok Build 0.1 0616xAI2026-06-160 t/s
2026-09-10
Quelle geprüft
151Hy3-preview (Non-reasoning)Other2026-04-230 t/s
2026-09-10
Quelle geprüft
152Hy3-preview (Reasoning)Other2026-04-230 t/s
2026-09-10
Quelle geprüft
153JT-35B-FlashOther2026-05-140 t/s
2026-09-10
Quelle geprüft
154JT-4.1 Flash 236B A21BOther2026-07-090 t/s
2026-09-10
Quelle geprüft
155JT-MINIOther2026-04-150 t/s
2026-09-10
Quelle geprüft
156K-EXAONE 2.0 0803Other2026-08-120 t/s
2026-09-10
Quelle geprüft
157K2 Horizon 375B A23BOther2026-09-030 t/s
2026-09-10
Quelle geprüft
158KAT Coder Pro V2Other2026-03-270 t/s
2026-09-10
Quelle geprüft
159Kimi K2 ThinkingMoonshot2025-11-060 t/s
2026-09-10
Quelle geprüft
160Kimi K2.5Moonshot2026-01-270 t/s
2026-09-10
Quelle geprüft
161Kimi K2.6Moonshot2026-04-200 t/s
2026-09-10
Quelle geprüft
162Kimi K2.6 (Non-reasoning)Other2026-04-200 t/s
2026-09-10
Quelle geprüft
163LFM2.5-8B-A1BLiquid2026-06-080 t/s
2026-09-10
Quelle geprüft
164Ling 2.6 FlashOther2026-04-210 t/s
2026-09-10
Quelle geprüft
165Ling-2.6-1TOther2026-04-230 t/s
2026-09-10
Quelle geprüft
166MiMo-V2-Flash (Feb 2026)Xiaomi2025-12-160 t/s
2026-09-10
Quelle geprüft
167MiMo-V2-Flash (Reasoning)Xiaomi2025-12-160 t/s
2026-09-10
Quelle geprüft
168MiMo-V2-OmniXiaomi2026-03-190 t/s
2026-09-10
Quelle geprüft
169MiMo-V2-Omni-0327Xiaomi2026-03-270 t/s
2026-09-10
Quelle geprüft
170MiMo-V2-ProXiaomi2026-03-180 t/s
2026-09-10
Quelle geprüft
171MiniCPM-V 4.6 1.3BOpenBMB2026-05-110 t/s
2026-09-10
Quelle geprüft
172MiniCPM5-1B (Non-reasoning)OpenBMB2026-05-250 t/s
2026-09-10
Quelle geprüft
173MiniCPM5-1B (Reasoning)OpenBMB2026-06-040 t/s
2026-09-10
Quelle geprüft
174MiniCPM5-2BOpenBMB2026-09-070 t/s
2026-09-10
Quelle geprüft
175MiniMax M2.5MiniMax2026-04-010 t/s
2026-09-10
Quelle geprüft
176MiniMax M2.7MiniMax2026-04-150 t/s
2026-09-10
Quelle geprüft
177MiniMax-M2.1MiniMax2025-12-230 t/s
2026-09-10
Quelle geprüft
178Motif 3Other2026-08-120 t/s
2026-09-10
Quelle geprüft
179Motif 3 (Beta)Other2026-07-210 t/s
2026-09-10
Quelle geprüft
180Muse SparkOther2026-01-010 t/s
2026-09-10
Quelle geprüft
181Muse Spark 1.1Meta2026-07-090 t/s
2026-09-10
Quelle geprüft
182Nemotron 3 Nano Omni 30B A3B ReasoningNVIDIA2026-04-290 t/s
2026-09-10
Quelle geprüft
183o3-proOpenAI2025-06-100 t/s
2026-09-10
Quelle geprüft
184OpenAI o1OpenAI2024-09-120 t/s
2026-09-10
Quelle geprüft
185Qwen3 Max ThinkingAlibaba2026-01-260 t/s
2026-09-10
Quelle geprüft
186Qwen3.5 27B (Reasoning)Alibaba2026-02-240 t/s
2026-09-10
Quelle geprüft
187Qwen3.6 Max PreviewAlibaba2026-04-200 t/s
2026-09-10
Quelle geprüft
188Qwen3.6 PlusAlibaba2026-04-020 t/s
2026-09-10
Quelle geprüft
189Qwen3.7 MaxAlibaba2026-05-190 t/s
2026-09-10
Quelle geprüft
190Solar Open2 250BOther2026-08-120 t/s
2026-09-10
Quelle geprüft
Methode

Was er abdeckt

Dieser Benchmark gehört zur Familie performance. Sein Format: Streaming-Generierung nach erstem Token; Median der letzten 72 Stunden im AA-Harness. Der Score sollte immer mit Aufgabenformat, Bewertungsmethode, Quelldatum und Benchmark-Version gelesen werden.

Score-Obergrenze

Wo er an Grenzen stößt

Noch ist keine Obergrenze erfasst. Wenn sich Scores oben bündeln, kann der Benchmark Frontier-Modelle möglicherweise nicht mehr trennen.

Tools, die ihn ausweisen

Belege

Quellen und weiterführende Lektüre

Fragen zu diesem Benchmark

Jede Antwort unten stammt aus den datierten Feldern dieser Seite. Nichts davon ist zusätzlich für Suchmaschinen geschrieben.

Was misst AA output speed?

Medianer Output-Tokens pro Sekunde nach dem ersten Chunk, gemessen am Default-API-Provider jedes Modells mit ~1k Input-Tokens (AA-Medium-Workload).

Was beweist ein hoher AA output speed-Wert nicht?

Ein starkes AA output speed-Ergebnis sagt nichts aus über:

  • IDE- oder Chat-App-Latenz — nur First-Party-API-Routen, die AA als Default-Provider trackt.
  • Qualität oder Reasoning-Tiefe — nur Speed. Ein schnelles Modell kann schwere Aufgaben trotzdem verfehlen.

Wie wird AA output speed bewertet?

Mehr Tokens/s ist schneller. AA nutzt OpenAI tiktoken o200k_base für Token-Zählung. Aufgabenformat: Streaming-Generierung nach erstem Token; Median der letzten 72 Stunden im AA-Harness.

Ist AA output speed gesättigt?

AA output speed ist im Atlas derzeit als Aktiv markiert.

Können AA output speed-Ergebnisse durch Trainingsdaten verunreinigt sein?

Das Kontaminationsrisiko für AA output speed ist als Kontamination unbekannt eingestuft. Behandle jede Zeile auf dieser Seite als öffentliche Angabe mit Quelle und Datum, nicht als kontrolliertes Experiment.

The Pack · Redaktionsnewsletter

Neue Tools in dein Postfach. Kostenlos.

Eine kurze E-Mail, wenn ein Tool erscheint oder den Status wechselt. Kein Tracking, keine Drittanbieter-Analytics. Abmeldung mit einem Klick.