Modelle / Alibaba

Qwen3.8 Max

Qwen · Release 2026-08-03

Alibabas Max-Flaggschiff August 2026. AA-Intelligence-Index v4.3 ist 40,3 im Snapshot vom 10. Sep. — nicht mit der August-v4.1-Headline 58,1 vergleichen. API-Liste $2 / $6 pro 1M Tokens in diesem Snapshot.

Aktuelles Alibaba-Cloud-Max-Modell für langen Kontext und agentische API-Arbeit. Bevorzuge belegte Ledger-Zeilen gegenüber Vendor-Eval-Tabellen; AA-Scores kommen aus dem öffentlichen Snapshot.

#15 von 184 im AA Index · aktueller Snapshot
40 AA Index · 10 Benchmark-Zeilen · 1 QuellenPosition ist benchmark-spezifisch — kein Cross-Family- oder Cross-Source-Ranking.
Composite64
Kontext1M
Input / 1M$2.0
Output / 1M$6.0
Wissensstichtagunpublished
Output-Speed39 t/s
TTFT (Default-API)1.59s
Statusflagship

Familienprofil

Bester veröffentlichter Score je abgedeckter Benchmark-Familie.

77/100 Ø
Reasoning
93
Coding
53
Agentisch
81
Multimodal
82
Langer Kontext
78

5 getestete Benchmark-Familien

Redaktionsnotiz
Erfasst aus dem Alibaba-Cloud-Launch plus AA-Snapshots. Der API-Composite vom 10. Sep. 2026 ist Intelligence Index v4.3 = 40,3; die August-Zahl 58,1 war v4.1. Redaktionelle Tiefe braucht noch einen Desk-Pass. Vendor-Zahlen zu PaperBench/OSWorld bleiben außerhalb des Ledgers.
Benchmark-Platzierungen

Wo Qwen3.8 Max auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.

BenchmarkFamilyRangScoreQuelleDatum
τ³-Bench BankingAgentic#1/ 11051Artificial Analysis2026-09-10
MMMU-ProMultimodal#6/ 882Artificial Analysis — MMMU-Pro2026-09-01
Artificial Analysis Intelligence IndexReasoning#19/ 18840Artificial Analysis2026-09-10
GPQA DiamondReasoning#20/ 19093Artificial Analysis2026-09-10
Humanity's Last ExamReasoning#21/ 18543Artificial Analysis2026-09-10
Terminal-BenchAgentic#24/ 18981Artificial Analysis2026-09-10
SciCodeCoding#28/ 9353Artificial Analysis2026-09-10
AA time to first tokenPerformance#42/ 190Artificial Analysis2026-09-10
AA-LCRLong context#57/ 18278Artificial Analysis2026-09-10
AA output speedPerformance#82/ 190Artificial Analysis2026-09-10
Family-Kontext

Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo Qwen3.8 Max auftaucht, ist es hervorgehoben.

Neueste Belege

Benchmark-Zeilen im öffentlichen Ledger für Qwen3.8 Max in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.

10 neu
Family-Abdeckung

Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.

Reasoning93
Coding53
Agentisch81
Multimodal82
Langer Kontext78
Preis vs. Performance
0255075100$0.10$0.30$1$3$10$30Input-USD / 1M Tokens · log-Skala →← Intelligenz

Hover auf einen Punkt zeigt Name, Score und Input-Preis. Per Tastatur: die zwölf besten mit Tab durchgehen oder die Rangliste unten nutzen.

AnthropicOpenAIMistralAlibabaDeepSeekGoogleMoonshotMetaxAIMiniMaxZhipuXiaomiOtherMeituanCohereNVIDIA

Volles Benchmark-Ledger

Jeder Katalog-Benchmark für Qwen3.8 Max. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.

10 Quell-Zeilen

10 von 37 Katalog-Benchmarks haben eine belegte Zeile für Qwen3.8 Max.

Reasoning

Coding

Agentic

Multimodal

Long context

Performance

Changelog
  1. AA-API-Snapshot: Intelligence Index v4.3 ist 40,3. Listenpreis unverändert $2 / $6.
  2. Qwen3.8 Max erscheint auf Artificial Analysis (damaliger Index 58,1, $2 / $6 pro 1M Tokens).
Quellen

The Pack · Redaktionsnewsletter

Neue Tools in dein Postfach. Kostenlos.

Eine kurze E-Mail, wenn ein Tool erscheint oder den Status wechselt. Kein Tracking, keine Drittanbieter-Analytics. Abmeldung mit einem Klick.