VerdictPal · Redaktions-Desk · 2026VerdictPal
Vergleich · Zwei Modelle, direkt

Wähle zwei Modelle. Sieh den Unterschied.

Composite-Scores, Benchmark-Ränge, Fähigkeitsraster und Preis pro Million Tokens. Alles aus denselben Daten wie der Modell-Atlas.

Kimi K2.5 vs MiniMax M3

Kimi K2.51Stats gewonnen
Gleichstand1Stats
MiniMax M35Stats gewonnen
Spec-Showdown

Kapazität, Preis, Aktualität.

Kimi K2.5vsMiniMax M3

MiniMax M3 hat einen knappen Composite-Vorsprung (62 vs 53), aber die Lücke ist klein genug, dass andere Faktoren zählen. MiniMax M3 hat den höheren Vals/AA-Intelligence-Score (44 vs 35). MiniMax M3s 1M Kontextfenster übertrifft Kimi K2.5s 262K deutlich — relevant für lange Dokumente oder Codebasen.

  1. Composite-Score
    Kimi K2.553MiniMax M362Gewinner in dieser Zeile
  2. Intelligence (Vals/AA)
    Kimi K2.535MiniMax M344Gewinner in dieser Zeile
  3. Kontextfenster
    Kimi K2.5262KMiniMax M31MGewinner in dieser Zeile
  4. Max. Output
    Kimi K2.566KMiniMax M366K
  5. Input-Preis / 1M (niedriger gewinnt)
    Kimi K2.5$0.60MiniMax M3$0.40Gewinner in dieser Zeile
  6. Output-Geschwindigkeit (AA Default-API)
    Kimi K2.550 t/sMiniMax M397 t/sGewinner in dieser Zeile
  7. Zeit bis zum ersten Token (AA Default-API)
    Kimi K2.51.02sGewinner in dieser ZeileMiniMax M31.26s
Composite-Score
53
vs
62Gewinner in dieser Zeile
Intelligence (Vals/AA)
35
vs
44Gewinner in dieser Zeile
Kontextfenster
262K
vs
1MGewinner in dieser Zeile
Max. Output
66K
vs
66K
Input-Preis / 1M (niedriger gewinnt)
$0.60
vs
$0.40Gewinner in dieser Zeile
Output-Geschwindigkeit (AA Default-API)
50 t/s
vs
97 t/sGewinner in dieser Zeile
Zeit bis zum ersten Token (AA Default-API)
1.02sGewinner in dieser Zeile
vs
1.26s
Fähigkeitsraster

Was jedes Modell kann.

Modalitäten

Kimi K2.5MiniMax M3
Text
Bild
Audio
Video
Code
Tool-Nutzung
Reasoning

Zugang

Kimi K2.5MiniMax M3
API
Consumer-App
Open Weights
Managed Cloud
On-Device
Family-Radar

Top-Score pro Benchmark-Family.

Wissen
86Gewinner in dieser Zeile
vs
85
Reasoning
88
vs
93Gewinner in dieser Zeile
Coding
49
vs
78Gewinner in dieser Zeile
Agentisch
46
vs
66Gewinner in dieser Zeile
Langer Kontext
65
vs
74Gewinner in dieser Zeile
Benchmark-Ränge

Jeder gemeinsame Benchmark, nebeneinander.

Wissen

MMLU#18/22 · #22/22
86.4%Gewinner in dieser Zeile
vs
84.8%

Reasoning

Artificial Analysis Intelligence Index#44/67 · #21/67
35.4%
vs
44.4%Gewinner in dieser Zeile
GPQA Diamond#32/69 · #7/69
87.9%
vs
92.9%Gewinner in dieser Zeile
Humanity's Last Exam#37/65 · #23/65
29.4%
vs
37.1%Gewinner in dieser Zeile
IFBench#35/57 · #1/57
70.2%
vs
82.86%Gewinner in dieser Zeile
LiveBench#16/21 · #18/21
61.2%Gewinner in dieser Zeile
vs
59.6%

Coding

SciCode#31/65 · #43/65
49%Gewinner in dieser Zeile
vs
45.4%

Agentisch

Terminal-Bench#48/69 · #28/69
45.69%
vs
66%Gewinner in dieser Zeile
τ³-Bench Banking#48/64 · #51/64
14.23%Gewinner in dieser Zeile
vs
12.99%

Langer Kontext

AA-LCR#39/64 · #7/64
65.33%
vs
74%Gewinner in dieser Zeile
LongBench v2#15/19 · #18/19
48.2%Gewinner in dieser Zeile
vs
45.6%

Performance

AA output speed#55/69 · #26/69
50 t/s
vs
97 t/sGewinner in dieser Zeile
AA time to first token#43/69 · #38/69
1.02sGewinner in dieser Zeile
vs
1.26s
Dossier-Fakten

Daten, Quellen, Kleingedrucktes.

Kimi K2.5MiniMax M3
AnbieterMoonshotMiniMax
FamilyKimiMiniMax
Veröffentlichung2026-01-272026-05-31
Wissensstichtag2025-10-012026-03-01
Kontextfenster262K1M
Max. Output66K66K
Input-Preis /1M$0.60$0.40
Output-Preis /1M$3.0$2.0
Statussolidsolid
Composite-Score5362
Intelligence-Score3544
Intel-Quelleaaaa
Benchmark-Zeilen1317
Quellenanzahl48
Aktualitätfreshfresh
Preis geprüft2026-06-092026-06-01
Ökosystem

Welche Tools jedes Modell einwickeln.

Kimi K2.5

In keinem Tool gelistet.

MiniMax M3

In keinem Tool gelistet.

Urteil

Welches Modell du wirklich wählen solltest.

MiniMax M3 hat einen knappen Composite-Vorsprung (62 vs 53), aber die Lücke ist klein genug, dass andere Faktoren zählen. MiniMax M3 hat den höheren Vals/AA-Intelligence-Score (44 vs 35). MiniMax M3s 1M Kontextfenster übertrifft Kimi K2.5s 262K deutlich — relevant für lange Dokumente oder Codebasen.