VerdictPal · Redaktions-Desk · 2026VerdictPal
Vergleich · Zwei Modelle, direkt

Wähle zwei Modelle. Sieh den Unterschied.

Composite-Scores, Benchmark-Ränge, Fähigkeitsraster und Preis pro Million Tokens. Alles aus denselben Daten wie der Modell-Atlas.

Kimi K3 vs Kimi K2.5

Kimi K33Stats gewonnen
Gleichstand0Stats
Kimi K2.54Stats gewonnen
Spec-Showdown

Kapazität, Preis, Aktualität.

Kimi K3vsKimi K2.5

Kimi K3 dominiert beim Composite-Score (65 vs 53) — breitere Benchmark-Abdeckung und stärkere Performance pro Family. Kimi K3 hat den höheren Vals/AA-Intelligence-Score (75 vs 35). Kimi K2.5 ist deutlich günstiger bei $0.60/1M Input vs $3.0/1M Input. Kimi K3s 1M Kontextfenster übertrifft Kimi K2.5s 262K deutlich — relevant für lange Dokumente oder Codebasen.

  1. Composite-Score
    Kimi K365Gewinner in dieser ZeileKimi K2.553
  2. Intelligence (Vals/AA)
    Kimi K375Gewinner in dieser ZeileKimi K2.535
  3. Kontextfenster
    Kimi K31MGewinner in dieser ZeileKimi K2.5262K
  4. Max. Output
    Kimi K3Kimi K2.566KGewinner in dieser Zeile
  5. Input-Preis / 1M (niedriger gewinnt)
    Kimi K3$3.0Kimi K2.5$0.60Gewinner in dieser Zeile
  6. Output-Geschwindigkeit (AA Default-API)
    Kimi K338 t/sKimi K2.550 t/sGewinner in dieser Zeile
  7. Zeit bis zum ersten Token (AA Default-API)
    Kimi K36.19sKimi K2.51.02sGewinner in dieser Zeile
Composite-Score
65Gewinner in dieser Zeile
vs
53
Intelligence (Vals/AA)
75Gewinner in dieser Zeile
vs
35
Kontextfenster
1MGewinner in dieser Zeile
vs
262K
Max. Output
vs
66KGewinner in dieser Zeile
Input-Preis / 1M (niedriger gewinnt)
$3.0
vs
$0.60Gewinner in dieser Zeile
Output-Geschwindigkeit (AA Default-API)
38 t/s
vs
50 t/sGewinner in dieser Zeile
Zeit bis zum ersten Token (AA Default-API)
6.19s
vs
1.02sGewinner in dieser Zeile
Fähigkeitsraster

Was jedes Modell kann.

Modalitäten

Kimi K3Kimi K2.5
Text
Bild
Audio
Video
Code
Tool-Nutzung
Reasoning

Zugang

Kimi K3Kimi K2.5
API
Consumer-App
Open Weights
Managed Cloud
On-Device
Family-Radar

Top-Score pro Benchmark-Family.

Reasoning
94Gewinner in dieser Zeile
vs
88
Coding
59Gewinner in dieser Zeile
vs
49
Agentisch
85Gewinner in dieser Zeile
vs
46
Langer Kontext
75Gewinner in dieser Zeile
vs
65
Benchmark-Ränge

Jeder gemeinsame Benchmark, nebeneinander.

Reasoning

Artificial Analysis Intelligence Index#3/67 · #44/67
57.1%Gewinner in dieser Zeile
vs
35.4%
GPQA Diamond#4/69 · #32/69
93.5%Gewinner in dieser Zeile
vs
87.9%
Humanity's Last Exam#7/65 · #37/65
44.3%Gewinner in dieser Zeile
vs
29.4%

Coding

SciCode#3/65 · #31/65
58.7%Gewinner in dieser Zeile
vs
49%

Agentisch

Terminal-Bench#3/69 · #48/69
85.02%Gewinner in dieser Zeile
vs
45.69%
τ³-Bench Banking#20/64 · #48/64
33.4%Gewinner in dieser Zeile
vs
14.23%

Langer Kontext

AA-LCR#2/64 · #39/64
74.67%Gewinner in dieser Zeile
vs
65.33%

Performance

AA output speed#57/69 · #55/69
38 t/s
vs
50 t/sGewinner in dieser Zeile
AA time to first token#24/69 · #43/69
6.19s
vs
1.02sGewinner in dieser Zeile
Dossier-Fakten

Daten, Quellen, Kleingedrucktes.

Kimi K3Kimi K2.5
AnbieterMoonshotMoonshot
FamilyKimi K3Kimi
Veröffentlichung2026-07-162026-01-27
Wissensstichtagunpublished2025-10-01
Kontextfenster1M262K
Max. Output66K
Input-Preis /1M$3.0$0.60
Output-Preis /1M$15$3.0
Statussolidsolid
Composite-Score6553
Intelligence-Score7535
Intel-Quellevalsaa
Benchmark-Zeilen1013
Quellenanzahl24
Aktualitätfreshfresh
Preis geprüft2026-07-192026-06-09
Ökosystem

Welche Tools jedes Modell einwickeln.

Kimi K3

In keinem Tool gelistet.

Kimi K2.5

In keinem Tool gelistet.

Urteil

Welches Modell du wirklich wählen solltest.

Kimi K3 dominiert beim Composite-Score (65 vs 53) — breitere Benchmark-Abdeckung und stärkere Performance pro Family. Kimi K3 hat den höheren Vals/AA-Intelligence-Score (75 vs 35). Kimi K2.5 ist deutlich günstiger bei $0.60/1M Input vs $3.0/1M Input. Kimi K3s 1M Kontextfenster übertrifft Kimi K2.5s 262K deutlich — relevant für lange Dokumente oder Codebasen.