79%
SWE-bench Verified
Modelle / DeepSeek
DeepSeek V4 · Release 2026-04-24
DeepSeeks kosteneffizientes V4-Tier April 2026. 1M-Kontext, $0,14/$0,28 pro 1M Tokens (Cache Miss). SWE-bench Verified 79,0 %.
Günstigste Long-Context-Coding-Route im öffentlichen Ledger. Standard-DeepSeek-API-Wahl für Agenten.
Wo DeepSeek V4 Flash Max auf jeder öffentlichen Benchmark-Quelle mit Zeile steht. Rang zählt jedes Modell mit neuester Zeile im selben Test — kein universeller Qualitätsscore.
| Benchmark | Family | Rang | Score | Quelle | Datum |
|---|---|---|---|---|---|
| BFCL | Tool use | #13/ 20 | 77 | Berkeley Function Calling Leaderboard V4 | 2026-04-15 |
| SWE-bench Verified | Coding | #15/ 23 | 79 | SWE-bench official leaderboard | 2026-05-30 |
Die drei höchstscorierenden kartierten Modelle pro Capability-Family. Wo DeepSeek V4 Flash Max auftaucht, ist es hervorgehoben.
Benchmark-Zeilen im öffentlichen Ledger für DeepSeek V4 Flash Max in den letzten 120 Tagen. Ältere Zeilen stehen in der vollen Tabelle unten.
| Benchmark | Family | Score | Quelle | Tage her |
|---|---|---|---|---|
| SWE-bench Verified | Coding | 79% | SWE-bench official leaderboard | 54 |
| BFCL | Tool use | 76.8% | Berkeley Function Calling Leaderboard V4 | 99 |
Ein hoher Composite, der eine schwache Family versteckt, ist eine Falle. Diese Balken zeigen Families ohne öffentlichen Test — und wo das Modell führt.
Hover or tab any dot for name, score, and input price.
Jeder Katalog-Benchmark für DeepSeek V4 Flash Max. Scores verlinken zur Originalquelle; Lücken heißen: noch keine öffentliche Zeile.
2 of 32 catalog benchmarks have a sourced row for DeepSeek V4 Flash Max.
79%
SWE-bench Verified
76.8%
BFCL