DeepSeek-V4-Pro ist das Flaggschiff der V4-Generation: ein 1,6-Billionen-Parameter-MoE mit nur 49 Milliarden aktiven Parametern pro Token und einem Standard-Kontextfenster von einer Million Token. Neue Attention-Mechanismen mit Token-Kompression (Compressed Sparse Attention und Heavily Compressed Attention, kombiniert mit DeepSeek Sparse Attention) machen diesen riesigen Kontext praktikabel. In Benchmarks bewegt sich V4-Pro auf dem Niveau führender proprietärer Modelle – bei offener MIT-Lizenz.
DeepSeek-V4-Pro (Preview)
DeepSeek AI
April 2026
MIT (Open Source)
MoE-Flaggschiff, Dual-Modus (Think/Non-Think)
1,6 Bio. total (49 Mrd. aktiv pro Token)
Compressed Sparse Attention + Heavily Compressed Attention + DSA, text-only
1.000.000 Token
Offizielle Angaben aus der DeepSeek-V4-Pro Model-Card (Auswahl):
| Benchmark | DeepSeek-V4-Pro | Kategorie |
|---|---|---|
| SWE-bench Verified | 80,6 % | Coding |
| GPQA-Diamond | 90,1 | Wissen/Reasoning |
| LiveCodeBench | 93,5 | Coding |
| MMLU-Pro | 87,5 | Wissen |
| GSM8K | 92,6 | Mathematik |
Quelle: offizielle DeepSeek-V4-Pro Model-Card & Technical Report. Als Preview gekennzeichnet – Werte vor Publikation final prüfen.
V4-Pro ist ein Frontier-Modell mit entsprechendem Infrastrukturbedarf. Wir prüfen mit Ihnen Nutzen, Hardware und Betriebskonzept.
DeepSeek-V4-Pro kombiniert mehrere Attention-Verfahren mit Token-weiser Kompression: Compressed Sparse Attention und Heavily Compressed Attention arbeiten mit DeepSeek Sparse Attention zusammen, um den 1-Million-Token-Kontext effizient zu halten.
Das Modell ist rein textbasiert (nicht multimodal) und laut Berichten auch auf Huawei-Ascend-Hardware lauffähig – ein Argument für souveräne Infrastruktur.
Für Organisationen, die Frontier-Qualität und sehr lange Kontexte selbst betreiben wollen.
1-Million-Token-Kontext als Standard
Frontier-Benchmarks bei offener MIT-Lizenz
Effiziente CSA/HCA-Attention
Breite Agenten- und API-Kompatibilität
Enormer Hardware- und Speicherbedarf
Nicht multimodal (text-only)
Als Preview gekennzeichnet – Reifegrad beachten
Wir planen mit Ihnen die Cluster-Auslegung für DeepSeek-V4-Pro und übernehmen Deployment, Quantisierung und Betrieb – auf Wunsch vollständig in Deutschland.