DeepSeek-V3.1 vereint erstmals einen schnellen Antwortmodus und einen tiefen Reasoning-Modus in einem einzigen 671-Milliarden-Parameter-MoE. Statt zwischen einem Chat- und einem Reasoning-Modell zu wechseln, steuern Sie das Verhalten direkt über das Chat-Template. Das Modell wurde auf Basis von DeepSeek-V3 mit rund 840 Milliarden zusätzlichen Tokens weitertrainiert und bringt spürbar bessere Tool- und Agenten-Fähigkeiten mit – bei voller Offenheit unter der MIT-Lizenz.
DeepSeek-V3.1
DeepSeek AI (High-Flyer, Hangzhou)
August 2025
MIT (Open Source, kommerziell nutzbar)
Mixture-of-Experts, hybrides Reasoning
671 Mrd. total (37 Mrd. aktiv pro Token)
MoE mit Multi-head Latent Attention (MLA), FP8-Gewichte (UE8M0)
128.000 Token
Offizielle Angaben aus der DeepSeek-Model-Card (Auswahl):
| Benchmark | DeepSeek-V3.1 | Referenz R1-0528 |
|---|---|---|
| MMLU-Redux | 91,8 | — |
| GPQA-Diamond | 74,9 | — |
| AIME 2024 | 66,3 | — |
| LiveCodeBench | 56,4 | — |
Quelle: offizielle DeepSeek-V3.1 Model-Card (Hugging Face). Vergleichszahlen je nach Messsetup abweichend.
Ob Hybrid-Reasoning wirklich zu Ihrem Anwendungsfall passt und welche Hardware sinnvoll ist, klären wir gern im unverbindlichen Erstgespräch mit unseren KI-Experten.
DeepSeek-V3.1 baut auf dem V3-Basismodell auf und wurde mit rund 840 Milliarden zusätzlichen Tokens weitertrainiert, ergänzt um einen neuen Tokenizer und ein überarbeitetes Chat-Template.
Der Trainingsprozess kombiniert die effiziente MoE-Architektur mit Multi-head Latent Attention (MLA), sodass pro Token nur 37 Milliarden der 671 Milliarden Parameter aktiv sind – ein guter Kompromiss aus Qualität und Inferenzkosten.
DeepSeek-V3.1 eignet sich überall dort, wo schnelle Antworten und tiefes Reasoning im selben System gebraucht werden.
Hybrid-Modus spart den Wechsel zwischen zwei Modellen
Starke Agenten- und Tool-Fähigkeiten
Vollständig offen unter MIT-Lizenz
Schneller als reine Reasoning-Modelle bei ähnlicher Qualität
128K-Kontext kleiner als spätere V4-Generation
Sehr hoher Hardware-Bedarf (8-GPU-Klasse)
Vereinzelt Sprachmix – in V3.1-Terminus behoben
Wir beraten Sie zu Integration, Quantisierung, Hosting und Betrieb von DeepSeek-V3.1 – auf Wunsch vollständig DSGVO-konform aus unserem Rechenzentrum.