

DeepSeek Flash
#49 in Open-Source-SprachmodelleDeepSeek · flash · seit 31. Juli 2026 (offizielle GA-Version "V4-Flash-0731"; ursprüngliche Preview: 24. April 2026) · 3× · zuletzt 15. Aug. 2026
DeepSeek Flash (offiziell DeepSeek-V4-Flash, Build "0731") ist ein Open-Source-Sprachmodell von DeepSeek, das als kosteneffiziente Variante der DeepSeek-V4-Modellfamilie entwickelt wurde. Es basiert auf einer Mixture-of-Experts-Architektur mit 284 Milliarden Gesamtparametern, von denen pro Token nur 13 Milliarden aktiviert werden, und bietet ein Kontextfenster von 1 Million Token. Die am 31. Juli 2026 veröffentlichte offizielle Version verbessert gegenüber der April-Vorschau vor allem die Agenten- und Coding-Fähigkeiten durch intensiviertes Post-Training, ohne die Architektur zu verändern. Die Gewichte sind unter der MIT-Lizenz auf Hugging Face frei verfügbar.
Features
| Key-Benchmark (%) | Terminal-Bench 2.1: 82,7 (offizielle Steigerung von 61,8 auf 82,7 durch Post-Training) |
| Kontextfenster (Token) | 1.000.000 Token (max. 384.000 Ausgabe-Token) |
| Lizenz | MIT-Lizenz (offene Gewichte) |
| Multimodalität | Kein Beleg für Multimodalität gefunden; Modell ist primär textbasiert mit Funktionsaufruf/strukturierter Ausgabe |
| Plattform | DeepSeek API (deepseek-v4-flash), chat.deepseek.com, Hugging Face, LM Studio, Ollama |
| Preis pro 1M Token | $0,14 Input (Cache-Miss) / $0,0028 Input (Cache-Hit) / $0,28 Output |
| Release-Datum | 31. Juli 2026 (offizielle Version 0731); Preview am 24. April 2026 |