

DeepSeek R1 671B
#24 in Reasoning-ModelleDeepSeek · 671b · 2× · zuletzt 23. Juli 2026
DeepSeek R1 671B ist ein Open-Weight-Reasoning-Modell des chinesischen KI-Labors DeepSeek, das auf einer Mixture-of-Experts-Architektur mit 671 Milliarden Gesamtparametern basiert, von denen pro Inferenzschritt nur rund 37 Milliarden aktiv genutzt werden. Das Modell wurde primär mittels Reinforcement Learning trainiert und zeigt sichtbare Chain-of-Thought-Reasoning-Schritte vor der finalen Antwort. Es wird unter der MIT-Lizenz als Open-Weight-Modell bereitgestellt und ist zusätzlich über die offizielle DeepSeek-API sowie den Chat-Dienst chat.deepseek.com nutzbar. Ein Update (DeepSeek-R1-0528) verbesserte im Mai 2025 die Reasoning-Tiefe und Benchmark-Leistung weiter.
Features
| Key-Benchmark (%) | AIME 2024: 79,8% Pass@1; MATH-500: 97,3% Pass@1 |
| Kontextfenster (Token) | 163.840 Token |
| Lizenz | MIT-Lizenz, kommerzielle Nutzung und Modifikation erlaubt |
| Multimodalität | Kein multimodales Modell; reines Text-Reasoning-Modell (max. Generierungslänge 32.768 Token) |
| Plattform | Open-Weight-Download (Hugging Face/GitHub), Chat unter chat.deepseek.com, API über platform.deepseek.com |
| Preis pro 1M Token | 0,55 $ Input / 2,19 $ Output (Cache-Hit-Input: 0,14 $) |
| Release-Datum | 20. Januar 2025 |