DeepSeek V-series
17 models · DeepSeek
DeepSeek's V2–V3.2 open MoE line (671B total/37B active for V3), including Coder variants, the Terminus and Speciale editions, and V3.2's sparse-attention experiments — each iteration cutting inference cost further.
Models in this family
- DeepSeek Coder V2 Lite InstructDeepSeekOpen weights
- DeepSeek LLM 67B Chat (V1)DeepSeek67B parametersOpen weights
- DeepSeek V3 (Dec '24)DeepSeekOpen weights
- DeepSeek V3 0324DeepSeekOpen weights
- DeepSeek V3.1 (Non-reasoning)DeepSeekOpen weights
- DeepSeek V3.1 (Reasoning)DeepSeekOpen weights
- DeepSeek V3.1 Terminus (Non-reasoning)DeepSeekOpen weights
- DeepSeek V3.1 Terminus (Reasoning)DeepSeekOpen weights
- DeepSeek V3.2 (Non-reasoning)DeepSeekOpen weights
- DeepSeek V3.2 (Reasoning)DeepSeekOpen weights
- DeepSeek V3.2 Exp (Non-reasoning)DeepSeekOpen weights
- DeepSeek V3.2 Exp (Reasoning)DeepSeekOpen weights
- DeepSeek V3.2 SpecialeDeepSeekOpen weights
- DeepSeek-Coder-V2DeepSeekOpen weights
- DeepSeek-V2-ChatDeepSeekOpen weights
- DeepSeek-V2.5DeepSeekOpen weights
- DeepSeek-V2.5 (Dec '24)DeepSeekOpen weights
