- Context (input / output)
- 1.05M / 393K
- Parameters
- 552B / 16B active
- Release date
- 2026-09
- License
- MIT
- Input modalities
- Text · Image
- Output modalities
- Text
- Architecture
- MoE, Causal Encoder-Decoder (CED)
- Modes
- Supports non-thinking and thinking (low / high / max)
- Attention
- Compressed Sparse Attention 2 (CSA2)
- Experts
- 384 (6 routed + 1 shared expert per token)
- Backbone parameters
- 552B
- Exact release date
- 2026-09-10
- Release status
- Production API release
- API model ID
- deepseek-flash
- Weight status
- Open weights released (MIT)
- Engram parameters
- 196B (separate from backbone parameters)
- Active parameters (prefill)
- 8B
- Active parameters (decode)
- 16B