deepseek-coder-7b-instruct-v1.5

Try Try

deepseek-coder-7b-instruct-v1.5 has 6.91B parameters (6.49B active per token) and takes 13.8 GB on disk. See where its parameters live, layer by layer, and what hardware it needs.

At a glance

deepseek-ai/deepseek-coder-7b-instruct-v1.5
Repo createdJan 25, 2024updated Feb 5, 2024
Model typeDenseFull attention (MHA)
InputsText
Total parameters6.91B
Active per token6.49B94% of the model
ExpertsNone (dense)
Max context (from config)4K tokens
Layers30
On disk13.8 GB3 files
PrecisionBF16 (100%)
QuantizationNoneoriginal precision (BF16)
Fewest GPUs1× RTX 5060 Ti 16 GBa single 16 GB card · weights only
Licensedeepseek (custom)
GitHubdeepseek-ai/deepseek-coder