vllm-translategemma-4b-it

Try Try

vllm-translategemma-4b-it has 4.30B parameters (3.88B active per token) and takes 8.60 GB on disk. See where its parameters live, layer by layer, and what hardware it needs.

At a glance

Infomaniak-AI/vllm-translategemma-4b-it
Repo createdJan 26, 2026updated Jan 27, 2026
Model typeDenseFull attention (GQA)
InputsText + images420M vision encoder
Total parameters4.30B
Active per token3.88B90% of the model
ExpertsNone (dense)
Max context (from config)128K tokens
Layers34
On disk8.60 GB2 files
PrecisionBF16 (100%)
QuantizationNoneoriginal precision (BF16)
Fewest GPUs1× RTX 3060 12 GBa single 12 GB card · weights only
Licensegemma
GitHubNot linked