gemma-4-26B-A4B-it-FP8-dynamic

Try Try

gemma-4-26B-A4B-it-FP8-dynamic has 26.5B parameters and takes 28.6 GB on disk. See where its parameters live, layer by layer, and what hardware it needs.

At a glance

RedHatAI/gemma-4-26B-A4B-it-FP8-dynamic
Repo createdApr 6, 2026updated Aug 13, 2026
Model typeMixture of expertsFull attention (GQA)
InputsText + images573M vision encoder
Total parameters26.5B
Active per token0
ExpertsNone of 128 active
Max context (from config)256K tokens
Layers30
On disk28.6 GB1 file
PrecisionFP8 E4M3 (85%), BF16 (14%), other (0.12%)
QuantizationFP8 E4M3 (compressed-tensors)per channel · 92% of parameters · embeddings & output head and vision encoder kept in BF16
Fewest GPUs1× RTX 5090a single 32 GB card · weights only
Licenseapache-2.0
GitHubNot linked