Gemma 3 4B · Q4_K_M
GGUF · Q4_K_M
- Model-size signal
- 2.5 GB
- Minimum load
- 3.5 GB
- Planning memory
- 4.5 GB
- GPU VRAM
- 12 GB
12 GB dedicated VRAM meets the 4.5 GB planning memory level for Gemma 3 4B · Q4_K_M.
This is a deterministic memory fit, not a speed or quality benchmark.