Qwen3 8B · Q4_K_M
GGUF · Q4_K_M
- Model-size signal
- 5.0 GB
- Minimum load
- 6 GB
- Planning memory
- 7 GB
- GPU VRAM
- 16 GB
16 GB dedicated VRAM meets the 7 GB planning memory level for Qwen3 8B · Q4_K_M.
This is a deterministic memory fit, not a speed or quality benchmark.