Qwen3 14B · Q4_K_M
GGUF · Q4_K_M
- Model-size signal
- 9 GB
- Minimum load
- 10.4 GB
- Planning memory
- 12.2 GB
- GPU VRAM
- 12 GB
12 GB dedicated VRAM meets the 10.4 GB minimum-load planning level, but not the 12.2 GB recommended headroom.
Expect less room for long context or concurrent GPU work.