Llama
Llama 3.2 3B
Meta · 3B parameters · 2 GGUF variants
Local AI model catalog
Browse model families, GGUF quantizations, and conservative memory planning signals used by AIPCFit. Model pages link to dedicated GPU memory guides and Apple Silicon unified-memory guides where the fit engine has enough information.
Starting from a model and quantization? Estimate memory planning thresholds with the LLM VRAM calculator.
Browse by family
Model finder
Search the catalog or narrow models by family, size, and common local-AI use case.
20 of 20 models
Llama
Meta · 3B parameters · 2 GGUF variants
Llama
Meta · 8B parameters · 2 GGUF variants
Llama
Meta · 70B parameters · 1 GGUF variant
Qwen
Alibaba Cloud · 4B parameters · 2 GGUF variants
Qwen
Alibaba Cloud · 8B parameters · 2 GGUF variants
Qwen
Alibaba Cloud · 14B parameters · 2 GGUF variants
Qwen
Alibaba Cloud · 30.5B parameters · 2 GGUF variants
Qwen
Alibaba Cloud · 27B parameters · 2 GGUF variants
Gemma
Google · 4B parameters · 2 GGUF variants
Gemma
Google · 12B parameters · 2 GGUF variants
Gemma
Google · 27B parameters · 2 GGUF variants
Mistral
Mistral AI · 7B parameters · 2 GGUF variants
Mistral
Mistral AI · 46.7B parameters · 1 GGUF variant
Mistral
Mistral AI · 24B parameters · 2 GGUF variants
DeepSeek
DeepSeek · 7B parameters · 2 GGUF variants
DeepSeek
DeepSeek · 14B parameters · 1 GGUF variant
DeepSeek
DeepSeek · 32B parameters · 2 GGUF variants
Phi
Microsoft · 3.8B parameters · 1 GGUF variant
Phi
Microsoft · 3.8B parameters · 1 GGUF variant
Phi
Microsoft · 14B parameters · 1 GGUF variant