What can I run · updated Oct 11, 2026

Local LLMs that run on a Mac with 32 GB of memory

35 of the 56 models we've tested fit, with room for a normal-length chat. The best one is Qwen3.6 27B, scoring 97 out of 100.

#ModelScoreCodingDocumentsDownloadMemory
1 Qwen3.6 27B 97 97 97 Q4 19.6 GB
2 Muse Glimmer 30B 94 90 98 Q4 19.1 GB
3 gpt-oss-20b
ollama run gpt-oss:20b
88 90 87 standard 12.1 GB
4 Qwen3.5-27B 88 77 100 Q4 19.6 GB
5 Qwen3.8 27B 88 77 99 Q4 19.6 GB
6 Nemotron 3 Nano 30B A3B 80 70 91 Q4 20.2 GB
7 Granite 4.2 8B 77 77 78 Q8 11.3 GB
8 Qwen3 30B A3B
ollama run qwen3:30b
77 67 87 Q4 19.9 GB
9 Qwen3 VL 30B A3B Thinking 77 60 93 Q4 20.2 GB
10 Qwen3 14B
ollama run qwen3:14b
72 63 81 Q8 17.6 GB
11 Qwen3.5-9B 72 47 97 Q8 11.9 GB
12 Gemma 4 26B A4B 70 83 58 Q5 21 GB
13 Nemotron 3.5 Lightning 57 43 72 Q4 20.2 GB
14 Qwen3 Coder 30B A3B Instruct
ollama run qwen3-coder:30b
51 57 46 Q4 19.9 GB
15 Qwen3 VL 30B A3B Instruct 46 43 49 Q4 20.2 GB
16 Ministral 3 14B 2512 44 43 45 Q8 16.8 GB
17 Mistral Small 3.2 24B 44 40 47 Q5 19 GB
18 Mistral Small 3 41 37 45 Q5 18.7 GB
19 Gemma 3 27B
ollama run gemma3:27b
40 33 46 Q4 18.7 GB
20 Qwen3 30B A3B Instruct 2507 40 33 46 Q4 19.9 GB
21 Qwen3 VL 8B Instruct 39 37 41 Q8 11.1 GB
22 Ministral 3 8B 2512 37 30 43 Q8 11.2 GB
23 Gemma 3 12B
ollama run gemma3:12b
35 30 40 Q8 14.6 GB
24 Phi 4
ollama run phi4
25 23 26 Q8 17.9 GB
25 Qwen2.5 7B Instruct
ollama run qwen2.5:7b
24 10 37 Q8 9.2 GB
26 Gemma 2 27B
ollama run gemma2:27b
23 13 34 Q4 18.6 GB
27 Llama 3.3 8B Instruct (Q4, Mac)
ollama run hf.co/bartowski/allura-forge_Llama-3.3-8B-Instruct-GGUF:Q4_K_M
23 13 33 Q4 6 GB
28 Mistral Nemo
ollama run mistral-nemo
23 10 36 Q8 15 GB
29 Granite 4.0 Micro (Q4, Mac)
ollama run granite4:micro-h
22 13 31 Q4 3.2 GB
30 Ministral 3 3B 2512 21 10 32 Q8 5.6 GB
31 Llama 3.1 8B Instruct
ollama run llama3.1:8b
15 3 26 Q8 9.6 GB
32 Gemma 3 4B
ollama run gemma3:4b
14 3 25 Q8 5.7 GB
33 Reka Edge 8 0 16 Q8 9.2 GB
34 Llama 3.2 3B Instruct
ollama run llama3.2:3b
6 0 13 Q8 4.5 GB
35 Llama 3.2 1B Instruct (Q4, Mac)
ollama run llama3.2:1b-instruct-q4_K_M
5 0 9 Q4 1.9 GB

"Download" is the biggest version that fits on Mac with 32 GB; "Memory" is roughly what that version needs. Smaller versions also work and leave more room. Q4 or Q8?

Top models that don't fit

  • gpt-oss-120b (96/100) needs about 63.3 GB even in its smallest version.
  • Ling 3.0 Flash (94/100) needs about 83.5 GB even in its smallest version.
  • GLM 4.5V (93/100) needs about 67.4 GB even in its smallest version.
  • Ling 3.0 Flash VL (92/100) needs about 81.9 GB even in its smallest version.
  • Qwen3.5-35B-A3B (88/100) needs about 23.1 GB even in its smallest version.

Not sure how much memory you have? Here's how to check.