What can I run · updated Oct 11, 2026

Local LLMs that run on a Mac with 96 GB of memory

52 of the 56 models we've tested fit, with room for a normal-length chat. The best one is Qwen3.6 27B, scoring 97 out of 100.

#ModelScoreCodingDocumentsDownloadMemory
1 Qwen3.6 27B 97 97 97 Q8 32.3 GB
2 gpt-oss-120b
ollama run gpt-oss:120b
96 93 99 standard 63.3 GB
3 Muse Glimmer 30B 94 90 98 Q8 32.7 GB
4 GLM 4.5V 93 87 99 Q4 67.4 GB
5 gpt-oss-20b
ollama run gpt-oss:20b
88 90 87 standard 12.1 GB
6 Qwen3.5-27B 88 77 100 Q8 32.3 GB
7 Qwen3.8 27B 88 77 99 Q8 32.3 GB
8 Qwen3.5-35B-A3B 88 80 95 Q8 39.5 GB
9 Qwen3.6 35B A3B 86 80 93 Q8 39.5 GB
10 Laguna XS 2.1 82 73 91 Q8 37.5 GB
11 Nemotron 3 Nano 30B A3B 80 70 91 Q8 34.6 GB
12 Gemma 4 31B 79 93 65 Q8 41.9 GB
13 Granite 4.2 8B 77 77 78 Q8 11.3 GB
14 Qwen3 30B A3B
ollama run qwen3:30b
77 67 87 Q8 33.8 GB
15 Qwen3 VL 30B A3B Thinking 77 60 93 Q8 34.4 GB
16 GLM 4.5 Air 76 70 82 Q4 69.1 GB
17 GLM 4.6V 73 73 73 Q4 67.4 GB
18 Qwen3 14B
ollama run qwen3:14b
72 63 81 Q8 17.6 GB
19 GLM 4.7 Flash 72 73 70 Q8 36.9 GB
20 Qwen3.5-9B 72 47 97 Q8 11.9 GB
21 Gemma 4 26B A4B 70 83 58 Q8 30 GB
22 Qwen3 32B
ollama run qwen3:32b
64 50 79 Q8 37.6 GB
23 Nemotron 3.5 Lightning 57 43 72 Q8 34.6 GB
24 Nex-N2.5-Mini 57 27 88 Q8 38.6 GB
25 Hunyuan A13B Instruct 52 37 67 Q6 67.9 GB
26 Qwen3 Coder 30B A3B Instruct
ollama run qwen3-coder:30b
51 57 46 Q8 33.8 GB
27 Qwen3 VL 30B A3B Instruct 46 43 49 Q8 34.4 GB
28 Qwen2.5 72B Instruct 46 40 52 Q6 63.2 GB
29 Llama 3.3 70B Instruct 46 47 45 Q6 60.2 GB
30 Command A 45 33 56 Q4 69.4 GB
31 Ministral 3 14B 2512 44 43 45 Q8 16.8 GB
32 Mistral Small 3.2 24B 44 40 47 Q8 27.5 GB
33 Mistral Small 3 41 37 45 Q8 27 GB
34 Gemma 3 27B
ollama run gemma3:27b
40 33 46 Q8 31.2 GB
35 Qwen3 30B A3B Instruct 2507 40 33 46 Q8 33.8 GB
36 Qwen3 VL 8B Instruct 39 37 41 Q8 11.1 GB
37 Llama 3.1 70B Instruct 39 33 44 Q6 60.2 GB
38 Ministral 3 8B 2512 37 30 43 Q8 11.2 GB
39 Gemma 3 12B
ollama run gemma3:12b
35 30 40 Q8 14.6 GB
40 Phi 4
ollama run phi4
25 23 26 Q8 17.9 GB
41 Qwen2.5 7B Instruct
ollama run qwen2.5:7b
24 10 37 Q8 9.2 GB
42 Gemma 2 27B
ollama run gemma2:27b
23 13 34 Q8 31 GB
43 Llama 3.3 8B Instruct (Q4, Mac)
ollama run hf.co/bartowski/allura-forge_Llama-3.3-8B-Instruct-GGUF:Q4_K_M
23 13 33 Q4 6 GB
44 Mistral Nemo
ollama run mistral-nemo
23 10 36 Q8 15 GB
45 Granite 4.0 Micro (Q4, Mac)
ollama run granite4:micro-h
22 13 31 Q4 3.2 GB
46 Ministral 3 3B 2512 21 10 32 Q8 5.6 GB
47 Llama 3.1 8B Instruct
ollama run llama3.1:8b
15 3 26 Q8 9.6 GB
48 Gemma 3 4B
ollama run gemma3:4b
14 3 25 Q8 5.7 GB
49 Qwen2.5 VL 72B Instruct 14 13 14 Q6 63.8 GB
50 Reka Edge 8 0 16 Q8 9.2 GB
51 Llama 3.2 3B Instruct
ollama run llama3.2:3b
6 0 13 Q8 4.5 GB
52 Llama 3.2 1B Instruct (Q4, Mac)
ollama run llama3.2:1b-instruct-q4_K_M
5 0 9 Q4 1.9 GB

"Download" is the biggest version that fits on Mac with 96 GB; "Memory" is roughly what that version needs. Smaller versions also work and leave more room. Q4 or Q8?

Top models that don't fit

  • Ling 3.0 Flash (94/100) needs about 83.5 GB even in its smallest version.
  • Ling 3.0 Flash VL (92/100) needs about 81.9 GB even in its smallest version.
  • Laguna S 2.1 (64/100) needs about 73.5 GB even in its smallest version.
  • Devstral 2 2512 (53/100) needs about 79.4 GB even in its smallest version.

Not sure how much memory you have? Here's how to check.