What can I run · updated Oct 11, 2026

Local LLMs that run on a Mac with 128 GB of memory

56 of the 56 models we've tested fit, with room for a normal-length chat. The best one is Qwen3.6 27B, scoring 97 out of 100. The same list is a good guide for 128 GB "AI PCs" such as AMD Strix Halo (Ryzen AI Max+ 395) and NVIDIA DGX Spark.

#ModelScoreCodingDocumentsDownloadMemory
1 Qwen3.6 27B 97 97 97 Q8 32.3 GB
2 gpt-oss-120b
ollama run gpt-oss:120b
96 93 99 standard 63.3 GB
3 Muse Glimmer 30B 94 90 98 Q8 32.7 GB
4 Ling 3.0 Flash 94 93 95 Q4 83.5 GB
5 GLM 4.5V 93 87 99 Q6 90.9 GB
6 Ling 3.0 Flash VL 92 87 98 Q5 95 GB
7 gpt-oss-20b
ollama run gpt-oss:20b
88 90 87 standard 12.1 GB
8 Qwen3.5-27B 88 77 100 Q8 32.3 GB
9 Qwen3.8 27B 88 77 99 Q8 32.3 GB
10 Qwen3.5-35B-A3B 88 80 95 Q8 39.5 GB
11 Qwen3.6 35B A3B 86 80 93 Q8 39.5 GB
12 Laguna XS 2.1 82 73 91 Q8 37.5 GB
13 Nemotron 3 Nano 30B A3B 80 70 91 Q8 34.6 GB
14 Gemma 4 31B 79 93 65 Q8 41.9 GB
15 Granite 4.2 8B 77 77 78 Q8 11.3 GB
16 Qwen3 30B A3B
ollama run qwen3:30b
77 67 87 Q8 33.8 GB
17 Qwen3 VL 30B A3B Thinking 77 60 93 Q8 34.4 GB
18 GLM 4.5 Air 76 70 82 Q6 93.1 GB
19 GLM 4.6V 73 73 73 Q6 90.9 GB
20 Qwen3 14B
ollama run qwen3:14b
72 63 81 Q8 17.6 GB
21 GLM 4.7 Flash 72 73 70 Q8 36.9 GB
22 Qwen3.5-9B 72 47 97 Q8 11.9 GB
23 Gemma 4 26B A4B 70 83 58 Q8 30 GB
24 Qwen3 32B
ollama run qwen3:32b
64 50 79 Q8 37.6 GB
25 Laguna S 2.1 64 70 59 Q5 85.8 GB
26 Nemotron 3.5 Lightning 57 43 72 Q8 34.6 GB
27 Nex-N2.5-Mini 57 27 88 Q8 38.6 GB
28 Devstral 2 2512 53 53 53 Q5 92.5 GB
29 Hunyuan A13B Instruct 52 37 67 Q8 87.1 GB
30 Qwen3 Coder 30B A3B Instruct
ollama run qwen3-coder:30b
51 57 46 Q8 33.8 GB
31 Qwen3 VL 30B A3B Instruct 46 43 49 Q8 34.4 GB
32 Qwen2.5 72B Instruct 46 40 52 Q8 80.5 GB
33 Llama 3.3 70B Instruct 46 47 45 Q8 77.1 GB
34 Command A 45 33 56 Q6 93.6 GB
35 Ministral 3 14B 2512 44 43 45 Q8 16.8 GB
36 Mistral Small 3.2 24B 44 40 47 Q8 27.5 GB
37 Mistral Small 3 41 37 45 Q8 27 GB
38 Gemma 3 27B
ollama run gemma3:27b
40 33 46 Q8 31.2 GB
39 Qwen3 30B A3B Instruct 2507 40 33 46 Q8 33.8 GB
40 Qwen3 VL 8B Instruct 39 37 41 Q8 11.1 GB
41 Llama 3.1 70B Instruct 39 33 44 Q8 77.1 GB
42 Ministral 3 8B 2512 37 30 43 Q8 11.2 GB
43 Gemma 3 12B
ollama run gemma3:12b
35 30 40 Q8 14.6 GB
44 Phi 4
ollama run phi4
25 23 26 Q8 17.9 GB
45 Qwen2.5 7B Instruct
ollama run qwen2.5:7b
24 10 37 Q8 9.2 GB
46 Gemma 2 27B
ollama run gemma2:27b
23 13 34 Q8 31 GB
47 Llama 3.3 8B Instruct (Q4, Mac)
ollama run hf.co/bartowski/allura-forge_Llama-3.3-8B-Instruct-GGUF:Q4_K_M
23 13 33 Q4 6 GB
48 Mistral Nemo
ollama run mistral-nemo
23 10 36 Q8 15 GB
49 Granite 4.0 Micro (Q4, Mac)
ollama run granite4:micro-h
22 13 31 Q4 3.2 GB
50 Ministral 3 3B 2512 21 10 32 Q8 5.6 GB
51 Llama 3.1 8B Instruct
ollama run llama3.1:8b
15 3 26 Q8 9.6 GB
52 Gemma 3 4B
ollama run gemma3:4b
14 3 25 Q8 5.7 GB
53 Qwen2.5 VL 72B Instruct 14 13 14 Q8 81.3 GB
54 Reka Edge 8 0 16 Q8 9.2 GB
55 Llama 3.2 3B Instruct
ollama run llama3.2:3b
6 0 13 Q8 4.5 GB
56 Llama 3.2 1B Instruct (Q4, Mac)
ollama run llama3.2:1b-instruct-q4_K_M
5 0 9 Q4 1.9 GB

"Download" is the biggest version that fits on Mac with 128 GB; "Memory" is roughly what that version needs. Smaller versions also work and leave more room. Q4 or Q8?