Will it run? / Code Llama 34B

Can I run Code Llama 34B on a Mac or mini PC?

Code Llama 34B needs about 20.5 GB of memory. It fits on 12 of the 15 machines we track. The cheapest current machine that runs it at a comfortable 10+ tokens/sec is the Mac Studio M5 Max (40-core GPU, 64GB) ($3,799).

19 GBdownload (Q4_K_M)
~20.5 GBmemory needed
12/15machines it fits on
ollama run codellama:34b
MachineMemoryFits?Tokens/secFrom
Mac Studio M5 Ultra (96GB) 96 GBYes52
$5,499Check price →
Mac Studio M5 Ultra (256GB) 256 GBYes52
$9,499Check price →
Mac Studio M5 Max (40-core GPU, 64GB) 64 GBYes26
$3,799Check price →
Mac mini M5 Pro (64GB) 64 GBYes13
Check price →
Mac mini M4 Pro (64GB) older 64 GBYes12
Check price →
NVIDIA DGX Spark (128GB) 128 GBYes10
Check price →
Ryzen AI Max+ 395 mini PC (128GB) 128 GBYes9.4
Check price →
Mac mini M5 Pro (24GB) 24 GBBarely7.8
$1,699Check price →
Mac mini M6 (32GB) 32 GBYes7.2
Check price →
Beelink SER7 (Ryzen 7 7840HS, 32GB) 32 GBYes2.8
Check price →
Minisforum UM790 Pro (Ryzen 9 7940HS, 32GB) 32 GBYes2.8
Check price →
GEEKOM A6 (Ryzen 7 6800H, 32GB) 32 GBYes2.4
Check price →
Mac mini M6 (16GB) 16 GBNo–
$899Check price →
Mac mini M4 (16GB) older 16 GBNo–
Check price →
Mac mini M2 (16GB) older 16 GBNo–
Check price →

Around 10 tokens/sec reads comfortably; under 5 feels slow. How we estimate.

Other codellama sizes

Embed this table

Free for blogs, READMEs and model cards. Updates automatically.

<iframe src="https://vsmacs.com/embed/codellama-34b" width="100%" height="420" style="border:0" loading="lazy" title="Code Llama 34B speed by machine"></iframe>