| Machine | Fits? | Tokens/sec | |
|---|---|---|---|
| Mac mini M5 Pro (24GB) | Yes | 120+ | Check price → |
| Mac mini M5 Pro (64GB) | Yes | 120+ | Check price → |
| Mac Studio M5 Max (40-core GPU, 64GB) | Yes | 120+ | Check price → |
| Mac Studio M5 Ultra (96GB) | Yes | 120+ | Check price → |
| Mac Studio M5 Ultra (256GB) | Yes | 120+ | Check price → |
| Mac mini M4 Pro (64GB) older | Yes | 120+ | Check price → |
| Ryzen AI Max+ 395 mini PC (128GB) | Yes | 120+ | Check price → |
| NVIDIA DGX Spark (128GB) | Yes | 120+ | Check price → |
| Mac mini M6 (16GB) | Yes | 105 | Check price → |
| Mac mini M6 (32GB) | Yes | 105 | Check price → |
| Mac mini M4 (16GB) older | Yes | 74 | Check price → |
| Mac mini M2 (16GB) older | Yes | 62 | Check price → |
| Beelink SER7 (Ryzen 7 7840HS, 32GB) | Yes | 41 | Check price → |
| Minisforum UM790 Pro (Ryzen 9 7940HS, 32GB) | Yes | 41 | Check price → |
| GEEKOM A6 (Ryzen 7 6800H, 32GB) | Yes | 35 | Check price → |
Around 10 tokens/sec reads comfortably; under 5 feels slow. How we estimate.
Other llama3.2 sizes
Embed this table
Free for blogs, READMEs and model cards. Updates automatically.
<iframe src="https://vsmacs.com/embed/llama3-2-1b" width="100%" height="420" style="border:0" loading="lazy" title="Llama 3.2 1B speed by machine"></iframe>