| Machine | Fits? | Tokens/sec | |
|---|---|---|---|
| Mac Studio M5 Ultra (96GB) | Yes | 120+ | Check price → |
| Mac Studio M5 Ultra (256GB) | Yes | 120+ | Check price → |
| Mac Studio M5 Max (40-core GPU, 64GB) | Yes | 63 | Check price → |
| Mac mini M5 Pro (24GB) | Yes | 32 | Check price → |
| Mac mini M5 Pro (64GB) | Yes | 32 | Check price → |
| Mac mini M4 Pro (64GB) older | Yes | 28 | Check price → |
| NVIDIA DGX Spark (128GB) | Yes | 25 | Check price → |
| Ryzen AI Max+ 395 mini PC (128GB) | Yes | 23 | Check price → |
| Mac mini M6 (16GB) | Yes | 17 | Check price → |
| Mac mini M6 (32GB) | Yes | 17 | Check price → |
| Mac mini M4 (16GB) older | Yes | 12 | Check price → |
| Mac mini M2 (16GB) older | Yes | 10 | Check price → |
| Beelink SER7 (Ryzen 7 7840HS, 32GB) | Yes | 6.9 | Check price → |
| Minisforum UM790 Pro (Ryzen 9 7940HS, 32GB) | Yes | 6.9 | Check price → |
| GEEKOM A6 (Ryzen 7 6800H, 32GB) | Yes | 5.9 | Check price → |
Around 10 tokens/sec reads comfortably; under 5 feels slow. How we estimate.
Other llama3.2-vision sizes
Embed this table
Free for blogs, READMEs and model cards. Updates automatically.
<iframe src="https://vsmacs.com/embed/llama3-2-vision-11b" width="100%" height="420" style="border:0" loading="lazy" title="Llama 3.2 Vision 11B speed by machine"></iframe>