localinference
local.ai/localinference
Claimed August 2026
My machines

16" M5 Max Macbook Pro
Apple · 128 GB
Recommended for MacBook Pro M5 Max 128GB · 40-core GPU
Choose what matters most
Best fit
Qwen3.6 35B A3B · UD-Q4_K_S
Best balance of speed and intelligence.
Intelligence68.5Speed17.0 tasks/hrSize20.9 GBMore intelligent
Step 3.7 Flash · IQ4_XS
2% more intelligence · 31% slower.
Intelligence70.0Speed13.0 tasks/hrSize105.0 GB
Faster
Ornith 1.0 35B · Q4_K_M
37% faster · retains 98% intelligence.
Intelligence67.2Speed27.1 tasks/hrSize21.2 GB
DGX Spark
×3Nvidia · 128 GB each
Recommended for NVIDIA DGX Spark 128GB
Choose what matters most
Best fit
Qwen3.6 35B A3B · NVFP4
Best balance of speed and intelligence.
Intelligence69.7Speed21.8 tasks/hrSize23.4 GBMore intelligent
DeepSeek V4 Flash 0731 · UD-IQ2_M
12% more intelligence · 280% slower.
Intelligence77.8Speed5.7 tasks/hrSize90.9 GBFaster
NVIDIA Nemotron 3.5 Lightning 30B A3B · NVFP4
29% faster · retains 81% intelligence.
Intelligence56.2Speed30.6 tasks/hrSize21.6 GB