Fastest Local Coding Model on a 32 GB Mac Mini: qwen3-coder:30b vs qwen2.5-coder:32b vs qwen2.5-coder:14b
BLUF On my 32 GB Mac mini (Apple M2 Pro), qwen3-coder:30b — a Mixture-of-Experts model with roughly 3B active parameters — hit 41 tok/s generation speed, compared to 14.2 tok/s for qwen2.5-coder:14b and 6.9 tok/s for the dense qwen2.5-coder:32b. The MoE architecture is doing something very different from dense 32B here, and the raw numbers … Read more