M4 Pro Mac mini 本地部署 LLM 全攻略
My local model setup on an M4 Pro Mac Mini

我在 M4 Pro Mac mini 上搭建了一套本地 LLM 服务器,用 48GB 内存轻松运行 Qwen3.6-35B 和 Gemma-4-E4B 等模型。通过 oMLX 和 Tailscale,我实现了手机、MacBook 与 Mac mini 的无缝连接,彻底摆脱了云 API 的订阅费、数据隐私担忧和速率限制。本地部署不仅成本固定、响应零延迟,还能随时更换最新模型。对于日常 80% 的任务,本地模型已足够强大,且完全掌握在自己手中。
云 API 是租来的土地,它们随时可能改变定价、触碰你的使用上限,或者在幕后悄悄替换模型。