本地 AI 真正重要的运行时——从 llama.cpp、Ollama 到 vLLM 和 ROCm 本身——都是先为 Linux 打包,再照顾其他系统。Linux 机器可以在没有桌面会话占用显存的情况下跑模型,还能同时驱动多块显卡,而 Windows 子系统一次只暴露一块。在软件这一侧,争论已经结束:这就是在家里跑模型最好的操作系统。
硬件这一侧则变得“驱动味”十足。Windows 买家选一个显存大小,任何带这个数的卡都能用。Linux 买家得先选驱动栈,因为栈决定了哪些卡是一等公民、发行版必须带哪个内核、以及这台机器会占用你多少个周末。NVIDIA 是稳妥路;AMD 在 ROCm 支持清单之内很好、清单之外要手动硬凑;Strix Halo 那枚 128 GB 迷你主机芯片,想要的内核比大多数长期支持版自带的还要新;Intel 是你能买到最便宜的 32 GB,只是裹在最厚的软件里。选你愿意维护的栈,机箱自然跟着定。本文是 Windows 篇的 Linux 姊妹篇,沿用同一套显存逻辑。