用 Ryzen 笔记本在本机跑大模型,硬件没变,换一条更顺的“内存通道”也可能明显提速。供稿援引的 Phoronix 测试称,Linux 7.4 相关改进可让 Radeon 集成显卡的 AI 与大语言模型推理性能提高约 18% 至 23%。这对预算有限、希望少依赖云服务的用户尤其值得留意。
关键是 AMD PerfOpt,也就是 AMD IOMMU Performance Optimization。IOMMU 是 Linux 管理设备访问系统内存时使用的地址转换与隔离机制;而 iGPU——集成在处理器里的显卡——通常与 CPU 共用这块内存。PerfOpt 允许显卡直接访问系统内存时绕过 IOMMU,减少额外开销。相关补丁计划让 AMDGPU 驱动在集成显卡上默认启用它,也可通过 amdgpu.iommu_perfopt=0 关闭,方便对照测试。
这轮结果来自测试内核,并使用 Lemonade 本地 AI 服务器和 Llama.cpp 后端,在 Strix Halo、Strix Point 与 Krackan 设备上测试;供稿未披露各设备、模型和任务的逐项数据,因此两成左右的提升仍应视为特定测试结果,而非所有场景的保证。