让一台电脑里的多个 AI 分工做事,难点不只是“算得快”,还得同时装下模型、知识库和任务记录。9 月 10 日,AMD 发布锐龙 AI Max PRO 400 系列,目标正是把这类多模型 Agent——让不同模型分工、调用工具并连续执行任务的智能体系统——更多留在个人设备和工作站上,减少网络依赖、等待时间和敏感数据外传。
它押注的关键是统一内存,也就是 CPU 和 GPU 共用一个内存池,减少数据搬运,并给多个模型腾出更大空间。作为现有平台的参照,锐龙 AI Max+ 395 最高配备 128GB 统一内存,其中最多 96GB 可分配为显存。GPU 可承担大模型推理,NPU 处理低功耗常驻任务,CPU 负责流程编排和工具调用。现场案例覆盖科研、金融、影视和投标,但并非所有任务都要留在本地:视频渲染等重计算仍可交给云端。说白了,Agent 的算力竞争正从云服务器下沉到桌面;不过能否规模化,还要看软件适配、调度效率、价格和实际业务需求。