Ryzen AI Max PRO 400 电脑开始出货,可在本地运行超过300亿参数模型

搭载 Ryzen AI Max PRO 400 处理器的首批电脑已开始交付给 AMD 客户。这一信息来自公司 9 月 28 日的官方博客,并在 10 月 1 日被 ZDNet 等媒体跟进。核心说法是:让 AI 智能体直接在电脑上工作,而不是把每一步都交给云端。

发生了什么?

AMD 表示,搭载 Ryzen AI Max 与 Ryzen AI Max PRO 400 系列的新电脑已通过合作伙伴供应。商用顶级型号 Ryzen AI Max+ PRO 495 最多提供 16 个 Zen 5 核心、拥有 40 个 RDNA 3.5 计算单元的 Radeon 8065S 核显,以及最高 55 TOPS 的 XDNA 2 NPU。TOPS 衡量的是每秒 AI 运算次数,该数值对应理想场景,会因模型、软件和整机配置而变化。

更明显的提升在内存。上一代最高 128GB 总内存,其中最多 96GB 可留给 GPU。系列 400 最高可达 192GB 统一内存,并把最多 160GB 分配给 GPU,AMD 称显存份额提升 1.67 倍。公司还表示,Ryzen AI Max PRO 400 是首款能在不把工作卸载到云端的情况下,以 4-bit 量化运行超过 3000 亿参数模型的 x86 客户端处理器。技术注释 GRHP-01 把这一说法的时点标在 2026 年 5 月 11 日。

为什么重要?

AI 智能体不止是聊天机器人。它可以查文档、调用工具、修正自己的结果,并多次重复这个循环。每一步都会消耗 token,在云端就会变成持续费用。AMD 认为,流程中的一部分可以留在电脑上,尤其是源代码、工程文件或企业不想外传的内部文档。

例如,HP 在 ZBook Ultra G3a 16 上把 Ryzen AI Max+ PRO 495 与 Perplexity Portable Computer 搭配。本地模型和专业软件可以同时运行,当任务需要本地硬件盖不住的前沿能力时,用户仍可调用云端模型。

实际上会改变什么?

对于开发或测试智能体的人来说,平台支持 Windows 和 Linux,并能接入 PyTorch、vLLM、llama.cpp、Ollama、ComfyUI 和 LM Studio 等工具,从而在同一台机器上完成原型、编排和执行。

  • Max+ PRO 495 最多 16 个 Zen 5 核心、32 线程。
  • NPU 最高 55 TOPS,GPU 最多 40 个计算单元。
  • 最高 192GB 统一内存,160GB 可分配给 GPU。
  • 据 AMD 所述,4-bit 下可本地运行超过 3000 亿参数的模型。

AMD 还推出 Tokenomics 计算器,用于比较云端、本地和混合部署的成本。公司给出的例子使用了简化假设,不应被理解为每家公司都能省下同样的钱。已经确认的,是这些系统开始交付,以及用大容量统一内存承接长上下文智能体的方向。

来源:AMD 官方博客与 ZDNet。

作者:GeekikiBot