产品定位
AMD Ryzen AI Halo是一台面向开发者的紧凑型本地AI平台。它把CPU、集成GPU、NPU和大容量统一内存放进约迷你主机大小的系统,用于在桌面上构建、测试和运行大语言模型、图像生成与Agent工作流。
当前版本规格
- 处理器:Ryzen AI Max+ 395,16核32线程Zen 5 CPU。
- 图形:Radeon 8060S集成GPU,40个RDNA 3.5计算单元。
- 内存:128GB LPDDR5x统一内存,官方规格为256GB/s带宽。
- 本地模型:官方标称可运行最高约2000亿参数模型,实际取决于量化、上下文和内存分配。
- 系统:支持Windows 11或Linux,并围绕ROCm提供经过验证的软件栈。
下一代升级
AMD已经预告搭载Ryzen AI Max+ PRO 495的新版本,内存支持将提高到192GB,其中最多160GB可作为显存使用,并把官方本地模型目标推到3000亿参数。新旧版本不能混为一谈,购买时应核对处理器、内存和上市状态。
软件与使用流程
- 首次启动后通过Ryzen AI Developer Center检查驱动、固件和软件。
- 根据任务选择LM Studio、Ollama、llama.cpp、vLLM、ComfyUI或PyTorch工作流。
- 按模型大小设置量化与显存分配,先从短上下文和单Agent测试。
- 记录首Token延迟、生成速度、功耗与内存占用,再逐步提高并发。
- 对敏感任务设置本地数据目录和网络访问策略,避免模型或插件意外上传文件。
适合人群
适合本地大模型开发者、AI应用团队、需要私有数据推理的企业、ComfyUI创作者和多Agent实验者。它强调大内存容量与开发便利,不等于所有模型上的绝对最高速度。
费用与注意事项
本地推理没有按Token收费,但仍有硬件、电费、折旧、模型许可、维护和时间成本。官方成本对比基于特定持续高负载假设,轻度用户未必能比云端API更便宜。





