做视频AI导航网
做视频AI导航网
AI导航
  • 热门工具
  • Agent智能体
  • Skills技能
  • AI大模型
  • AI创作
  • AI工具集
视频Video
  • 素材下载
  • 创作灵感
Github神器
  • 导航
  • 资讯
  • 视频素材
  • 视频模版
  • 音乐音效
  • Luts调色预设
  • 整合包
首页/
打开 MD 链接

AMD Ryzen AI Halo - 128GB统一内存的本地AI开发平台

12
支持Windows与Linux、ROCm和2000亿参数模型,下一代版本将升至192GB内存
评分
产品类型:紧凑型本地AI开发平台当前处理器:AMD Ryzen AI Max+ 395当前内存:128GB LPDDR5x统一内存,256GB/s带宽本地模型:官方标称支持最高约2000亿参数模型操作系统:Windows 11或Linux软件生态:ROCm、PyTorch、vLLM、llama.cpp、Ollama、ComfyUI、LM Studio
AMD Ryzen AI Halo是面向本地AI开发与推理的紧凑型平台,当前型号配备Ryzen AI Max+…
Ai硬件|AI PC·AMD Ryzen AI·AMD Ryzen AI Halo·ROCm·本地AI

产品定位

AMD Ryzen AI Halo是一台面向开发者的紧凑型本地AI平台。它把CPU、集成GPU、NPU和大容量统一内存放进约迷你主机大小的系统,用于在桌面上构建、测试和运行大语言模型、图像生成与Agent工作流。

当前版本规格

  • 处理器:Ryzen AI Max+ 395,16核32线程Zen 5 CPU。
  • 图形:Radeon 8060S集成GPU,40个RDNA 3.5计算单元。
  • 内存:128GB LPDDR5x统一内存,官方规格为256GB/s带宽。
  • 本地模型:官方标称可运行最高约2000亿参数模型,实际取决于量化、上下文和内存分配。
  • 系统:支持Windows 11或Linux,并围绕ROCm提供经过验证的软件栈。

下一代升级

AMD已经预告搭载Ryzen AI Max+ PRO 495的新版本,内存支持将提高到192GB,其中最多160GB可作为显存使用,并把官方本地模型目标推到3000亿参数。新旧版本不能混为一谈,购买时应核对处理器、内存和上市状态。

软件与使用流程

  1. 首次启动后通过Ryzen AI Developer Center检查驱动、固件和软件。
  2. 根据任务选择LM Studio、Ollama、llama.cpp、vLLM、ComfyUI或PyTorch工作流。
  3. 按模型大小设置量化与显存分配,先从短上下文和单Agent测试。
  4. 记录首Token延迟、生成速度、功耗与内存占用,再逐步提高并发。
  5. 对敏感任务设置本地数据目录和网络访问策略,避免模型或插件意外上传文件。

适合人群

适合本地大模型开发者、AI应用团队、需要私有数据推理的企业、ComfyUI创作者和多Agent实验者。它强调大内存容量与开发便利,不等于所有模型上的绝对最高速度。

费用与注意事项

本地推理没有按Token收费,但仍有硬件、电费、折旧、模型许可、维护和时间成本。官方成本对比基于特定持续高负载假设,轻度用户未必能比云端API更便宜。

常见问题(FAQ)

AMD Ryzen AI Halo是什么?
它是AMD面向本地AI开发与推理推出的紧凑型开发平台,集成CPU、GPU、NPU和大容量统一内存。
Ryzen AI Halo能运行多大的模型?
当前128GB版本官方标称可运行最高约2000亿参数模型;实际能力受量化精度、上下文、缓存和内存分配影响。
192GB版本已经上市了吗?
AMD已预告搭载Ryzen AI Max+ PRO 495的下一代平台,支持192GB内存;具体上市与配置以官方和整机厂商页面为准。
Ryzen AI Halo支持哪些系统?
当前官方规格列出Windows 11与Linux,并提供ROCm和经过验证的AI开发软件。
本地运行模型是否完全免费?
没有API按Token账单,但仍需承担硬件、电力、折旧、维护、模型许可和运维成本。
0 讨论
热门最新
总结
暂无总结
0 / 600
细中粗

相关网站

热门最新

AMD Threadripper Halo Station – 2.6TB内存的桌边AI工作站

96核Threadripper PRO配合最多4张MI350P,面向万亿参数模型与数百Agent工作流

AMD Threadripper Halo Station是IFA 2026首次展示的桌边AI工作站原型,最高…

0

Microsoft Project Zenith – 面向本地AI的开箱即用Windows开发体验

64GB以上统一内存、250GB/s带宽起步,为本地模型与安全Agent准备开发环境

Project Zenith是微软面向开发者级设备打造的预配置Windows体验,要求64GB以上统一内存和2…

0

Qwen3.8-27B – 24GB显存可尝试的开源多模态Agent模型

推荐!把前沿Coding与Agent能力压缩到27B尺寸,本地部署和强能力第一次真正靠近

Qwen3.8-27B是27B Dense开源多模态模型,强化Coding、工具调用与长程Agent,4bit…

0

MiniMax H3 Max – 5秒视频不到3秒生成的实时AI视频模型

fal基于开源MiniMax H3后训练,原生音画同步且生成快过播放

fal 基于开源 MiniMax H3 后训练的高速原生音画同步视频模型,可在不到3秒内生成5秒、768P带声…

0

MiniMax – 模型、视频、语音和 Code 都覆盖的全能 AI 平台

MiniMax 的官方平台入口,模型、产品、API 和研究内容都能在这里找到。

MiniMax 是一个覆盖模型、视频生成、语音音乐、MiniMax Code 和 API 的全能 AI 平台,…

0

Qualcomm 6G – 高通AI原生6G技术专题

从设备到数据中心,理解AI原生网络如何融合连接、感知与计算

高通官方6G研究专题,覆盖AI原生网络、Giga-MIMO、通信感知一体化、NTN及端边云分布式计算。

0

Ollama – 把开放大模型装进自己电脑,也能随时切换云端算力

推荐!从本地离线推理到云端大模型,用一套命令和API接通应用、编辑器与Agent

推荐!一条命令下载并运行开放大模型,用本地REST API接入应用和Agent;电脑算力不够时,还能无缝调用O…

0

CuspAI – 用智能体AI加速新材料发现与实验验证

把生成式设计、原子模拟、合成路线与实验室验证连接成新材料研发闭环

CuspAI通过MIRA智能体平台连接材料生成、模拟、合成规划和实验验证,并联合45+伙伴建设AI Mater…

0

GPT-6 Astra – OpenAI旗舰推理、编程与计算机操作模型

面向高难度端到端任务的旗舰Agent模型与开发接口

GPT-6 Astra是OpenAI面向复杂推理、软件工程、计算机操作、研究和专业工作的旗舰模型,支持105万…

0

Agnes AI – 全模态模型、AI Agent 与免费 API 平台

覆盖文本、图像、视频与推理模型,连接 AI Agent、编程、短剧创作和开发者 API

Agnes AI 是覆盖文本、图像、视频、AI Agent 和开发者 API 的全模态平台,旗下包括 Agne…

0
所有的成功,都源自一个勇敢的开始
不辜负每一个勇敢的开始
做视频AI导航网 © 2026闽ICP备16009488号-1