做视频AI导航网
做视频AI导航网
AI导航
  • 热门工具
  • Agent智能体
  • Skills技能
  • AI大模型
  • AI创作
  • AI工具集
视频Video
  • 素材下载
  • 创作灵感
Github神器
  • 导航
  • 资讯
  • 视频素材
  • 视频模版
  • 音乐音效
  • Luts调色预设
  • 整合包
首页/
打开 MD 链接

AMD Threadripper Halo Station - 2.6TB内存的桌边AI工作站

11
96核Threadripper PRO配合最多4张MI350P,面向万亿参数模型与数百Agent工作流
评分
产品状态:IFA 2026原型展示,官方标注2027年推出处理器:最高96核、192线程Threadripper PRO 9995WX加速器:最多4张AMD Instinct MI350PGPU内存:最高576GB HBM3e系统内存:最高2TB RDIMM,总内存约2.6TB适合场景:大型模型推理、微调、多Agent并发与本地私有AI
AMD Threadripper Halo Station是IFA 2026首次展示的桌边AI工作站原型,最高…
Ai硬件|AI PC·AI工作站·AMD Ryzen AI·Threadripper Halo Station·本地AI

产品定位

Threadripper Halo Station是一台把数据中心级AI算力放到桌边的工作站原型。它面向无法完全装进普通AI PC、又希望避免共享云端环境的大模型推理、微调和高并发Agent任务。

最高配置

  • CPU:96核、192线程Ryzen Threadripper PRO 9995WX。
  • GPU:最多4张Instinct MI350P工作站加速器。
  • HBM:最高576GB HBM3e GPU内存。
  • 系统内存:最高2TB DDR5 RDIMM,总内存容量约2.6TB。
  • 带宽:官方最高标称16.4TB/s总内存带宽。
  • 散热:原型采用液冷方案,整机配置可能因制造商而异。

能做什么

大容量内存允许系统保持更大的模型、上下文和并发缓存,适合万亿参数级模型的量化推理、LoRA微调、多个Agent长期运行,以及需要将敏感数据留在本地的企业研发。

部署建议

  1. 先按模型权重、KV缓存、并发和训练优化器估算真实内存需求。
  2. 明确单机推理、微调还是团队共享服务,避免为参数规模盲目堆硬件。
  3. 规划供电、液冷、噪声、机房温度和高带宽存储。
  4. 设置用户隔离、凭据管理、作业队列和监控,工作站也应按服务器治理。
  5. 用每小时有效Token、并发成功率和三年总拥有成本与云端方案比较。

上市状态

AMD将其描述为IFA 2026首次展示的原型系统,官方页面标注2027年推出。最终售价、整机厂商、地区、加速器数量和软件认证仍可能变化。

使用提醒

“能装下万亿参数模型”不代表能以交互速度运行所有万亿参数模型。量化方式、互联带宽、并行策略、上下文长度和软件优化都会显著影响实际性能。

常见问题(FAQ)

Threadripper Halo Station是什么?
它是AMD在IFA 2026首次展示的桌边AI工作站原型,面向超大模型、本地微调和高并发Agent工作流。
Threadripper Halo Station有多少内存?
官方最高配置为2TB RDIMM系统内存和576GB HBM3e GPU内存,总容量约2.6TB。
它配备几张GPU?
官方最高配置使用4张AMD Instinct MI350P;不同整机厂商和实际产品配置可能不同。
它现在可以买到吗?
官方页面标注2027年推出,目前属于预告与原型展示阶段,售价和地区尚需等待。
它能流畅运行万亿参数模型吗?
大容量内存有助于装载万亿参数级模型,但速度仍取决于量化、互联、软件优化、上下文和并行策略。
0 讨论
热门最新
总结
暂无总结
0 / 600
细中粗

相关网站

热门最新

AMD Ryzen AI Halo – 128GB统一内存的本地AI开发平台

支持Windows与Linux、ROCm和2000亿参数模型,下一代版本将升至192GB内存

AMD Ryzen AI Halo是面向本地AI开发与推理的紧凑型平台,当前型号配备Ryzen AI Max+…

0

Microsoft Project Zenith – 面向本地AI的开箱即用Windows开发体验

64GB以上统一内存、250GB/s带宽起步,为本地模型与安全Agent准备开发环境

Project Zenith是微软面向开发者级设备打造的预配置Windows体验,要求64GB以上统一内存和2…

0

CuspAI – 用智能体AI加速新材料发现与实验验证

把生成式设计、原子模拟、合成路线与实验室验证连接成新材料研发闭环

CuspAI通过MIRA智能体平台连接材料生成、模拟、合成规划和实验验证,并联合45+伙伴建设AI Mater…

0

INT21 – AI自我改进与自动化研究平台

用多Agent在真实GPU上生成、测试和优化推理引擎与Kernel,以硬件性能作为验证信号。

用多Agent在真实GPU上生成、测试和优化推理引擎与Kernel,以硬件性能作为验证信号。

0

元空AI Work – 本地离线运行的端侧办公Agent

把模型、Agent Runtime 与办公工作流装进本地设备

元空AI Work 是面向数据、文件、文档和办公工作流的端侧AI生产力平台,支持本地模型、Agent Runt…

0

Loomy官网直达 – 讯飞这款会操作网页、跑办公任务的本地AI工作搭子

推荐!不用折腾复杂部署,把网页、本地文件、Skills、定时任务和远程协作交给一位会真正执行工作的桌面AI搭子

推荐!讯飞Loomy把网页代操作、本地文件、定时任务、Skills和国内协作工具接进桌面Agent,适合让AI…

0

GPT-6 Astra – OpenAI旗舰推理、编程与计算机操作模型

面向高难度端到端任务的旗舰Agent模型与开发接口

GPT-6 Astra是OpenAI面向复杂推理、软件工程、计算机操作、研究和专业工作的旗舰模型,支持105万…

0

Qwen3.8-27B – 24GB显存可尝试的开源多模态Agent模型

推荐!把前沿Coding与Agent能力压缩到27B尺寸,本地部署和强能力第一次真正靠近

Qwen3.8-27B是27B Dense开源多模态模型,强化Coding、工具调用与长程Agent,4bit…

0

Screenpipe – 把每天的电脑操作沉淀成可搜索记忆与自动执行Agent

推荐!在本机记录屏幕、会议与应用上下文,把真实工作轨迹变成可搜索记忆、SOP和自动执行Agent

推荐!在本机记录屏幕、会议与应用上下文,把真实工作轨迹变成可搜索记忆、SOP和能按事件自动运行的AI智能体。

0

Qualcomm 6G – 高通AI原生6G技术专题

从设备到数据中心,理解AI原生网络如何融合连接、感知与计算

高通官方6G研究专题,覆盖AI原生网络、Giga-MIMO、通信感知一体化、NTN及端边云分布式计算。

0
所有的成功,都源自一个勇敢的开始
不辜负每一个勇敢的开始
做视频AI导航网 © 2026闽ICP备16009488号-1