AMD在2026年柏林IFA上展示了Threadripper Halo Station:一台仍处于原型阶段的液冷桌边AI工作站。它瞄准开发者、科研人员及有专业需求的机构,核心卖点是让超大模型在本地环境运行,而非完全依赖云端。AMD称,最高内存配置可在无需连接云端的情况下运行参数量超过1万亿的AI模型。
4
7
不过,这一说法属于AMD对最高配平台能力的定位与容量主张。某个具体的万亿参数模型能否真正高效使用,还取决于模型架构、精度或量化方式、执行的是推理还是训练任务,以及软件支持情况。
一台“个人超级计算机”,但并非普通台式机
AMD将Halo Station定义为一类新的工作站,并以“个人超级计算机”来描述其定位:将接近超级计算机级别的算力带给个人用户与开发者。
4
12
但这里的“个人”并不意味着面向一般消费者。这是一台针对高吞吐量本地AI推理和开发场景设计的专业设备。AMD在IFA的资料中明确表示,其目标是突破本地训练和运行大型模型时的瓶颈。
16
本地部署的价值主要在于控制权:团队可以将提示词、数据集和模型工作流留在自己的基础设施内,而不是交由托管云服务处理。对涉及敏感数据的研发或企业场景而言,这一点尤其重要。
硬件规格:96核CPU,最多4张Instinct加速器
平台核心是AMD Ryzen Threadripper PRO 9995WX,拥有96个核心、192个线程,并支持最高2TB DDR5 RDIMM系统内存。
4
11
AI计算部分最多可搭载4张AMD Instinct MI350P加速器。每张MI350P配备144GB HBM3e高带宽内存,因此四卡最高配置将提供576GB加速器内存。
4
24
AMD给出的平台上限数据包括:
- 最高2.6TB组合内存;
- 最高16.4TB/s总系统内存带宽;
- 最多4张配备HBM内存的Instinct级加速器。
7
对于大模型工作负载而言,内存容量和带宽并非附属参数。模型权重与运行过程中的工作数据必须尽可能留在高速本地内存中,算力才能得到有效利用。
IFA现场展示的是双卡原型,不是四卡满配
AMD在IFA现场展示的液冷原型机配有两张MI350P,对应288GB HBM3e。这与其规划中的四卡上限——576GB HBM3e——需要明确区分。
3
14
AMD官方将Halo Station称为原型系统,称其首次在IFA 2026亮相,目的是把数据中心级AI计算能力整合到一台桌边工作站中。
7
对标NVIDIA DGX Station:比的不只是参数
Halo Station瞄准的是与NVIDIA DGX Station相近的产品类别:在工作站形态中提供大量AI计算资源,使机构不必为所有任务部署完整机架式服务器。AMD特别强调的差异,是把Instinct数据中心加速器带入桌边工作站形态。
7
12
AMD还以最高配置与DGX Station参考平台进行总内存容量比较,并宣称自身具有优势;但这属于AMD基于相应配置作出的对比,并非独立第三方性能测试。
25
对实际采购而言,内存容量只是决策的一部分。软件生态、框架与模型兼容性、工作负载调优、售后支持、电力和散热条件,以及实测性能,同样会影响最终选择。
ROCm生态将是关键变量
该系统预计采用AMD的ROCm软件生态,服务于AI和高性能计算工作负载。ROCm可视作AMD面向开发者的CUDA替代型计算软件栈;潜在用户仍需验证自身使用的框架、工具链和模型是否获得良好支持。
27
因此,Halo Station并不是一台“把AI装进办公室就万事大吉”的通用电脑。它更适合拥有高强度AI需求、专业运维能力和相应预算的机构及专业人士。
价格与上市细节仍待公布
截至发布时,AMD尚未公布最终售价、完整配置列表或具名OEM合作伙伴。
26
28 AMD相关信息显示,该平台预计于2027年推出,但具体上市路径和最终整机形态尚未披露。
25
媒体估算,一套配置得当的系统价格可能在10万至15万美元之间;这并非AMD官方定价,只能视为基于硬件规格作出的市场预估。
23
Halo Station当前的意义,更多在于AMD正尝试开辟一个本地AI工作站层级:用一台置于桌边的设备,提供足够的CPU核心数、加速器内存和带宽,让一部分前沿级大模型工作负载从云端回到机构自己的环境中。