热点科技 6小时前
从迷你主机到AI集群,AMD在2026云栖大会展示算力落地新形态
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

生成式 AI 继续向实际业务渗透之后,算力需求正在变得更分散。大模型训练仍然需要大规模数据中心,但推理开始进入企业终端、本地工作站乃至边缘设备;与此同时,AI 集群规模扩大,也让 CPU、GPU、内存、网络以及软件栈之间的配合变得更加重要。

在 2026 云栖大会现场,AMD 展区给出的答案并不是单独展示某一颗处理器,而是把本地 AI、AI PC、数据中心 CPU、AI 加速器以及高速网络放在同一套展陈逻辑中。从搭载锐龙 AI Max 平台的迷你主机,到第五代 EPYC 服务器处理器,再到 Instinct MI308X 与 Pensando Pollara AI NIC,现场产品基本覆盖了 AI 工作负载从端侧运行到数据中心集群的多个环节。

  2026 云栖大会 AMD 展区

本地 AI 成为现场重点,锐龙 AI Max 把大模型带到桌面

如果只看今年现场最容易被观众直接体验到的部分,本地 AI 无疑是重点之一。AMD 展区摆出了多套由合作伙伴打造的迷你主机、AI 工作站和本地 AI 解决方案,现场还能直接运行大模型、AI 办公等应用。和过去把 AI PC 更多理解为 " 多了一颗 NPU" 相比,这类设备更强调 CPU、GPU、NPU 以及大容量统一内存协同工作。

  本地 AI 演示平台

其中,锐龙 AI Max+ 395 是现场多套方案采用的核心平台之一。AMD 官方资料显示,这颗处理器采用 Zen 5 架构,提供 16 核 32 线程 CPU,集成 40 个计算单元的 Radeon 8060S 图形核心,并配备 XDNA 2 NPU;整个平台最高可提供 126 TOPS AI 算力,其中 NPU 最高为 50 TOPS。平台最高支持 128GB LPDDR5x 内存,这一点对于需要在本地加载较大模型的设备尤其关键。

现场展出的六联、联想、极摩客、超聚变等不同形态设备,也让这套平台的定位更加直观:本地 AI 并不只对应传统笔记本,一些过去需要较大工作站才能承担的推理、内容生成或开发任务,正在尝试被压缩到更小的桌面设备里。

  搭载 AMD 平台的合作伙伴迷你主机

CPU 仍是 AI 基础设施的重要一环,第五代 EPYC 面向高密度计算

从桌面转向数据中心,AMD 此次也展示了第五代 EPYC 平台。AI 时代的注意力经常被 GPU 吸走,但在真实的数据中心里,CPU 依旧承担着系统调度、数据预处理、通用计算以及大量云原生业务。尤其当 AI 训练、推理与传统计算混合部署时,服务器 CPU 的核心密度、内存能力和能效都会直接影响整机与机架的配置。

  AMD 合作伙伴桌面计算设备及本地 AI 解决方案

AMD 第五代 EPYC 9005 系列基于 Zen 5 和 Zen 5c 架构,覆盖不同核心规模和功耗区间。现场可以看到 EPYC 处理器实物以及多块服务器主板和平台方案。相比单独强调某一个性能数字,这部分展陈更像是在说明 AMD 数据中心业务的另一条主线:GPU 负责高并行 AI 计算的同时,EPYC 继续承担通用计算底座,并与加速器、网络等组件共同组成完整服务器平台。

  AMD 平台迷你主机与工作站产品现场展陈

MI308X 亮相:大模型训练与推理继续向加速计算集中

AI 计算的另一端,则是 Instinct 加速器。现场展示了 MI308X 相关系统以及单 OAM 模块,从展陈形态上就能看到数据中心 AI 加速器与消费级显卡完全不同的设计思路:它并不是独立面向个人用户使用,而是围绕服务器、互连、散热以及集群部署来构建。

随着模型规模和上下文长度不断增加,AI 基础设施面对的问题已经不只是 " 算得快不快 "。模型能否装得下、数据能否及时送到计算单元、多个加速器之间能否高效协同,都会影响最终吞吐量。也正因为如此,AMD 近年的数据中心 AI 布局正在从单颗 GPU 性能,进一步延伸到整机平台、软件生态和集群级连接。

  AMD Instinct MI308X 单 OAM 模块

AI 集群规模变大之后,网络也开始进入 " 算力 " 讨论

在这批现场展品里,Pensando Pollara AI NIC 值得单独拿出来看。它的存在很容易被 CPU 和 GPU 抢走注意力,但当一个 AI 任务需要成百上千颗加速器共同工作时,网络传输效率会直接影响计算资源能否被充分利用。

AMD 将 Pollara 定位为面向 AI 基础设施的高速以太网网卡方案,现场展出的 Pollara 400 AI NIC 面向 400Gbps 级网络连接。它所对应的并不是普通办公网络,而是 AI 集群内部大量节点之间持续的数据交换。对于越来越大的训练和推理集群而言,网络延迟、拥塞控制以及数据传输效率,已经成为系统级性能的一部分。

把 EPYC、Instinct 与 Pensando 放在同一个展区来看,也更容易理解 AMD 现在强调的 " 全栈 " 含义:处理器、加速器和网络并不是各自独立的产品线,而是在数据中心里共同决定一套 AI 基础设施能跑到什么程度。

  AMD Pensando Pollara AI NIC 网卡

热点科技洞察:AI 算力的竞争,正在从单颗芯片走向整套系统

这次云栖大会 AMD 展台给人的一个明显感受,是 AI 已经很难再用单一硬件品类来概括。桌面端需要考虑模型能不能在本地跑起来,因此统一内存容量、GPU 能力和 NPU 都变得重要;到了数据中心,GPU 之外还要看 CPU、网络、服务器设计以及软件栈。不同场景的侧重点并不相同,但最终都指向同一件事——如何让数据更顺畅地进入计算环节,并让算力真正被利用起来。

锐龙 AI Max 平台的意义也不只是把 AI 算力数字继续往上推。128GB 级统一内存和较强的集成 GPU,让小型设备有机会承接过去更依赖独立显卡或云端资源的工作负载。现场大量迷你主机和本地 AI 演示说明,厂商已经开始尝试把这类能力做成可以直接部署的产品,而不只是停留在处理器参数表上。

数据中心侧则是另一套逻辑。EPYC、MI308X 和 Pollara AI NIC 分别对应通用计算、AI 加速和集群网络,它们被放到一起,反映出 AI 基础设施竞争正在逐渐从 " 谁有更快的一颗芯片 ",转向 " 谁能把一整套系统更高效地跑起来 "。对 AMD 而言,这也是其当前 AI 战略中更值得观察的部分:一边把 AI 能力下沉到本地设备,一边继续补齐云端计算与互连环节。

从云栖大会的现场展示来看,本地 AI 与数据中心 AI 并不是两条互相割裂的路线。模型可能在云端完成训练,再进入企业工作站、AI PC 或边缘设备执行推理;终端产生的数据,又会回到云端参与新的计算流程。随着这种循环越来越频繁,未来的算力竞争或许不会只围绕 CPU、GPU 或 NPU 中的某一个名字展开,而会更多落到平台协同、数据流动和实际部署效率上。

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai amd 数据中心 第五代 云栖大会
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论