星途科讯 1小时前
Arm发布C2-Ultra架构:AI性能翻倍,定义2027旗舰标准
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

移动 AI 的讨论长期聚焦于 NPU、TPU 等专用加速器,但 Arm 正试图证明通用 CPU 同样能担此重任。Arm 最新发布的 C2-Ultra 架构,有望成为 2027 年旗舰智能手机的新基准,覆盖从联发科、三星到谷歌未来 Tensor 芯片组的广泛生态。

这一战略转变标志着 Arm 从单纯追求时钟频率和流水线宽度,转向加速特定专业用例。尽管市场对峰值通用性能的需求尚存变数,但在移动设备与 PC 场景融合的背景下,这一调整颇具深意。

C2-Ultra:能效与架构的双重进化

作为去年 C1-Ultra 的继任者,C2-Ultra 预计将搭载于 2027 年初推出的下一代三星 Exynos 和联发科 Dimensity 芯片中,并可能出现在谷歌 Tensor G7 芯片组里。

在性能方面,C2-Ultra 峰值性能较前代提升 15%。其中,时钟频率提升至 4.45GHz 贡献了 8% 的增幅,其余 7% 源于架构改进。更关键的是,得益于 2 纳米制程工艺,C2-Ultra 在维持同等性能水平时,功耗降低了 38%。此外,其 L2 缓存容量上限增至 3MB,为以面积换性能的处理器设计提供了更大空间。

值得注意的是,C2-Ultra 的流水线宽度保持不变,性能提升并非依赖单周期处理量的增加,而是通过将执行窗口扩大 30%(从 2000 条指令增至约 2600 条),并增强乱序执行机制来实现。这种更智能的推测执行和数据依赖检测,减少了等待数据的时间,从而在提升执行效率的同时降低功耗。

相比之下,C2-Premium、C2-Pro 和 C2-Nano 核心架构未作大幅改动,主要针对 2 纳米生产线进行了面积、效率和功耗优化。

CPU 加速 AI:性能提升高达 1.7 倍

AI 加速是 C2 系列的核心亮点。Arm 宣称,通过加速低精度数学运算并利用查找表指令(LUTi)降低内存带宽需求,新一代 CPU 配置可使 AI 模型性能提升高达 1.7 倍。

这一提升通过在共享 CPU 集群中部署两个可扩展矩阵扩展(SME2)单元实现,而去年仅支持一个。虽然小米 XRING O3 已在 C1 架构上支持双 SME2,但 Arm 此次将其作为参考标准推广。SME2 作为常规 CPU 指令管道的一部分执行,无需开发人员额外适配即可享受加速红利。此外,SME2 单元的时钟频率从 2GHz 提升至 3GHz,进一步释放 AI 算力。

实际应用场景中,Arm 基准测试显示:语音转文本延迟减少 40%,实现近乎即时的识别;内存检索搜索速度提升 41%,加快用户偏好回忆;首个令牌生成时间缩短 25%,显著提升端侧大模型的响应速度。

终端落地:联发科或首发 12 核配置

Arm 仅提供核心 IP,最终配置由芯片合作伙伴决定。参考设计显示,旗舰方案可能采用 2 个 C2-Ultra 核心(峰值 4.45GHz)搭配 6 个 C2-Pro 核心(3.6GHz),而入门级设备则可能使用 2 个 C2-Pro 和 4 个 C2-Nano 组合。

借鉴过往产品节奏,2025 至 2026 年的高端芯片将普遍采用 " 超大核 + 大核 " 的组合策略,并在超高端型号中配备双 SME2 单元以强化 AI 性能。Arm 透露,预计今年晚些时候将有合作伙伴推出 10 至 12 核的 CPU 配置,业界猜测这很可能指向联发科 Dimensity 9600。随着 2027 年临近,更多厂商的跟进计划值得密切关注。

【星途科讯 图文丨王宇洲 首发于 ZAKER 科技,转载请注明出处】

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

arm ai 谷歌 联发科 三星
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论