财联社-深度 昨天
Cerebras推出CS-4系统强势对标英伟达,称其推理速度可达GPU服务器的30倍
index.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

财联社 8 月 19 日讯(编辑 李莹)AI 芯片公司 Cerebras System 于当地时间周二发布了全新机架式 AI 系统 CS-4,该公司称,CS-4 系统在单用户场景下,每秒输出 token 的能力可达传统 GPU 服务器的 30 倍。

CS-4 系统面向大模型推理赛道,直接对标英伟达的 GPU 服务器产品。

值得注意的是,该 30 倍结果来自厂商内部自测,衡量的是整机资源全部供给单一用户时的文本生成速度,并非整机同时服务大量用户的总吞吐性能。

当地时间周二,Cerebras 在旧金山举办的活动上表示,这款名为 CS-4 的系统目前已向少量客户提供样品,将于今年第三季度晚些时候扩大供货范围。

Cerebras CS-4 内置 3 颗 WSE-3 Turbo 晶圆级处理器。公司表示,WSE-3 Turbo 是迄今为止规模最大的 AI 处理器,集成了 4 万亿个晶体管。

业内指出,这套系统面向 AI 推理,而非模型训练。它采用静态随机存取存储器(SRAM),而非行业常用的动态随机存取存储器(DRAM)。

SRAM 速度远高于 DRAM,但结构复杂,体积更大、成本更高。普通小型处理器几乎无法使用 SRAM。而 Cerebras 的 WSE-3 Turbo 晶圆处理器有餐盘大小,为使用 SRAM 提供了充足物理空间。

公司还表示,Cerebras 处理器为单片完整芯片,相比英伟达、AMD 由多颗芯片拼接的方案,数据传输距离更短。

Cerebras 将快速生成结果作为自身核心竞争亮点。该公司称,其巨型芯片可存储 AI 模型所需全部参数数值,无需通过链路访问存储芯片调取数据,运算流程得以大幅提速。

Cerebras 首席执行官 Andrew Feldman 在声明中指出:

" 过去想要实现高速推理,只能选用能力较弱的小型模型。CS-4 在前沿大模型上实现行业顶尖速度,从根本上改变行业范式。"

"CS 4 整套系统的设计全部围绕高速度、大吞吐量优化。搭载 CS-4 之后,AI 的响应速度足以重塑产品体验。"

Andrew Feldman 在周二的活动现场表示,新机型设计有助于 Cerebras 应对激增的市场需求:一方面该系统无需目前供给紧缺的存储芯片;另一方面其采用普及度更高的生产工艺,因此公司能够更快完成设备部署。

业内指出,此次产品迭代,是该公司在 AI 数据中心硬件市场向英伟达发起挑战的重要一步。

股价承压

Cerebras 于 5 月完成 IPO,发行价 185 美元,开盘价 350 美元,但此后股价大幅回落。美东时间周二,股价收跌 12.69% 报 220.01 美元。

Cerebras 上周三盘后发布上市以来的第二份财报,财报显示,Cerebras 第二季度总营收同比增长 74.3% 至 1.8 亿美元,低于分析师预期的 1.94 亿美元。

Cerebras 同时上调了全年营收指引,将 2026 年调整后营收从 8.55 亿到 8.65 亿美元上调至 8.8 亿到 8.9 亿美元,全年调整后毛利率预期从 38%-41% 上调至 41%-43%。

业内指出,作为备受瞩目的 AI 芯片公司,Cerebras 财报中的任何业绩数据下滑,都可能导致投资者质疑其能否从英伟达手中抢占市场份额。

评论
大家都在看