全天候科技 1小时前
小模型“抢走”云端算力需求,万亿美元数据中心资本开支面临考验
index.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

AI 应用持续扩张,但支撑这轮热潮的超大规模数据中心投资,正面临新的需求端挑战。

杰富瑞报告指出,随着小型语言模型性能提升、成本下降,企业 AI 部署可能从集中式云端转向本地化,由此对云端算力需求以及巨额数据中心资本开支形成压力。

这一判断的一个重要依据,是近期对 AI 服务器实际使用情况的观察。2026 年 9 月,Swerve Research Technologies 通过追踪 Anthropic 服务器请求队列的等待时间构建 " 拥堵指数 ",发现相关服务器利用率较 2026 年 1 月至 2 月的峰值下降 26%。这一指标并不能直接对应公司收入,但如果利用率持续走低,可能意味着部分算力供给开始出现闲置。

与此同时,AI 基础设施投资仍在快速扩张。市场目前预计,Meta、Alphabet、亚马逊和微软四家美国科技巨头 2027 年资本支出合计可能达到 9900 亿美元。报告认为,如果 AI 算力需求增速最终无法匹配如此庞大的投资规模,部分数据中心可能面临回报不足甚至成为 " 搁置资产 " 的风险。

服务器利用率下降,AI 算力供给面临考验

Meta 旗下个人 AI 产品 Muse 于 9 月 8 日上线后,推动 Meta 股价在数周内上涨 21%,成为近期 AI 消费应用的亮点。但报告认为,单个应用的成功并不足以证明整个 AI 基础设施投资周期能够持续。

更值得关注的是,AI 企业自身也释放出一些不同于市场乐观预期的信号。Anthropic CEO、OpenAI CEO Sam Altman 以及 Elon Musk 近期均曾公开讨论放缓 AI 发展的必要性;Anthropic 原计划中的 IPO 则推迟至 11 月。

与此同时,Anthropic 此前已与 SpaceX 签署价值 450 亿美元、为期三年的算力合同,并与亚马逊、谷歌云达成数十亿美元级别的算力合作。如果 AI 收入增速放缓,而此前签订的大规模算力合同仍需持续兑现,企业的成本压力可能进一步上升。

据报道,Meta 还在 7 月与 Anthropic 谈判,拟在两年内向其出租最高 100 亿美元的数据中心算力。报告认为,大型科技公司开始积极寻找外部客户消化算力,也反映出随着基础设施供给快速扩张,如何提高资产利用率正成为新的问题。

小模型性能追赶,本地部署或分流云端需求

相比服务器利用率的短期变化,报告更加关注 AI 模型架构正在发生的变化。

斯坦福大学与 Together AI 联合发布的《Intelligence per Watt》研究显示,小型语言模型的性能正快速追赶大型语言模型,同时能耗和算力成本低 50% 至 85%。如果这一趋势延续,企业部署 AI 所需的算力规模和成本结构都可能随之改变。

过去,企业更多依赖集中式云端大模型完成 AI 任务;随着小模型能力提升,部分场景可能转向本地部署。对于银行等对数据安全要求较高的行业,本地化部署本身已有较强需求;当小模型进一步降低部署成本后,这一模式的适用范围可能继续扩大。

这意味着,AI 应用增长并不必然对应云端算力需求同比例增长。企业可能一边扩大 AI 应用,一边减少对超大模型 API 和集中式云端算力的依赖。

这也是报告质疑近万亿美元资本开支的重要原因:如果未来更多 AI 应用由低成本、小规模、本地化模型承载,那么当前围绕超大规模数据中心形成的投资规模,可能与实际算力需求出现错配。

在这一情景下,真正需要重新评估的并非 AI 需求是否存在,而是 AI 需求究竟需要多少集中式算力,以及这些数据中心能否获得与其投资规模相匹配的回报。

评论
大家都在看