《科创板日报》8 月 31 日讯 今日,腾讯混元发文称,为保障使用体验,已针对 Hy4 preview 推理集群进行紧急扩容,并将持续动态调配资源。
关于紧急扩容的原因,腾讯混元表示,自 2026 年 8 月 28 日混元 Hy4 preview 在 WorkBuddy 首发接入以来,凭借其 Agent 能力的显著提升,受到了广大用户与开发者的积极体验和热情反馈,上线首日即在 WorkBuddy 任务队列中出现排队情况。
与此同时,腾讯混元为排队情况提供了过渡方案:一是切换到 Hy3 等其他模型继续使用:Hy3 当前 WorkBuddy 限免将延长至 2026 年 9 月 30 日 23:59;二是将非紧急需求错峰调至晚间时段使用。

图源:腾讯混元
不过,腾讯混元提醒道,受限于高端算力总量与高峰并发集中,仍不排除个别时段会继续出现排队情况。此外,由于 Hy4 preview 为大语言模型,暂不具备多模态生成能力,当发起生图、视频等任务时,系统会自动切换到其他多模态模型执行。
华创证券指出,Hy4 preivew 模型,在模型尺寸(总参数 770B)、上下文长度(1M)、数据规模上较 Hy3 提升显著;与 GLM-5.3、Kimi K3 等一梯队开源模型相比,在多个 Benchmark 上跑分接近,在 Workbuddy 上盲测结果略优。API 价格每百万 tokens 输入(缓存命中)/ 输入 / 输出分别 0.3/6/18 元,Workbuddy 上免费两周,延续高性价比优势。
▌大模型持续火热 国产算力放量在望
伴随访问量大增,AI 模型陡然爆火,最终倒逼算力扩容,类似的情况已经屡见不鲜。
7 月 17 日,月之暗面正式发布 Kimi K3,其年化收入于次日从平缓波动区间陡然冲高,创下历史最大单日增幅。上线 48 小时后,Kimi K3 用户请求量大幅超出预估,一度抵达推理集群承载极限。公司不得不暂停 C 端新用户订阅,并全力推进算力扩容。
就在本月,DeepSeek V4 Flash 上线公测后不久,海外开源 AI Coding Agent 平台 OpenCode 发文称:DeepSeek V4 Flash 因前所未有的访问量而出现容量不足问题。随后,技术团队启动紧急扩容方案,并全力修复相关问题。
今年以来,国产大模型调用量总体呈持续攀升趋势。
根据 OpenRouter 最新数据测算,上周(8 月 24 日至 8 月 30 日)全球 AI 大模型总调用量为 113 万亿 Token,环比增长 21.11%,较年初增长 1928.73%。上榜的 AI 大模型中,国产大模型周调用量达 55.16 万亿 Token,环比增长 36.26%; 同期美国 AI 大模型周调用量为 17.07 万亿 Token。国产大模型周调用量连续十八周超过美国并稳居全球首位。

图源:OpenRouter
在国产大模型百花齐放之际,华创证券建议关注国内外模型竞争格局,以及头部厂商在高效架构、国产算力适配、办公 Agent 入口和开发者生态的商业化进展。该机构表示,在国产模型开源为主、性能提升加速、格局相对分散的趋势下,互联网平台有望延续企业数据与入口优势,在编程、办公等高价值场景中提升渗透率,MaaS 与云收入兑现提升资本开支回报。
广发证券分析称,Token 调用量快速增长,且需求正由简单问答向 Coding、Agent、多模态生成和复杂知识工作迁移,带动模型 API、云算力及 AI 应用需求持续扩张。单位 Token 价格下降进一步降低了应用门槛,并推动调用量和使用场景增长。后续,国产大模型 Tokens 快速的增长有望推动国产 AI 芯片和服务器产品的快速放量。
该机构进一步指出,国内算力供需失衡格局下高端 GPU 采购价格不断上行,进一步推高了企业自建算力集群的初始资本开支,算力租赁由此成为现阶段国内获取高端算力资源的重要补充供给方式。对于算租厂商而言,还具备稳定现金流、高硬件残值等优势。看好后续 token 分成的商业模式。
开源证券近日研报指出,大模型 C 端应用规模化扩张、B 端私有化部署加速及边缘推理场景渗透,将驱动推理算力需求指数级增长,推理成本持续下探进一步释放中小客户需求,国产算力推理场景增速预计高于训练场景,国产大模型与芯片的协同渗透率持续提升。
其表示,供给侧看,2026 年上半年国产芯片龙头通过大幅提升存货与预付款规模,锁定上游原材料及委托加工产能以保障订单交付,寒武纪、海光信息等核心厂商存货较 2025 年末实现显著增长,推理算力赛道供需共振下,AI 算力产业链上下游均有望迎来业绩释放机遇。
阅 1.34W+ 特别声明:文章内容仅供参考,不构成投资建议。投资者据此操作风险自担。


登录后才可以发布评论哦
打开小程序可以发布评论哦