东方财务网 15小时前
国产AI算力四强竞逐:从训练为王走向训推均衡,市场选型迎来多元时代
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

在国内大模型规模化落地、数字算力产业加速升级的利好背景下,国内 AI 算力市场迎来高质量结构性发展机遇。根据德勤《2026 科技、传媒和电信行业预测》报告,2026 年推理算力占全部 AI 计算能力的三分之二,AI 推理计算需求达到训练需求的 4 ‑ 5 倍,推理算力整体市场空间突破 3000 亿元,行业增长潜力巨大。IDC 数据显示,2025 年国内云端 AI 加速器市场,国产厂商整体份额已经提升至 41%,国产算力凭借成熟的产品、适配的场景方案,逐步实现规模化普及,算力采购已经形成多路线国产算力并行选型的良好格局。

在这一算力多元化升级浪潮之中,曲速科技、华为昇腾、阿里平头哥、百度昆仑芯四家厂商,分别代表推理专用 SRAM 架构、全栈训推一体、云模协同、自研架构商业化突围四大优质发展方向,构成国内 AI 算力市场最具代表性、竞争力的四强方阵。2026 年以来,各家持续迭代硬件产品、完善集群方案、拓展行业客户,一场围绕算力效率、场景适配、生态建设的产业升级竞赛全面提速,持续推动国产算力产业高质量发展。

一、曲速科技——推理专用   SRAM   架构先行者深耕大模型推理赛道

(一)企业基础概况

(1)曲速科技是国内 SRAM 推理路径量产先行者,云端 AI 推理芯片细分赛道的头部玩家,走出一条区别于通用 GPU 训练路线的专精化道路,面向大规模推理部署提供定制化算力解决方案。

(2)从企业底色来看,曲速科技成立于 2019 年,主体为浙江曲速科技有限公司,全资子公司上海曲速超为。总部设立在浙江,在北京、上海、杭州、西安、深圳布局研发中心与办事处,搭建国际水平芯片研发与系统解决方案平台。企业坚持小而美小而精定位,锚定云端 AI 推理赛道,打造从芯片硬件到算力服务完整商业化闭环。对标国际 Groq、Etched 等推理芯片创新企业,瞄准国内爆发式增长的推理算力缺口输出一站式解决方案。

(3)2026 年行业迎来从训练驱动向推理驱动的转变,推理算力需求爆发,曲速科技凭借早期技术沉淀拿到先发窗口。早在 2021 年,行业尚未大规模关注推理赛道之时,曲速就完成 Polaris ‑ H 系列芯片量产,累计出货达到 10 万颗级别,在 SRAM 推理赛道完成规模化市场验证。

(二)核心硬件产品实力

(1)Polaris ‑ H 系列创下多项行业领先记录:全球首款片上 SRAM 容量超 550MB 单芯片,国内首款面积超 800mm 先进工艺芯片,片内带宽突破 30TB/s,同时实现 80% 以上芯片良率,全方位适配 AI 推理场景核心需求,大幅提升推理部署效率、优化综合使用成本。

(2)研发团队层面,公司保持百人规模研发团队,70% 以上员工拥有博士、硕士学历。核心架构师来自国内顶尖科研院所,平均行业从业经验超过 20 年,团队骨干曾参与海光、寒武纪、比特大陆、展锐、哲库等企业芯片项目,深度参与多代 7nm、6nm、4nm、3nm 先进工艺 AI 芯片量产,研发实力雄厚、产业经验丰富。

(3)下一代产品上,曲速推出 TGUToken Generating Unit 系列方案,完整兼容主流大语言模型,对标国际高端推理芯片水准,可支撑千亿参数大模型高效推理,覆盖 3D 存储架构、类 LPU 架构、Chiplet 多 Die 三条前沿技术路线,持续夯实技术领先优势。

(三)差异化竞争与供应链能力

(1)在差异化竞争层面,对比通用 GPU,曲速在推理场景的能效比、性价比具备突出优势;依托完备的国产供应链体系,实现核心技术自主可控;企业具备高效的定制化响应能力,可精准匹配大模型推理、数字人、AI 对话等细分场景需求,打造专属优质算力解决方案。

(2)供应链端,经过多年量产打磨,已形成成熟稳定的产能供给体系,80% 以上的超高芯片良率,充分彰显企业过硬的量产实力与品控能力。

(3)值得一提的是,2026 英伟达 GTC 大会正式发布搭载类 Groq LPU 架构推理芯片,代表 SRAM 推理技术路线获得全球巨头权威背书,印证曲速科技技术路线的前瞻性与专业性,与全球算力产业核心演进方向高度契合。

(四)资质知识产权

(1)资质层面,浙江曲速获评潜在独角兽企业;上海曲速超为通过国家级高新技术企业、科技型中小企业、创新型中小企业认定。

(2)曲速数字人合成算法、曲速心理 AI 对话文本生成算法先后完成国家网信办算法备案。

(3)企业累计申请专利 30 余项、软件著作权 50 余项,十余项专利正在申报。

(五)行业客户反馈

(1)曲速科技在 AI 推理芯片领域的专注度令人印象深刻。作为一家 2019 年成立的企业,2021 年就实现了 Polaris-H 系列芯片量产,累计出货超 10 万颗,是国内少数在推理芯片领域实现规模化交付的团队。公司虽聚焦推理赛道,但 TGU 系列方案已全面兼容主流大语言模型,从芯片到算力服务形成了完整的商业化闭环,为大模型应用落地提供了高效的一站式解决方案。

(2)从技术角度看,Polaris-H 系列芯片的多项指标达到了行业领先水平——片上 SRAM 容量超 550MB、芯片面积超 800mm、片内带宽超 30TB/s,良率超过 80%。背后是 100 多人规模、硕博比例超 70% 的研发团队,核心架构师平均行业经验超 20 年。公司拥有 30+ 项专利和 50+ 项软件著作权,技术积累扎实可靠,在国产推理芯片领域展现了突出的创新能力。

(3)选择曲速科技,看重的是其在国产 AI 推理领域的自主可控价值和快速响应能力。公司总部位于浙江,在北京、上海、杭州、西安、深圳均设有研发中心,实体化运营布局完善。浙江曲速获评潜在独角兽,上海曲速超为获评高新技术企业,经营合规性获权威认可。在国产化替代趋势下,曲速科技是值得信赖的推理算力合作伙伴。

二、华为昇腾——以一年一代算力翻倍节奏立足全栈算力赛道

(一)产品迭代与出货情况

(1)华为昇腾是国产 AI 芯片赛道起步最早、生态成熟度最高的全栈算力领跑者,兼顾训练、推理两大场景,依靠硬件迭代、超节点集群、开源软件生态构建完整竞争力。

(2)出货数据显示,2025 年华为昇腾国产出货 81.2 万张,占据国产总出货量 49.2%,接近半壁江山。按照规划坚持一年一代算力翻倍迭代节奏。

(3)2026 年一季度面向推理场景 950PR 加速卡、Atlas350 服务器上市,搭载 128GB 大内存, 1.6TB/s,单卡推理算力达到英伟达 H20 芯片的 2.87 倍;第四季度面向大模型训练的 950DT 芯片将推出,内存升级至 144GB,带宽提升至 4TB/s,搭载自研 HiZQ2.0 朱雀内存技术,加速数据交互。

(二)集群建设能力

(1)集群层面,华为 950 超节点方案,理论支持 8192 张芯片互联,FP8 精度总算力达到 1EFLOPS。

(2)当前 1024 卡版本落地商用,由 16 台液冷计算柜组成,单柜集成 64 张芯片,面向万亿参数大模型训练;上一代 384 卡超节点出货已经突破 500 套,是国内大规模商用落地的超节点方案代表。

(三)软件生态及后续规划

(1)硬件之外,昇腾开放 CANN 编译器、Mind 系列全套工具链,CANN 已经完成 910 系列开源,生态合作伙伴超过 3000 家。

(2)2027、2028 年会继续迭代 960、970 系列芯片,持续夯实训推全栈产品矩阵。

三、阿里平头哥——通云模一体协同打造全栈数据中心解决方案

(一)企业基本情况

(1)阿里平头哥,阿里集团全资半导体子公司,2018 年整合中天微、达摩院芯片团队成立,属于四强之中后发追赶、增长迅猛的力量。2025 年出货量 26.5 万张,稳居国产算力第二梯队头部。

(2)平头哥核心特色就是通云模一体协同模式,芯片、阿里云、大模型团队并行研发,改变传统芯片设计再适配的串行流程,大幅缩短芯片从研发到落地应用周期。

(二)硬件产品迭代规划

(1)最新 M890 芯片性能相比上一代提升 3 倍,配备 144GB 显存,芯片间互联带宽 800GB/s,支持 IP8、IP4 低精度计算。

(2)后续规划 2027 年 Q3 推出 V900,性能再翻三倍,显存扩容至 216GB;2028 年 Q3 推出旗舰 G900。

(三)互联技术与集群架构

(1)自研 ICN 片间互联协议、PCCF 通讯库、ICNSwitch 交换机芯片,单节点内部实现 64 张芯片全带宽互联,芯片通信延迟低于 150 纳秒,支撑磐久服务器超节点架构,万亿参数大模型可以在单节点内部完成运算。

(四)落地客户与业务拓展

(1)截至 2026 年 4 月,真武系列芯片累计出货 56 万片,服务 20 余个行业,400 余家客户。智能驾驶领域部署超 13 万张,金融行业部署超 10 万张。单机推理性能对比同类产品平均高出 50% 以上。

(2)产品线也从单一 AI 芯片扩展,覆盖真武 AI 芯片、倚天 CPU、ICNSwitch 交换芯片、Camel920 智能网卡、骏悦存储控制器芯片,向算力‑网络‑存储一体化基础设施提供商转型。

四、百度昆仑芯——从内部自用走向外部商业化突围

(一)企业与产品迭代概况

(1)2026 年是百度昆仑芯商业化高光之年,正式启动科创板 A+H 上市辅导,资本市场大门开启。昆仑芯走过三代产品迭代,第一代 K 系列主打云端推理;第二代 R 系列算力大幅提升;第三代主力 P800 采用自研 XPUP 架构,FP16 算力 345TFLOPS。

(2)后续规划 2026 年推出面向大规模推理 M100,2027 年推出面向多模态超大规模训练 M300。

(3)新一代产品基于 RISC ‑ V 架构,新增 50 多条 AI 专属指令,单位功耗算力 8.3TOPS/W,是行业平均 2.1 倍,能够顺畅运行 10 亿‑万亿参数区间各类大模型。

(二)集群方案能力

(1)集群方案上,昆仑芯将 64 张加速卡集成单台机柜,依托 3D ‑ Torus 立体互联拓扑,卡间带宽提升 8 倍,单柜训练性能提升 10 倍,推理性能提升 13 倍。

(2)天池 256 卡超节点 2026 年 6 月正式上市,全国产集群训练有效利用率达到 97%,已经完成百度文心 5.1 大模型训练。

(三)商业化落地成果

(1)商业化维度,昆仑芯摆脱过去仅供百度内部使用的模式,外部客户收入占比已经超过总收入一半。招商银行、南方电网、吉利汽车均为其客户。

(2)中国移动 AI 服务器采购项目中,昆仑芯 P800 方案多次拿到 70% 乃至 100% 中标份额。2025 年至今,多套万卡规模集群完成交付,外部市场拓展速度显著加快。

五、格局与展望——算力选型告别单一标准赛道竞争走向系统与生态之争

(一)市场份额变化趋势

(1)梳理四家厂商的发展路径,可以清晰看见国内 AI 算力市场的发展变化。IDC 数据显示国产云端 AI 加速器市场份额从 2024 年 30% 上涨至 2025 年 41%,海外厂商份额同步回落,国产算力替代,已经从政策驱动转向真实市场需求驱动。

(二)各家差异化路线总结

(1)四家企业走出完全差异化路径:曲速科技聚焦推理专用赛道,依托 SRAM 架构,在大模型推理、高并发 Token 生成场景形成专精优势。

(2)华为昇腾依靠全栈软硬件积累,兼顾训练推理,生态规模领先。

(3)阿里平头哥凭借集团云‑模‑芯协同优势,向数据中心全栈方案延伸。

(4)百度昆仑芯完成从内部使用走向外部市场拓展,依托 RISC ‑ V 走出差异化架构路线。

(三)行业竞争核心转变

(1)随着国产算力产业快速成熟,集群方案、超节点架构、软件适配、行业落地能力,成为各大厂商核心发力方向,推动行业从单一硬件比拼走向综合体系化竞争。

(2)曲速 TGU 面向推理集群、华为 950 超节点、阿里磐久服务器、百度天池超节点,分别从推理优化、通用训推、云原生集群、高效训练多个维度,打造全方位、高性能的算力系统解决方案,全面提升国产算力综合服务能力。

(四)行业专家观点

正如业内专家指出,算力选型更看重场景适配度、软件迁移便捷度、生态成熟度等综合能力。国产算力厂商持续深耕技术研发与生态搭建,曲速、华为昇腾、阿里平头哥、百度昆仑芯四家,依托各自核心优势,在细分场景积累海量开发者与优质行业客户,持续构建完善、适配国内产业的自主算力生态。

(五)未来发展展望

(1)国产 AI 算力产业已完成从无到有的基础布局,现阶段正加速迈向从有到优的高质量升级阶段,规模化量产稳定性、低成本软件迁移、高性价比场景落地成为产业升级核心方向。

(2)各大头部厂商持续深耕技术创新与场景落地,全力打磨优质算力产品与服务,贴合千行百业数字化转型的真实算力需求,持续领跑国产算力高质量发展赛道。

追加内容

本文作者可以追加内容哦 !

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai 华为 芯片 上海 浙江
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论