快科技 8 月 22 日消息,中诚华隆 8 月 21 日在北京举办 2026 GPU 新品发布会,正式推出全新 HL200 推理芯片及超节点智算集群方案。中诚华隆董事长王嘉诚表示,行业算力竞争已告别单纯参数比拼,进入推理效率与落地体验的综合博弈阶段。
HL200 延续一年一芯迭代节奏,单卡 FP16/BF16 算力 0.5P,FP8 算力 2P,FP4 算力 4P,能效比达 5.12 TFLOPS/W。芯片原生支持 FP4、FP8 超低精度推理,兼容主流 FP16 精度,全维度覆盖大模型推理算力需求。
该卡在生态上全面兼容 PyTorch、ONNX、vLLM 等主流技术栈,配套 OpenAI 兼容接口与轻量化迁移方案。
在 DeepSeek V4 Flash、DeepSeek V4 Pro、GLM 5.2 等主流大模型对标测试中,HL200 相较国际同级芯片 Prefill 全流程性能领先,模型解码延迟优势显著。
超节点智算集群方案同步发布。该方案单机柜支持 64 张 GPU 高速互联,单节点最高可实现 1024 卡纵向堆叠,横向扩展最高可达 10240 卡,覆盖 8 卡至万卡全场景算力部署需求。
该集群通过算、存、网全链路 SLO 协同优化,在算力密度、互联带宽、部署时延、能效表现等关键指标达到业界先进水平。
中诚华隆是国内少数具备 " 芯片 + 整机 + 解决方案 " 全栈自主可控能力的科技企业,已形成 GPU、CPU 多芯协同布局。核心产品已成功中标中国移动、中国电信等头部运营商,覆盖全国 20 余省份、近 50 个重点标段。

【本文结束】如需转载请务必注明出处:快科技
责任编辑:红茶


登录后才可以发布评论哦
打开小程序可以发布评论哦