据量子位报道,中诚华隆日前在北京举办2026 GPU新品发布会,推出HL200推理芯片及超节点智算集群方案,实现国产AI推理算力从单点芯片到万卡级集群的体系化升级。工业和信息化部电子信息科技委执行副主任兼秘书长毕开春、中国科技咨询协会理事长刘志光出席并致辞。

中诚华隆方面介绍,HL200芯片原生支持FP4、FP8超低精度推理,兼容FP16精度。单卡FP16/BF16算力为0.5P,FP8算力2P,FP4算力4P,能效比达5.12 TFLOPS/W。芯片全面兼容PyTorch、ONNX、vLLM等主流技术栈,并提供OpenAI兼容接口与轻量化迁移方案。在DeepSeek V4 Flash、DeepSeek V4 Pro、GLM 5.2等主流大模型的适配测试中,相较国际同级芯片,Prefill全流程性能全面领先,模型解码延迟优势显著。

同步发布的HL200超节点智算集群方案,单机柜支持64张GPU高速互联,单节点最高可完成1024卡纵向堆叠,横向扩展最高可达10240卡,覆盖8卡至万卡全场景算力部署需求。集群通过算、存、网全链路SLO协同优化,在算力密度、互联带宽、部署时延等指标上达到业界先进水平,可为各规模智算中心预留迭代扩容空间。

毕开春在致辞中表示,国产人工智能基础芯片已从行业可选上升为国家战略必需。中诚华隆作为国产算力芯片领域骨干企业,在攻坚芯片关键核心技术与全栈算力布局上取得重要突破,希望其继续加大核心技术攻关。刘志光表示,国家“十五五”规划持续强化企业科技创新主体地位,中诚华隆HL系列全国产AI芯片的迭代升级是践行科技强国战略的实践。

发布会上,中诚华隆与中国能建所属中电工程、浪潮信息、紫光智算、光环云等十余家企业达成战略合作。中诚华隆董事长王嘉诚表示,行业算力竞争已进入推理效率、落地体验、产业价值的综合比拼阶段,公司坚持“不做参数的追随者,只做推理效率的定义者”。据介绍,中诚华隆是国内少数具备“芯片+整机+解决方案”全栈自主可控能力的企业,产品已中标中国移动、中国电信等运营商及全国20余省份、近50个重点标段,服务政务、金融、能源、交通等领域。