中诚华隆发布HL200推理芯片及万卡超节点集群,主攻国产推理算力体系化突破

2026/08/24 15:04阅读量 2

中诚华隆在北京发布HL200推理芯片与超节点智算集群,芯片原生支持FP4/FP8超低精度推理,单卡FP4算力达4P,能效比5.12 TFLOPS/W;集群单节点最高1024卡、横向可扩展至10240卡,并已在DeepSeek V4等主流大模型上完成适配,推动国产推理算力从单芯片走向万卡级体系化协同。

事件概述

中诚华隆在北京举办2026 GPU新品发布会,正式推出第二代推理芯片HL200及超节点智算集群方案,旨在面向万亿参数大模型商业化落地场景,实现国产AI推理算力从单点芯片到万卡集群的体系化升级。

核心信息

  • HL200推理芯片原生支持FP4、FP8超低精度推理,同时兼容FP16精度。
  • 单卡算力:FP16/BF16为0.5P,FP8为2P,FP4为4P;能效比达5.12 TFLOPS/W。
  • 芯片全面兼容PyTorch、ONNX、vLLM等主流技术栈,并提供OpenAI兼容接口与轻量化迁移方案,降低企业迁移成本。
  • 在DeepSeek V4 Flash、DeepSeek V4 Pro、GLM 5.2等主流大模型适配测试中,Prefill全流程性能优于国际同级芯片,解码延迟优势明显。

超节点集群方案

  • 单机柜支持64张GPU高速互联,单节点最高可纵向堆叠1024卡,横向扩展最高可达10240卡,覆盖8卡至万卡全场景部署。
  • 集群通过算力、存储、网络全链路SLO协同优化,在算力密度、互联带宽、部署时延和能效方面达到业界先进水平。
  • 方案兼顾灵活扩容与性价比,可适配不同规模政企智算中心建设需求,推动大模型从技术演示走向规模化商业交付。

生态与合作

发布会上,中诚华隆与中国能建所属中电工程、浪潮信息、紫光智算、光环云等十余家企业达成战略合作,共建国产AI算力产业生态。中诚华隆表示,公司已形成GPU、CPU多芯协同布局,核心产品曾中标中国移动、中国电信等运营商项目,并服务于政务、金融、能源、交通等关键领域。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。