中诚华隆 HL200 推理芯片发布:能效比 5.12 TFLOPS/W、集群最高可扩展至万卡
中诚华隆发布 HL200 推理芯片,能效比 5.12 TFLOPS/W,其智算集群方案横向最高可扩展至万卡规模。
资讯解读
中诚华隆正式推出 HL200 推理芯片及超节点智算集群方案。该芯片原生支持 FP4 与 FP8 低精度推理,单卡 FP4 算力为 4P,能效比达到 5.12 TFLOPS/W。
当前 AI 推理市场对能效比和低精度计算的需求日益增长。HL200 原生支持 FP4 和 FP8 格式,有助于在保持性能的同时降低算力成本与功耗,符合行业向高效能推理演进的趋势。
配套的智算集群方案支持大规模扩展,单机柜可互联 64 张 GPU,横向最高可扩展至万卡规模。这种高扩展性设计能够满足大模型训练后的大规模推理部署需求,为构建高性能智算中心提供硬件基础。
随着生成式 AI 应用的普及,推理算力需求激增。国内芯片厂商纷纷布局推理市场,中诚华隆此次发布的产品进一步丰富了国产 AI 算力芯片的选择,有助于推动相关产业链的成熟。
本站展示内容为基于公开信息的资讯解读与整理,不代表原文转载。如需核实细节或获取完整报道,请通过下方链接访问原始来源。