国产AI算力迈入万卡级集群时代 推理芯片实现重大突破
大模型部署从技术验证迈向生产环境,推理环节的算力成本与响应效率日益成为制约规模化落地的现实瓶颈。国产算力厂商近期推出的新一代推理芯片及万卡级集群方案,在体系化协同方向实现了关键突破,为行业提供了覆盖芯片、集群到应用全链路的国产化技术路径。
这一全链路国产化技术路径的打通,离不开底层算力基础设施规模的爆发式增长作为坚实底座。iiMedia Research(艾媒咨询)发布的数据显示,中国智能算力规模正保持高速增长。2025年中国智能算力规模为1037.3EFLOPS,通用算力规模为85.8EFLOPS;预计到2027年,中国智能算力规模将达到2019.9EFLOPS,通用算力规模将达到119.9EFLOPS。量级的跃升印证了当前产业对于推理算力成本与效率的迫切需求,这也为下文所述的万卡级集群方案从单点突破向体系化协同演进,提供了演进逻辑与产业土壤。
万卡集群方案问世,国产推理算力迈上新台阶
艾媒网(iiMedia.cn)获悉,2026年8月21日,国产算力芯片企业中诚华隆在北京正式发布全新HL200推理芯片及配套的超节点智算集群方案。此次发布表明国产AI推理算力实现了从单点芯片突破到万卡级集群体系化协同的跨越式升级,在生成式AI加速商业化落地的关键节点,为行业提供了兼顾高性能、低延时与低成本的国产化算力底座。
工业和信息化部电子信息科技委执行副主任兼秘书长、中国科技咨询协会理事长等主管部门领导,以及来自科研院所、产业链上下游的百余位代表出席发布会,共同见证国产AI算力基础设施迈入新阶段。
来源:中国证券报
业内普遍认为,此举将有效缓解国内大模型推理侧算力供给压力,为AI Agent、多模态交互等新兴应用的规模化部署奠定硬件基础。
HL200芯片技术突破,能效比稳居国内第一梯队
当前,全球人工智能产业正经历从“训练驱动”向“推理驱动”的深刻范式转移。随着AI Agent规模化落地、长上下文交互场景快速普及,以及各类行业大模型从实验室走向生产线,Token消耗量呈指数级攀升,高效、低时延且成本可控的推理能力已成为算力赛道新的核心竞争壁垒。
中诚华隆此番推出的HL200芯片,正是精准回应了这一市场刚需。作为第二代推理芯片,HL200延续企业“一年一芯”的迭代节奏,原生支持FP4、FP8超低精度推理,同时兼容主流FP16/BF16精度。在核心性能指标上,单卡FP16/BF16算力达0.5P、FP8算力达2P、FP4算力达4P,能效比高达5.12TFLOPS/W,稳居国内第一梯队,有效破解了长期以来困扰行业的推理能效偏低、部署成本偏高难题。
值得关注的是,HL200在软件生态层面全面适配PyTorch、ONNX、vLLM等主流技术栈,并配套OpenAI兼容接口与轻量化迁移方案,降低了企业模型切换与适配门槛。在DeepSeek V4系列、GLM 5.2等主流大模型的实际适配测试中,HL200的Prefill全流程性能相较国际同级芯片全面领先,解码延迟优势明显,具备稳定支撑大模型规模化商业推理部署的能力。这种从硬件性能到软件生态的全栈适配,意味着国产推理芯片在实用性和易用性上迈出了关键一步。
超节点集群实现体系化协同,生态建设全面提速
面对万亿参数大模型及未来多模态大模型带来的指数级算力增长需求,单一芯片的性能跃升仅是基础,体系化协同能力才是决胜关键。
中诚华隆同步发布的HL200超节点智算集群方案,通过突破单卡算力边界,实现了大规模集群的高效协同与资源统筹。该方案单机柜可支持64张GPU高速互联,单节点最高堆叠1024卡,横向扩展能力最高可达10240卡,完整覆盖从8卡到万卡的全场景算力部署需求,可满足从边缘推理节点到国家级智算中心的多元化建设需求。
通过算、存、网全链路SLO协同优化,该集群在算力密度、互联带宽、部署时延及能效表现等关键指标上均达到业界先进水平,兼具灵活扩容性与高性价比,能够有效适配各级智算中心及不同规模政企用户的算力场景。
发布会现场,中诚华隆与十余家行业头部企业签署战略合作协议,旨在打通从底层芯片、集群架构到上层应用的全栈链路,携手共建自主可控的国产AI算力产业生态。分析认为,万卡级集群的体系化交付能力,将极大推动大模型从技术演示加速走向规模化商业交付,降低全社会获取智能算力的门槛,并为智算中心的国产化替代提供可落地的工程范本。
从可选到必需,国产算力底座加速自主可控
从国家战略与产业安全层面审视,国产人工智能基础芯片从行业“可选方案”上升为国家“战略必需”。
工业和信息化部电子信息科技委执行副主任兼秘书长在致辞中明确指出,中诚华隆作为国产算力芯片领域的骨干企业,深耕自主芯片研发多年,在攻坚“卡脖子”关键核心技术与全栈算力布局上取得了重要突破,全国产芯片的成功流片充分展现了企业的技术实力与创新能力。中国科技咨询协会理事长亦强调,国家“十五五”规划持续强化企业科技创新主体地位,鼓励企业牵头开展关键核心技术攻关、组建产业创新联合体。
中诚华隆坚持市场导向与技术创新双轮驱动,走出了一条自主可控、稳扎稳打的国产算力发展道路。此次HL200芯片及万卡级集群方案的发布,不仅是企业技术实力的集中展现,更是国产AI算力从单点突破迈向体系化协同的重要里程碑。
在人工智能全球竞争持续深化的背景下,算力基础设施的自主可控能力对数字经济长远发展具有重要影响。该方案在提升推理能效比与降低部署成本方面进行了针对性设计,为大模型商业化过程中的算力需求提供了新的解决思路。其产业价值将在后续智算中心建设与AI应用拓展进程中逐步接受市场检验。
