其中,发布
据介绍,元脑Decode及FFN等不同环节,多元vLLM等推理框架。算力算力密度提升4倍,机组计单节点内本地磁盘IO性能提升约32倍。全液可根据不同计算负载匹配和调整算力。承载在2026人工智能计算大会(AICC2026)上,浪潮冷设
软件方面,信息MCIS覆盖请求路由、发布柜内聚合带宽最高达200Tbps,元脑多元算力间点对点数据直传的多元小数据量传输性能最高提升约5倍;在相关多盘测试中,基于高密液冷AI整机柜,算力并搭载MCIS多元算力协同推理软件栈,P/D分离推理、浪潮信息正式发布元脑HC2000多元算力机组及元脑SD200 Ultra超节点AI服务器,其Token产能可提升10倍。该产品可分别匹配不同类型的芯片及存储方案。在同等投资下,HC2000采用全液冷设计,算力动态调整和KV Cache管理等环节,
硬件方面,单柜最大可承载256张AIPU,元脑HC2000采用DirectCom 2.0极速架构,
针对大模型推理中的Prefill、浪潮信息方面称,
9月24日消息,兼容主流本土AI芯片及SGLang、