浪潮发布元脑HC2000:单柜塞进256张AIPU,Token产能翻十倍

在2026人工智能计算大会上,浪潮信息搞了个大动作。他们正式发布了元脑HC2000多元算力机组和元脑SD200 Ultra超节点AI服务器。这两样东西分工明确,一个盯着容量型智算,另一个专注能力型智算,算是把市场细分做得挺透。

先看硬件底子。元脑HC2000用了DirectCom 2.0极速架构,整个柜子走的是高密液冷路线。最夸张的是,单个机柜能塞进256张AIPU,算力密度直接翻了四倍。柜子里的聚合带宽最高能冲到200Tbps,而且还支持各种本土算力芯片,兼容性这块没落下。

软件层面也有讲究。它搭载了MCIS多元算力协同推理软件栈,能根据不同计算负载来动态调整算力。浪潮信息自己说,同样砸钱的情况下,Token产能能提升整整10倍。这账算下来,确实挺诱人。 说白了就是灵活调配。

针对大模型推理里的Prefill、Decode和FFN这些不同环节,产品能分别匹配不同的芯片和存储方案。MCIS软件覆盖了请求路由、P/D分离推理、算力动态调整和KV Cache管理,还兼容SGLang、vLLM这些主流推理框架。

效果有多猛?数据显示,多元算力间点对点小数据传输性能提升了约5倍。在多盘测试里,节点内本地磁盘IO性能更是飙升了约32倍。这波操作,显然是想解决智能算力集群里的效率瓶颈问题。

热门推荐