浪潮信息发布元脑 SD200 Ultra 超节点:单机承载 2.8 万亿参数 Kimi K3,Token 时延首次突破 5.85 毫秒

IT之家 9 月 22 日消息,在昨日的 2026 人工智能计算大会(AICC2026)上,浪潮信息宣布推出元脑 SD200 Ultra 超节点 AI 服务器与元脑 HC2000 多元算力机组。 据官方介绍,元脑 SD200 Ultra 基于国产 AI 芯片打造,单机可承载运行 2.8 万亿参数的 Kimi K3 大模型。 浪潮表示,SD200 Ultra 的 Token 生成时延首次降至 5.85 毫秒以内,相当于单用户速度 170 Tokens/s,达到业界平均水平的 5 倍。该机型支持 10 万亿参数规模前沿模型单机运行。 IT之家注:Token 生成时延指大模型每输出一个词元所需的平均时间,是衡量推理响应速度的核心指标之一。 SD200 Ultra 采用 3D Hyper Mesh 架构,紧耦合 128 芯本土 AI 芯片,提供 8TB 统一编址显存和 64TB 内存。系统采用原生内存语义通信,通信时延低至 0.69 微秒。 该超节点通过全局统一编址、虚拟影子设备映射、跨域地址翻译与路由,实现 GPU 跨主机域的统一寻址访问,构建百纳秒级低时延内存语义互连域。 浪潮称,借助对称内存技术,SD200 Ultra 首次在基于本土 AI 芯片的超节点上实现 GPU 显存直连,使 GPU 可直接访问远端 GPU 显存。AllReduce 通信时间降低 3.5 倍。 针对 Kimi

阅读原文(IT之家)↗ ← 返回资讯列表