阿里云真武超节点 Day0 适配 Kimi K3,国产算力突破万亿参数模型瓶颈

2026/07/28 09:25阅读量 2

阿里云真武 M890 超节点于 7 月 28 日完成对 Kimi K3 大模型的 Day0 适配,成为国内首个跑通近 3 万亿参数模型的超节点。通过 ICN Switch 高速互联芯片实现 64 卡全互联,显存达 9TB,软硬件联合优化后首 Token 时延降低 35%,单卡解码吞吐提升 1.8 倍。此举标志国产算力具备支撑超大模型大规模应用的能力。

事件概述

2026 年 7 月 28 日,阿里云真武 M890 超节点实例完成对 Kimi K3 大模型的 Day0 适配,这是国内首个成功运行近 3 万亿参数规模模型的超节点。双方由此展开国产算力合作,千问 AI 平台和阿里云百炼将提供 Kimi K3 的模型 API。

核心信息

  • 模型规模:Kimi K3 是业界参数规模最大的模型之一,需将参数分散至数十到上百张高速互联的 GPU 卡,普通 AI 集群因通信带宽限制无法满足高吞吐、低延迟需求。
  • 硬件架构:真武超节点通过平头哥自研 ICN Switch 高速互联芯片,实现 64 张真武 M890 之间 800GB/s 的全互联,单实例显存达 9TB,突破算力、显存和网络带宽瓶颈,可支撑万亿级参数 MoE 模型的专家并行。
  • 联合优化:阿里云、平头哥与 Kimi 团队从软件栈和算子层面进行深度适配。对 Kimi K3 核心算子进行优化后,推理算力和带宽利用率显著提升,稳定支持 1M 长上下文,可应对长文档理解、复杂推理等场景。
  • 测试成果:适配后模型首 Token 时延降低约 35%,单卡解码吞吐提升 1.8 倍。

值得关注

国内外主流模型已进入超 2 万亿参数时代,阿里云真武超节点不仅成功运行 Kimi K3,还实现了高效推理,表明国产算力已具备支撑超大参数模型大规模应用的能力。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。