摩尔线程提出“三大AI工厂”:覆盖模型训练、Token生产与智能体制造,构建AI智能生产基础设施
2026/07/20 18:33阅读量 2
在WAIC 2026上,摩尔线程CEO张建中提出三大AI工厂概念——模型训练工厂、词元(Token)生产工厂和智能体生产工厂,分别对应AI模型研发、推理成本优化和物理AI应用。该体系基于统一GPU架构与MUSA软件栈,旨在以国产全功能GPU支撑从基础模型训练到产业智能体部署的全链路。会上展示了万卡规模MoE-236B训练、异构推理方案以及具身智能合作案例。
事件概述
2026年世界人工智能大会(WAIC)期间,摩尔线程创始人、董事长兼CEO张建中提出“三大AI工厂”概念:模型训练工厂、词元(Token)生产工厂和智能体生产工厂。这一框架覆盖从基础模型研发到产业应用、从云端到终端设备的完整链路,反映出AI产业从“训练模型”向“持续生产智能能力”的演进趋势。
核心信息
-
三大工厂的定位:
- 模型训练工厂:负责训练更聪明的大模型,包括混合专家模型、多模态模型、具身智能模型等。
- Token生产工厂:解决低成本规模化调用模型的问题,适应未来Agent主导的AI使用方式。
- 智能体生产工厂:让AI从“会说”到“会做”,具备操作软件和物理世界的能力。
-
关键技术与案例:
- 摩尔线程展示了基于国产万卡GPU集群完成的MoE-236B基础模型训练,有效训练时长占比超过90%,训练精度与国际主流计算卡高度一致。
- 北京大学EvoPhys团队基于摩尔线程MTT S5000夸娥智算集群全栈原生训练的5D世界模型EvoPhys-World,在WorldScore“世界生成”维度连续37天排名第一。
- 摩尔线程推理套件已适配DeepSeek、MiniMax、GLM、Kimi、Qwen等主流模型,推出基于MTT S5000的PD分离异构推理方案。
- 趋境科技基于摩尔线程GPU实现万亿级每日Token供应,通过国产与国际GPU异构协同提升生产能力。
-
统一技术底座:三大工厂共享摩尔线程统一的GPU架构和MUSA软件体系,并非三套独立技术。GPU的通用性被视为应对未来模型形态不确定性的关键。
值得关注
- 中国工程院院士郑纬民指出算力基建的关键在于将算力转化为高质量词元,三大工厂是算力基础设施的必然演进。
- 京东云总裁曹鹏表示全国产算力体系(国产算力+国产模型+国产推理引擎)正在建立,京东基于摩尔线程国产算力进行模型训练与调优。
- 极佳视界与摩尔线程联合开展驾驶模型、具身模型等物理AI训练优化,探索国产芯片训练国产模型的完整链路。
摩尔线程通过三大工厂概念,将业务从单一GPU芯片提供者扩展为AI智能生产基础设施构建者,核心在于用统一的国产全功能GPU架构覆盖训练、推理与物理智能三个不同市场。
