进入 Agent 时代,产业竞争正在出现新的变化:AI 不再只是一个需要被训练的模型,而正在变成一种需要被持续生产、调用和部署的智能能力。
在 2026 世界人工智能大会(WAIC)期间,摩尔线程创始人、董事长兼 CEO 张建中提出 " 三大 AI 工厂 " 的概念——模型训练工厂、词元(Token)生产工厂和智能体生产工厂。

摩尔线程创始人、董事长兼 CEO 张建中
在摩尔线程的定义中,三大工厂分别对应模型训练、Token 生成和智能体生产,覆盖从基础模型研发到产业应用、从云端基础设施到终端设备的完整链路。

中国工程院院士、清华大学教授郑纬民在演讲中指出,算力基建的关键在于将每一份算力转化为高质量词元,三大 "AI 工厂 " 是算力基础设施的必然演进。在国家信息中心大数据发展部副主任魏颖看来,算力基础设施是词元生产的物理底座,作为算力核心的 GPU 决定了生产效率与成本。
但这三个 " 工厂 " 并不是三个割裂的业务方向。摩尔线程高级副总裁董龙飞表示,三个工厂代表的是不同市场,并不存在简单的优先级关系。但从产业竞争角度看,模型训练仍然是整个体系的基础。
" 产业人工智能的竞争最重要的就在于这个模型是不是聪明。" 董龙飞表示,模型能力依靠预训练和后训练获得,而不是推理阶段。
如果把 AI 比作一个企业,模型就像企业里的员工,首先需要具备足够高的认知能力,之后才谈得上执行任务。
这也成为摩尔线程布局三大工厂背后的核心逻辑:未来 AI 竞争不只是制造模型,而是建立一套持续生产智能的基础设施。
模型训练工厂,决定 AI 能力上限
过去,大模型主要围绕语言能力展开;如今行业中的模型已经呈现高度多样化趋势,包括混合专家模型、多模态模型、机器人具身大脑模型以及世界模型等。
训练这些模型,并不是简单的矩阵计算,而需要更复杂的软件、仿真和计算能力。
这也是摩尔线程强调国产 " 全功能 GPU" 的原因。在训练场景中,GPU 需要同时满足算力、显存、带宽、可靠性、软件生态以及训练结果一致性等要求。
其中,训练结果一致性是国产 GPU 进入大规模训练场景的重要门槛。
董龙飞解释,所谓训练中的 " 高精度 ",并不是单纯指计算精度,而是不同 GPU 平台之间训练结果的对齐能力。对于已经投入大量资源完成模型训练的用户来说,迁移到新的 GPU 平台后,能否获得稳定、可比的训练结果,是平台能否被采用的重要因素。

围绕模型训练工厂,摩尔线程展示了多项国产算力实践。

万卡规模 MoE-236B 基础模型训练是此次展示的重点,该项目依托国产万卡 GPU 集群完成从零开始的完整训练,在万卡规模下有效训练时长占比超过 90%,模型精度和训练损失曲线与国际主流计算卡高度一致。
与此同时,北京大学 EvoPhys 团队的 5D 世界模型 EvoPhys-World,也基于摩尔线程 MTT S5000 夸娥智算集群完成全栈原生训练,并在 WorldScore" 世界生成 " 维度连续 37 天排名第一。

京东云总裁曹鹏在摩尔线程举办的 " 词元时代 万物智能论坛 " 论坛上表示,当前 AI 基础设施正在发生变化,全国产算力、国产模型和国产推理引擎组成的体系正在逐渐建立。京东正在基于摩尔线程国产算力进行模型训练、适配和调优。
对于摩尔线程而言,模型训练工厂不仅意味着训练更大的模型,也意味着国产算力开始进入 AI 原创能力生产环节。
词元生产工厂,让模型能力规模化释放
如果模型训练工厂解决的是 " 如何制造更聪明的模型 ",那么词元生产工厂解决的是 " 如何让更多人低成本使用智能 "。
随着 Agent 兴起,AI 使用方式正在改变。过去,人向模型提出问题;未来,大量 Agent 会主动调用模型完成任务。
张建中认为,Token 消耗快速增长的根本原因,是未来不是人在使用 AI,而是 Agent 在使用大模型。
因此,AI 基础设施竞争正在从单纯关注训练性能,转向如何降低每一个 Token 背后的成本。
在这一方向,摩尔线程强调模型快速适配、推理优化以及异构算力协同能力。

目前,摩尔线程推理套件已经适配 DeepSeek、MiniMax、GLM、Kimi、Qwen 等主流模型,并推出基于 MTT S5000 的 PD 分离异构推理方案。
产业伙伴也正在验证 Token 生产工厂的商业价值。
趋境科技创始人兼 CEO 艾智远表示,目前趋境科技每天能够供应万亿级高品质 Token,并与摩尔线程合作,通过国产 GPU 与国际主流 GPU 异构协同,提高 Token 生产能力。

Token 工厂覆盖的是最大规模的用户市场。
过去,一个模型推理可能只需要一张卡或者一台服务器,但未来 Token 生产将成为复杂系统工程,需要考虑模型规模、缓存管理、调度效率以及成本控制。
这也是摩尔线程布局推理产品和方案的重要原因。
董龙飞表示,训练和推理都很重要。训练更强调通用性和综合能力,而推理更强调极致性价比,需要针对不同任务设计不同产品和解决方案。
智能体生产工厂,AI 开始进入现实世界
如果说 Token 工厂让 AI 具备输出能力,那么智能体生产工厂则让 AI 进一步具备行动能力。
张建中认为,Agentic AI 之后的重要方向是物理 AI,未来 AI 需要从数字世界走向现实世界。
摩尔线程认为,Token 工厂解决的是 " 会说 ",智能体工厂解决的是 " 会做 "。
董龙飞表示,Token 生成之后,还需要让 AI 调用工具。在电脑中,这意味着 Agent 能够操作软件和系统;在机器人领域,则意味着智能

但相比语言模型,物理智能对算力提出了更高要求。
摩尔线程生态副总裁兼生态科研部总经理吕其恒表示,大语言模型处理的是符号,而具身智能需要理解真实世界中的物理规律,因此需要同时处理视觉、渲染、仿真等任务。这也是世界模型成为具身智能关键方向的原因。
极佳视界合伙人兼副总裁毛继明表示,物理 AGI 面临的重要挑战之一,是如何提升数据使用效率。数字 AGI 主要依赖语言数据,而物理 AGI 需要处理真实世界数据,因此需要更高效的数据和算力体系。
基于这一方向,极佳视界与摩尔线程联合开展驾驶模型、具身模型等物理 AI 模型训练优化,探索国产芯片训练国产模型的完整链路。
三大 AI 工厂背后,是一套统一算力体系
从模型训练,到 Token 生产,再到智能体应用,三大工厂覆盖了 AI 产业从基础能力到应用落地的完整过程。
但三座工厂并不是三套技术体系。董龙飞表示,摩尔线程三个工厂共享统一的 GPU 架构和 MUSA 软件体系,并不是针对不同市场分别开发不同技术。
这也是国产全功能 GPU 的核心竞争力。

在 AI 快速变化阶段,最大的挑战并不是某一个固定模型的性能,而是未来模型形态的不确定性。
今天行业关注大语言模型,未来可能是世界模型、机器人模型、更多垂直领域模型。如果 GPU 过于专用,就很难适应产业变化。
董龙飞认为,GPU 首先需要具备通用性,因为未来模型路线仍然会持续变化。
因此,摩尔线程提出 " 三大工厂 ",并不是简单扩展业务边界,而是在回答一个更大的问题:当 AI 从模型时代进入智能生产时代,下一代基础设施应该是什么?雷峰网


登录后才可以发布评论哦
打开小程序可以发布评论哦