近日,2026世界人工智能大会(WAIC)在上海开幕。作为国内领先的全功能GPU企业,摩尔线程以“词元时代万物智能”为主题参展,首次联动上海世博展览馆与张江科学会堂双展区,以“模型训练、词元生产、智能体生产”三大AI工厂为主线,系统呈现国产算力打通大模型“训、推、用”的能力布局。

  其中,在“模型训练工厂”展区,摩尔线程重点展示了可支撑万卡规模、万亿参数大模型训练的“夸娥”智算底座,以三项标杆级国芯训国模成果,向业界有力证明了国产算力在超大规模、前沿复杂模型训练上的底座实力。

  摩尔线程还在现场首次展出MTT C256超节点,其创新架构首创一层Scale-up网络,实现标准单宽机柜128卡全互联,并柜扩展可达256卡极速互联,攻克传统多层网络的带宽损耗与高延迟痛点。MTT C256采用计算与交换一体化的高密设计,将大幅提高智算中心GPU部署密度,为万卡乃至十万卡级超大规模长稳训推集群打造坚实算力底座。

  万卡规模MoE-236B基础模型:从零起步完整训练

  依托国产万卡GPU集群与夸娥AI训练套件(KUAE Training Suite),该项目实现了MoE-236B模型从零起步的完整训练。模型基于25T+高质量训练语料,覆盖预训练、持续预训练到长窗口持续预训练全链路。在万卡超大规模下,集群有效训练时长占比超90%,展现出与国际同类集群相当的稳定性。其MMLU评测精度与训练损失曲线同国际主流计算卡高度一致,标志着“国产芯片+国产模型”技术路线在万亿参数级规模下实现了实质性跑通。

  北大EvoPhys-World世界模型:全栈原生训练首次落地

  北大EvoPhys团队推出的全球首个5D世界模型——EvoPhys-World,发布后便在斯坦福WorldScore“世界生成”维度蝉联全球榜首37天。作为摩尔线程“灯塔计划”的代表成果,该模型全程基于摩尔线程MTT S5000夸娥智算集群上完成全栈原生训练,由MUSA软件栈提供全栈支撑。其训练稳定性、扩展性与生成质量均达国际主流水平,为中国原创模型提供了坚实的产学研协同范式。

  智源RoboBrain 2.5:国产算力首度跑通具身大脑训练

  北京智源研究院面向真实物理场景打造的通用具身大脑RoboBrain 2.5,在动作时序价值评估和三维空间结构理解推理能力上实现突破。基于FlagOS-Robo框架,依托摩尔线程MTT S5000千卡智算集群,双方成功完成RoboBrain 2.5的全流程训练。这首次验证了国产算力集群在具身智能大模型训练中的高可用性与卓越效率,为具身智能从实验室走向工业产线提供了可靠算力支撑。

  从万亿参数语言大模型、多维世界模型到具身大脑模型,这一系列硬核实践表明,以摩尔线程为代表的国产全功能GPU不仅跑通了全链路技术验证,更在训练效率、系统稳定性等核心指标上达到了工业生产级要求,正成为推动中国大模型自主工程化落地的坚实底座。

来源:日照新闻网