首页
学习
活动
专区
圈层
工具
发布

摩尔线程披露236B MoE模型 国产万卡集群训练时长占比超90%

观点网讯:2026世界人工智能大会(WAIC)期间,摩尔线程披露了一款236B参数的MoE模型基于国产万卡级集群训练,同时展示了从训练到推理的全栈算力方案。

此外,一款具身智能大脑模型基于国产千卡集群训练。该MoE-236B模型基于25T+语料,在摩尔线程国产万卡级集群上从零起步完成预训练到长窗口训练的全流程,有效训练时长占比超过90%。

摩尔线程的夸娥万卡集群包含10240张GPU、10EFLOPS算力,Dense模型利用率60%,有效训练时长超90%。此外,北京大学EvoPhys团队首个全球5D世界模型EvoPhys-World的全栈原生训练,全程由MUSA软件栈提供底层支撑。

在推理侧,摩尔线程展示了基于MTT S5000的高性能推理方案,FP8算力1000 TFLOPS,单卡推理吞吐Decode 1000 tokens/s、Prefill 4000 tokens/s。展台还展出了十万卡的算力集群MTT C256,以及自研数字智能体“小麦”,掌握60多项技能,支持38款APP的跨应用控制。

生态合作方面,趋境科技在摩尔线程分论坛上透露,其使用摩尔线程全功能GPU与国际主流GPU深度融合,已具备日均万亿级高品质词元供应能力。

免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OAXQtktUBylno7OfVyxc08xg0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券