快速阅读: 据业内消息,摩尔线程于12月20日在北京发布“夸娥”万卡智算集群,具备全精度通用计算能力,浮点性能达10 Exa-FLOPS,训练线性扩展效率高达95%,并联合硅基流动在国产GPU上实现大模型推理性能突破。
12月20日,摩尔线程首届MUSA开发者大会(MDC 2025)在北京中关村国际创新中心开幕。作为国内首个聚焦全功能GPU的开发者技术盛会,大会系统展示了以自主MUSA统一架构为核心的全栈技术成果。
会上,摩尔线程创始人、董事长兼CEO张建中正式发布“夸娥”万卡智算集群。该集群具备全精度、全功能通用计算能力,可在万卡规模下实现高效稳定的AI训练与推理。其浮点运算能力达10 Exa-FLOPS,密集大模型训练的算力利用率(MFU)达60%,MOE大模型达40%,有效训练时间占比超过90%,训练线性扩展效率高达95%。
在训练方面,摩尔线程基于原生FP8能力完整复现了顶尖大模型的训练流程,关键精度指标达到国际主流水平。公司还在多项技术上取得突破:Flash Attention的算力利用率超过95%,并攻克了FP8累加精度等瓶颈,充分释放国产GPU的性能潜力。
在推理方面,摩尔线程联合硅基流动,通过系统级工程优化与FP8加速,在DeepSeek R1 671B全量模型上实现性能突破。MTT S5000单卡的Prefill吞吐量超过4000 tokens/s,Decode吞吐量超1000 tokens/s,树立了国产推理的新标杆。
此外,公司还发布了基于MTT S5000的MTT C256超节点架构规划。该产品采用计算与交换一体化的高密度设计,旨在系统性提升万卡集群的训练与推理效能,为下一代超大规模智算中心提供高密度、高能效的硬件基础。
(以上内容均由Ai生成)
引用自:IT之家网站