首页 > 快讯 > 正文

摩尔线程发布“花港”GPU新架构,万卡AI训练与推理能力,剑指英伟达

金证券 2025-12-21 14:55 快讯 43 0

摩尔线程发布“花港”GPU新架构,实力强劲剑指英伟达

北京,12月21日——在首届MUSA开发者大会(MDC2025)上,摩尔线程公司凭借其强大的技术实力,全面发布了全新一代GPU架构“花港”,并展示了其在AI训练与推理、图形渲染以及多个前沿领域的技术突破,这一发布不仅彰显了其在GPU行业的创新能力,也被业内专家视为对英伟达的有力挑战。

“花港”架构的核心亮点在于其全精度计算能力,支持从FP4到FP64,算力密度提升50%,能效提升10倍,基于这一架构,摩尔线程计划推出专注于AI训练与推理的“华山”芯片,以及面向图形渲染的“庐山”芯片,进一步巩固其在AI硬件领域的领先地位。

在AI训练集群方面,摩尔线程推出了“夸娥”万卡智算集群,展现了其在高效训练场景中的强大实力,该集群在稠密模型上的训练算力利用率达到60%,在混合专家模型上达40%,训练线性扩展效率高达95%,公司与硅基流动合作,在DeepSeek R1 671B模型上实现了突破性进展,单卡Prefill吞吐量超过4000 tokens/s,Decode吞吐量超过1000 tokens/s,凸显其在AI推理领域的强大能力。

软件生态方面,MUSA 5.0版本的发布进一步优化了编程模型、计算库和编译器,核心计算库muDNN的GEMM与FlashAttention效率超过98%,通信效率达97%,摩尔线程还表示,将逐步开源部分核心组件,包括计算加速库与系统管理框架,为行业提供更多选择和可能性。

在图形渲染领域,“花港”架构集成了硬件光线追踪加速引擎,并支持自研的AI生成式渲染技术,为内容创作和虚拟现实领域带来更多可能性,摩尔线程在具身智能、AI for Science等前沿领域也展现了强大潜力,推出了仿真训练平台MTLambda和基于“长江”SoC的AI算力本MTT AIBOOK。

公司还公布了面向下一代超大规模智算中心的MTTC256超节点架构设计,致力于高密度硬件与能效优化,进一步巩固其在AI计算生态中的地位。

此次MUSA大会的举办,展现了摩尔线程从芯片架构、集群基础设施到端侧设备的全栈技术布局,旨在为国内AI计算生态的发展提供坚实的硬件与软件支持,业内专家普遍认为,摩尔线程的这一系列举措不仅体现了其技术实力,更凸显了其对全球GPU市场的战略性布局,正全面对标并超越英伟达,提升其在AI硬件领域的信心与影响力。


搜索
标签列表
最近发表
友情链接
关灯 顶部