摩尔线程发布“花港”架构,力推国产万卡智算生态
在近日登陆科创板的摩尔线程(688795.SH)于12月20日在北京举办首届MUSA开发者大会上,正式发布了基于“元计算”统一计算架构的全新一代GPU架构“花港”,并展示了多款芯片产品及相关技术成果,标志着中国国产高端AI芯片进入万卡级智算集群时代。
核心技术与架构创新
“花港”架构是摩尔线程自主研发的MUSA(Meta-computing Unified System Architecture)统一计算架构的重要组成部分,该架构通过全新的指令集设计和异步编程模型,实现了“工艺不够,架构来补”的技术突破,在相同工艺条件下,“花港”架构的算力密度提升了50%,效能提升了10倍,支持从FP4到FP64的全精度计算,集成新一代异步编程模型,并通过自研的MTLink高速互联技术,可支持十万卡以上规模的智算集群扩展,单个节点支持1024卡。

全线产品发布
基于“花港”架构,摩尔线程推出了多款芯片产品:
公司还发布了“夸娥”万卡智算集群,该集群浮点运算能力达到10 Exa-Flops,在大模型训练方面展现出优异的性能,训练线性扩展效率为95%,对Dense大模型的算力利用率为60%,对MoE大模型的算力利用率为40%。
生态与合作推进
在软件与生态建设方面,摩尔线程升级了MUSA统一计算架构至5.0版本,核心计算库muDNN的GEMM和FlashAttention效率超过98%,通信效率达到97%,编译器性能提升3倍,公司计划逐步开源计算加速库、通信库及系统管理框架等核心组件。
摩尔线程还展示了多项前瞻性技术:
个人市场与图形技术
针对个人市场,摩尔线程发布了搭载“长江”SoC芯片的MTT AIBOOK笔记本电脑,端侧AI算力达到50 TOPS,同时预告了基于同一SoC芯片的迷你型计算设备MTT AICube。
在图形技术领域,摩尔线程目前支持DirectX 12、OpenGL 4.6、Vulkan 1.3等主流API,并已与国产CPU及操作系统完成适配,公司计划实现对DirectX 12 Ultimate的完整支持,并推出了AI生成式渲染技术MTAGR 1.0,打破传统渲染范式,尝试将渲染转向生成。
未来布局与市场潜力
摩尔线程在大会上还提及了科学智能(AI4S)、量子科技、AI for 6G等前沿交叉领域的布局,并宣布建设MUSA生态中心,启动开发者计划,为科研与创新提供算力支持。
当前,国产AI芯片行业受到资本市场大力追捧,摩尔线程成立于2020年10月,核心团队成员包括原英伟达中国区总经理张建中及CTO张钰勃,技术路线选择对标英伟达的通用GPU路径,12月5日,摩尔线程以114.28元/股的价格登陆科创板,截至12月19日收盘,其股价累计涨幅达到481%,市值约为3121.46亿元。
国产GPU能否在实际的大规模商业化场景中实现对国际主流产品有效替代,需要观察后续芯片量产进度与集群效能表现,摩尔线程通过“花港”架构与相关技术,标志性推进了中国在高端AI芯片领域的布局,为国产万卡智算生态的建设注入了强大动力。