首页 > 快讯 > 正文

摩尔线程发布“花港”架构,力推国产万卡智算生态

金证券 2025-12-20 21:12 快讯 68 0

摩尔线程发布“花港”架构,力推国产万卡智算生态

在近日登陆科创板的摩尔线程(688795.SH)于12月20日在北京举办首届MUSA开发者大会上,正式发布了基于“元计算”统一计算架构的全新一代GPU架构“花港”,并展示了多款芯片产品及相关技术成果,标志着中国国产高端AI芯片进入万卡级智算集群时代。

核心技术与架构创新
“花港”架构是摩尔线程自主研发的MUSA(Meta-computing Unified System Architecture)统一计算架构的重要组成部分,该架构通过全新的指令集设计和异步编程模型,实现了“工艺不够,架构来补”的技术突破,在相同工艺条件下,“花港”架构的算力密度提升了50%,效能提升了10倍,支持从FP4到FP64的全精度计算,集成新一代异步编程模型,并通过自研的MTLink高速互联技术,可支持十万卡以上规模的智算集群扩展,单个节点支持1024卡。

摩尔线程发布“花港”架构,力推国产万卡智算生态

全线产品发布
基于“花港”架构,摩尔线程推出了多款芯片产品:

  1. “华山”芯片:面向AI训推一体与超大规模智能计算,浮点算力、访存带宽、高速互联带宽三项指标的能力介于英伟达量产的Blackwell架构和上一代Hopper架构之间,在访存容量指标上则优于上述两个架构。
  2. “庐山”芯片:专注于高性能图形渲染,AI计算性能提升64倍,几何处理性能提升16倍,光线追踪性能提升50倍,并增强了纹理填充和显存容量。

公司还发布了“夸娥”万卡智算集群,该集群浮点运算能力达到10 Exa-Flops,在大模型训练方面展现出优异的性能,训练线性扩展效率为95%,对Dense大模型的算力利用率为60%,对MoE大模型的算力利用率为40%。

生态与合作推进
在软件与生态建设方面,摩尔线程升级了MUSA统一计算架构至5.0版本,核心计算库muDNN的GEMM和FlashAttention效率超过98%,通信效率达到97%,编译器性能提升3倍,公司计划逐步开源计算加速库、通信库及系统管理框架等核心组件。

摩尔线程还展示了多项前瞻性技术:

  • MTX:兼容跨代GPU指令架构的中间语言,支持多种GPU架构的统一开发。
  • MUSA-Q:量子计算融合框架,为量子与经典计算的结合提供技术支持。
  • muLitho:计算光刻库,推动高精度芯片设计。

个人市场与图形技术
针对个人市场,摩尔线程发布了搭载“长江”SoC芯片的MTT AIBOOK笔记本电脑,端侧AI算力达到50 TOPS,同时预告了基于同一SoC芯片的迷你型计算设备MTT AICube。

在图形技术领域,摩尔线程目前支持DirectX 12、OpenGL 4.6、Vulkan 1.3等主流API,并已与国产CPU及操作系统完成适配,公司计划实现对DirectX 12 Ultimate的完整支持,并推出了AI生成式渲染技术MTAGR 1.0,打破传统渲染范式,尝试将渲染转向生成。

未来布局与市场潜力
摩尔线程在大会上还提及了科学智能(AI4S)、量子科技、AI for 6G等前沿交叉领域的布局,并宣布建设MUSA生态中心,启动开发者计划,为科研与创新提供算力支持。

当前,国产AI芯片行业受到资本市场大力追捧,摩尔线程成立于2020年10月,核心团队成员包括原英伟达中国区总经理张建中及CTO张钰勃,技术路线选择对标英伟达的通用GPU路径,12月5日,摩尔线程以114.28元/股的价格登陆科创板,截至12月19日收盘,其股价累计涨幅达到481%,市值约为3121.46亿元。

国产GPU能否在实际的大规模商业化场景中实现对国际主流产品有效替代,需要观察后续芯片量产进度与集群效能表现,摩尔线程通过“花港”架构与相关技术,标志性推进了中国在高端AI芯片领域的布局,为国产万卡智算生态的建设注入了强大动力。


搜索
标签列表
最近发表
友情链接
关灯 顶部