0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

摩尔线程夸娥智算中心解决方案重磅升级

摩尔线程 来源:摩尔线程 2024-08-27 16:09 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

摩尔线程重磅宣布其AI旗舰产品夸娥(KUAE)智算集群解决方案实现重大升级,从当前的千卡级别大幅扩展至万卡规模。摩尔线程夸娥(KUAE)万卡智算集群,以全功能GPU为底座,旨在打造国内领先的、能够承载万卡规模、具备万P级浮点运算能力的国产通用加速计算平台,专为万亿参数级别的复杂大模型训练而设计。这一里程碑式的进展,树立了国产GPU技术的新标杆,有助于实现国产智算集群计算能力的全新跨越,将为我国人工智能领域技术与应用创新、科研攻坚和产业升级提供坚实可靠的关键基础设施。

此外,摩尔线程联合中国移动通讯集团青海有限公司、中国联通青海公司、北京德道信科集团、中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司(排名不分先后)分别就三个万卡集群项目进行了战略签约,多方聚力共同构建好用的国产GPU集群。

摩尔线程创始人兼CEO张建中表示:“当前,我们正处在生成式人工智能的黄金时代,技术交织催动智能涌现,GPU成为加速新技术浪潮来临的创新引擎。摩尔线程矢志投身于这一历史性的创造进程,致力于向全球提供加速计算的基础设施和一站式解决方案,为融合人工智能和数字孪生的数智世界打造先进的加速计算平台。夸娥万卡智算集群作为摩尔线程全栈AI战略的一块重要拼图,可为各行各业数智化转型提供澎湃算力,不仅有力彰显了摩尔线程在技术创新和工程实践上的实力,更将成为推动AI产业发展的新起点。”

AI主战场,万卡通用算力是标配

大模型自问世以来,关于其未来的走向和发展趋势亟待时间验证,但从当前来看,几种演进趋势值得关注,使得其对算力的核心需求也愈发明晰。

首先,Scaling Law将持续奏效。Scaling Law自2020年提出以来,已揭示了大模型发展背后的“暴力美学”,即通过算力、算法、数据的深度融合与经验积累,实现模型性能的飞跃,这也成为业界公认的将持续影响未来大模型的发展趋势。Scaling Law将持续奏效,需要单点规模够大并且通用的算力才能快速跟上技术演进。

其次,Transformer架构不能实现大一统,和其他架构会持续演进并共存,形成多元化的技术生态。生成式AI的进化并非仅依赖于规模的简单膨胀,技术架构的革新同样至关重要。Transformer架构虽然是当前主流,但新兴架构如Mamba、RWKV和RetNet等不断刷新计算效率,加快创新速度。随着技术迭代与演进,Transformer架构并不能实现大一统,从稠密到稀疏模型,再到多模态模型的融合,技术的进步都展现了对更高性能计算资源的渴望。

与此同时,AI、3D和HPC跨技术与跨领域融合不断加速,推动着空间智能、物理AI和AI 4Science、世界模型等领域的边界拓展,使得大模型的训练和应用环境更加复杂多元,市场对于能够支持AI+3D、AI+物理仿真、AI+科学计算等多元计算融合发展的通用加速计算平台的需求日益迫切。

多元趋势下,AI模型训练的主战场,万卡已是标配。随着计算量不断攀升,大模型训练亟需超级工厂,即一个“大且通用”的加速计算平台,以缩短训练时间,实现模型能力的快速迭代。当前,国际科技巨头都在通过积极部署千卡乃至超万卡规模的计算集群,以确保大模型产品的竞争力。随着模型参数量从千亿迈向万亿,模型能力更加泛化,大模型对底层算力的诉求进一步升级,万卡甚至超万卡集群成为这一轮大模型竞赛的入场券。

然而,构建万卡集群并非一万张GPU卡的简单堆叠,而是一项高度复杂的超级系统工程。它涉及到超大规模的组网互联、高效率的集群计算、长期稳定性和高可用性等诸多技术难题。这是难而正确的事情,摩尔线程希望能够建设一个规模超万卡、场景够通用、生态兼容好的加速计算平台,并优先解决大模型训练的难题。

夸娥:国产万卡万P万亿大模型训练平台

夸娥(KUAE)是摩尔线程智算中心全栈解决方案,是以全功能GPU为底座,软硬一体化、完整的系统级算力解决方案,包括以夸娥计算集群为核心的基础设施、夸娥集群管理平台(KUAE Platform)以及夸娥大模型服务平台(KUAE ModelStudio),旨在以一体化交付的方式解决大规模GPU算力的建设和运营管理问题。

基于对AI算力需求的深刻洞察和前瞻性布局,摩尔线程夸娥智算集群可实现从千卡至万卡集群的无缝扩展,旨在满足大模型时代对于算力“规模够大+计算通用+生态兼容”的核心需求,通过整合超大规模的GPU万卡集群、极致的计算效率优化以及高度稳定的运行环境,以万卡智算集群的新超级工程,重新定义国产集群计算能力的新标准。

夸娥万卡智算解决方案具备多个核心特性:

超大算力,万卡万P:在集群计算性能方面,全新一代夸娥智算集群实现单集群规模超万卡,浮点运算能力达到10Exa-Flops,大幅提升单集群计算性能,能够为万亿参数级别大模型训练提供坚实算力基础。同时,在GPU显存和传输带宽方面,夸娥万卡集群达到PB级的超大显存总容量、每秒PB级的超高速卡间互联总带宽和每秒PB级超高速节点互联总带宽,实现算力、显存和带宽的系统性协同优化,全面提升集群计算性能。

超高稳定,月级长稳训练:稳定性是衡量超万卡集群性能的关键。在集群稳定性方面,摩尔线程夸娥万卡集群平均无故障运行时间超过15天,最长可实现大模型稳定训练30天以上,周均训练有效率在99%以上,远超行业平均水平。这得益于摩尔线程自主研发的一系列可预测、可诊断的多级可靠机制,包括:软硬件故障的自动定位与诊断预测实现分钟级的故障定位,Checkpoint多级存储机制实现内存秒级存储和训练任务分钟级恢复以及高容错高效能的万卡集群管理平台实现秒级纳管分配与作业调度。

极致优化,超高MFU:MFU是评估大模型训练效率的通用指标,可以直接反应端到端的集群训练效率。夸娥万卡集群在系统软件、框架、算法等层面一系列优化,实现大模型的高效率训练,MFU最高可达到60%。其中,在系统软件层面,基于极致的计算和通讯效率优化等技术手段,大幅提升集群的执行效率和性能表现。在框架和算法层面,夸娥万卡集群支持多种自适应混合并行策略与高效显存优化等,可以根据应用负载选择并自动配置最优的并行策略,大幅提升训练效率和显存利用。同时,针对超长序列大模型,夸娥万卡集群通过CP并行、RingAttention等优化技术,有效缩减计算时间和显存占用,大幅提升集群训练效率。

全能通用,生态友好:夸娥万卡集群是一个通用加速计算平台,计算能力为通用场景设计,可加速LLM、MoE、多模态、Mamba等不同架构、不同模态的大模型。同时,基于高效易用的MUSA编程语言、完整兼容CUDA能力和自动化迁移工具Musify,加速新模型“Day0”级迁移,实现生态适配“Instant On”,助力客户业务快速上线。

万众一芯,共建大模型应用生态

万卡集群的建设需要产业界的齐心协力,为实现大模型创新应用的快速落地,让国产算力“为用而建”。发布会现场,摩尔线程携手中国移动通讯集团青海有限公司、中国联通青海公司、北京德道信科集团、中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司(排名不分先后),分别就青海零碳产业园万卡集群项目、青海高原夸娥万卡集群项目、广西东盟万卡集群项目进行了战略签约。

借助摩尔线程先进的夸娥全栈智算解决方案,各方将携手共建强大的全国产智算平台,以加速产业数字化转型和高质量发展。夸娥万卡智算集群项目标志着国产AI算力基础设施的又一重大进展,将为各地的数字经济发展注入新活力。

发布会后,无问芯穹、清程极智、360、京东云、智平方等五家合作伙伴代表纷纷登台,分享了摩尔线程夸娥智算集群如何助力其在大模型训练、大模型推理、具身智能等不同场景和领域的创新,展现了夸娥智算集群在实际应用中的巨大潜力与广泛适用性。

摩尔线程愿与广大行业伙伴并肩同行,发挥全栈AI的力量,加速推动一个由万卡智算集群为强大底座,多领域伙伴共建、广泛赋能数字经济的国产智算生态,共同开启一个属于大模型与生成式人工智能的新时代,为美好世界加速。在WAIC期间,摩尔线程将在上海世博展览馆(H2馆D616)开展“全栈AI 为美好世界加速”的主题成果展示,包括加速卡、服务器、超融合一体机和AIGC应用在内的摩尔线程全栈AI产品悉数亮相,并携手众多行业合作伙伴联合展示基于夸娥智算集群的丰富行业大模型与应用方案。

关于摩尔线程

摩尔线程成立于2020年10月,以全功能GPU为核心,致力于向全球提供加速计算的基础设施和一站式解决方案,为各行各业的数智化转型提供强大的AI计算支持。

我们的目标是成为具备国际竞争力的GPU领军企业,为融合人工智能和数字孪生的数智世界打造先进的加速计算平台。我们的愿景是为美好世界加速。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • gpu
    gpu
    +关注

    关注

    28

    文章

    5258

    浏览量

    136039
  • AI
    AI
    +关注

    关注

    91

    文章

    40927

    浏览量

    302512
  • 人工智能
    +关注

    关注

    1819

    文章

    50288

    浏览量

    266826
  • 摩尔线程
    +关注

    关注

    2

    文章

    285

    浏览量

    6635

原文标题:万卡万P万亿参数通用算力!摩尔线程夸娥智算中心解决方案重磅升级

文章出处:【微信号:moorethreads,微信公众号:摩尔线程】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    摩尔线程正式开源MuJoCo Warp MUSA

    3月30日,摩尔线程正式开源MuJoCo Warp MUSA。这是具身智能领域首个基于MUSA架构的全功能GPU加速物理仿真后端,补齐了国产力在强化学习仿真训练底层生态中的关键一环。
    的头像 发表于 04-01 10:40 1985次阅读
    <b class='flag-5'>摩尔</b><b class='flag-5'>线程</b>正式开源MuJoCo Warp MUSA

    摩尔线程斩获6.6亿元合同订单

    3月30日晚间,摩尔线程(688795)智能科技(北京)股份有限公司(简称“摩尔线程”)披露重大合同公告,公司于近日与某客户签订了产品销售协议(以下简称“合同”),合同标的为
    发表于 03-31 07:42 1062次阅读

    摩尔线程深耕国产力生态,共促科技和产业融合创新

    未来产业、量子科技、人工智能等多个平行论坛。同时,摩尔线程重点展示了与生态伙伴在量子计算等前沿领域的最新合作进展,并携全栈自主解决方案亮相“人工智能+”展区,以自主可控的底层
    发表于 03-29 18:52 1137次阅读
    <b class='flag-5'>摩尔</b><b class='flag-5'>线程</b>深耕国产<b class='flag-5'>算</b>力生态,共促科技和产业融合创新

    摩尔线程与中国移动研究院等,联合发布128卡高密超节点参考设计,定义超大规模智底座新标准

    ,依托OISA协同创新平台,摩尔线程、中国移动研究院、之江实验室等产业伙伴正式发布《OISA高密超节点参考设计技术规范》。该规范针对当前智中心面临的互联瓶颈、供电压力及散热极限,提出
    发表于 03-17 08:40 844次阅读

    摩尔线程正式开源TileLang-MUSA项目

    近日,摩尔线程正式开源TileLang-MUSA项目,实现对TileLang编程语言的完整支持。该项目已成功在摩尔线程多代全功能GPU上完成功能验证与特性开发,旨在通过高层抽象与编译器
    的头像 发表于 02-11 16:57 1645次阅读

    全栈国产AI Coding上线:摩尔线程+硅基流动+智谱,强强联合!

    摩尔线程今日正式推出AI Coding Plan 智能编程服务。作为首个基于国产全功能 GPU 力底座构建的智能开发解决方案,该服务以 MTT S5000 强劲的全精度计算能力为核心
    的头像 发表于 02-03 17:07 1917次阅读
    全栈国产AI Coding上线:<b class='flag-5'>摩尔</b><b class='flag-5'>线程</b>+硅基流动+智谱,强强联合!

    摩尔线程正式推出AI Coding Plan智能编程服务

    摩尔线程今日正式推出 AI Coding Plan 智能编程服务。作为首个基于国产全功能 GPU 力底座构建的智能开发解决方案,该服务以 MTT S5000 强劲的全精度计算能力为核
    的头像 发表于 02-03 16:46 1723次阅读

    力即国力!摩尔线程架构/芯片/超节点/万卡集群四连发,助力打造AI国之重器

    电子发烧友网报道(文/吴子鹏)在人工智能(AI)时代,力如同工业革命的电力,成为驱动社会运转的“数字能源”,是AI从技术研发走向大规模应用的核心支撑。因此,在摩尔线程首届MUSA开发者大会(MDC
    的头像 发表于 12-23 09:29 5705次阅读
    <b class='flag-5'>算</b>力即国力!<b class='flag-5'>摩尔</b><b class='flag-5'>线程</b>架构/芯片/超节点/万卡集群四连发,助力打造AI国之重器

    今日看点:国内首块L3级自动驾驶专用号牌诞生;三星发布全球首款 2nm芯片Exynos 2600

    摩尔线程新一代GPU架构发布,支持十万智集群   近日,摩尔线程发布新一代全功能GPU架构“花港”,以及基于“花港”架构的AI训推一体芯片
    发表于 12-22 10:23 1257次阅读

    摩尔线程新一代GPU架构即将揭晓

    12月19日至20日,摩尔线程首届MUSA开发者大会(MUSA Developer Conference,简称MDC 2025)将在北京中关村国际创新中心拉开帷幕。作为国内首个聚焦全功能GPU
    的头像 发表于 12-13 15:14 2179次阅读

    国家信息中心摩尔线程达成战略合作

    10月21日上午,国家信息中心摩尔线程在北京举行战略合作协议签约仪式。国家信息中心主任徐强,摩尔线程
    的头像 发表于 10-23 15:52 623次阅读

    商汤大装置力Mall重磅发布

    近日,商汤科技联合华为、库帕思、海光、寒武纪、曦望Sunrise、壁仞科技、麒麟软件、摩尔线程等十余家国产生态伙伴,共同发布“商汤大装置力Mall”。
    的头像 发表于 08-05 10:05 1268次阅读

    摩尔线程亮相WAIC 2025:以“AI工厂”理念驱动力进化,全栈AI应用赋能千行百业

    7月26日-29日,2025世界人工智能大会(WAIC)在上海举办。摩尔线程携以全功能GPU为核心的“云边端”全栈AI产品和解决方案精彩亮相,并首次提出“AI工厂”理念,旨在为AGI时代打造生产先进
    的头像 发表于 07-28 11:34 2427次阅读
    <b class='flag-5'>摩尔</b><b class='flag-5'>线程</b>亮相WAIC 2025:以“AI工厂”理念驱动<b class='flag-5'>算</b>力进化,全栈AI应用赋能千行百业

    摩尔线程MTT X300显卡全新性能升级

    摩尔线程近日发布的Linux驱动程序v3.0.0,为MTT X300专业显卡带来全面的性能提升。此次升级通过软硬件深度协同优化,显著提升了GPU渲染性能,使MTT X300在数字孪生、GIS
    的头像 发表于 05-27 18:03 2276次阅读

    摩尔线程与AI力平台AutoDL达成深度合作

    近日,摩尔线程与国内领先的AI力平台AutoDL宣布达成深度合作,双方联合推出面向个人开发者的“摩尔线程专区”,首次将国产GPU
    的头像 发表于 05-23 16:10 2032次阅读