0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

天数智芯支持智源研究院首次完成大模型异构算力混合训练,突破异构算力束缚

天数智芯 来源:未知 2023-11-30 13:10 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

1129日,北京智源人工智能研究院副院长兼总工程师林咏华在2023人工智能计算大会上宣布,正式开源700亿参数大模型Aquila2-70B-Expr(异构先驱版),这是首个基于英伟达混合资源及天数智芯混合资源完成训练的大模型,也是智源研究院与天数智芯合作取得的最新成果,再次证明了天数智芯通用GPU产品支持大模型训练的能力,以及与主流产品的兼容能力。wKgaomVoGlaAU6VuAADdsa8E_Yk828.jpg据林咏华副院长介绍,为了解决异构算力混合训练难题,智源研究院开发了高效并行训练框架FlagScale,支持异构算力混合训练,并在10月开源了FlagScale v0.1版本。此次基于FlagScale v0.2分别在英伟达混合资源(A100集群+A800集群)、天数智芯混合资源(BI-V100集群+BI-V150集群)完成了Aquila2-70B-Expr大模型训练工作。

wKgaomVoGlaAM9NnAAGPG4g0hWQ725.jpg天数智芯在今年上半年搭建了天垓100BI-V100)算力集群支持智源研究院开展70亿参数大模型训练。在此基础上,双方进一步深化合作。天数智芯首先搭建了128节点的BI-V100集群环境,支持智源研究院开展Aquila2-70B-Expr完整训练。训练到20万步,导出模型并完成总计11项性能指标的评估,涉及常识推断、多任务语言理解、真实性回答等场景,将基线实验和对比实验送到真实数据集上进行评测,计算差异在0.28%在精度上与国际主流集群训练的权重文件水平相当。同时,天数智芯基于新一代产品天垓150BI-V150)搭建了16节点集群环境,用于智源研究院混合并行训练研究。智源研究院利用120节点BI-V100集群加上8节点BI-V150集群进行Aquila2-70B-Expr大模型混合训练,混合集群性能达到上界(理想合池理论峰值)的85.3%测试结果显示,在天数智芯产品上异构训练,对模型性能影响甚微。

这一成果极具商业价值和应用前景,有助于解决智算中心换代升级、增容后新旧计算卡并用难题,为智算中心高效运行提供了新方案。 wKgaomVoGlaAJ-_XAAAlV2YGdhE627.gifEND


原文标题:天数智芯支持智源研究院首次完成大模型异构算力混合训练,突破异构算力束缚

文章出处:【微信公众号:天数智芯】欢迎添加关注!文章转载请注明出处。


声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 天数智芯
    +关注

    关注

    0

    文章

    114

    浏览量

    6795

原文标题:天数智芯支持智源研究院首次完成大模型异构算力混合训练,突破异构算力束缚

文章出处:【微信号:IluvatarCoreX,微信公众号:天数智芯】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    集聚设备与技术,2027甘肃绿色展会,兰州AI

    平台、网荷储协同管控系统、零碳数据中心整体建设方案、园区低碳运维管理体系、清洁能源适配优化技术等内容。聚焦西部
    发表于 09-13 12:03

    奇异摩尔加入北京智人工智能研究院众智FlagOS生态

    近日,奇异摩尔正式加入北京智人工智能研究院主导的开源AI系统软件栈——众智FlagOS生态,成为该生态中首家网络互联芯片厂商。作为国内极具影响的开源生态,FlagOS定位于异构
    的头像 发表于 08-05 15:09 433次阅读
    奇异摩尔加入北京智<b class='flag-5'>源</b>人工智能<b class='flag-5'>研究院</b>众智FlagOS生态

    凌昊智能发布6U VPX异构板,搭载KP920S释放强劲

    近期,凌昊智能正式推出基于KP920S芯片打造的6U VPX高性能异构板,专门面向高可靠复杂场景设计,把强劲的异构塞进了标准工业板卡
    的头像 发表于 08-04 10:10 262次阅读

    天数天垓300对标Hopper,重塑AI格局

    近期,天数正式发布新一代通用GPU旗舰产品——天垓300,直接对标NVIDIA Hopper架构,标志着国产高端GPU在AI训练与推理领域迈入全球第一梯队。这款芯片凭借全自研架构、超大规模
    的头像 发表于 07-21 10:10 760次阅读

    中昊英TPU接入OpenCSG生态:国产异构协同迈出关键一步

    近日,中昊英TPU正式完成与OpenCSG旗下CSGHub平台的适配接入,这一合作标志着国产AI专用
    的头像 发表于 07-20 09:09 418次阅读

    凌昊智能3U VPX智模块发布 国产异构赋能边缘智能升级

    近日,国产边缘智能领军企业凌昊智能®正式推出全新一代3U VPX智模块,这款产品采用“国产FPGA+AI类脑芯片”的异构
    的头像 发表于 07-08 10:11 458次阅读

    异构赋能边侧智能,大联大诠鼎携手此科技推动智能体终端落地

    大联大控股旗下诠鼎集团宣布,联合此科技(CIX Technology)举办“此P1:异构AI赋能OpenClaw龙虾盒子和AI NA
    的头像 发表于 05-25 17:16 661次阅读

    企业如何突破AI困局?2026 年异构管理平台推荐

    随着 AI 大模型爆发式增长,异构管理已成为企业 AI 基础设施建设的核心挑战。本文从行业现状出发,分析异构
    的头像 发表于 05-20 12:53 629次阅读

    科技云报到:信通《智能服务研究报告(2026年)》深度解析 产业迎来关键破局点

    科技云报到原创。 2026年,生成式AI与大模型的规模化落地,把智能力推到了数字经济的C位。从千亿参数模型的跨域训练、亿级用户的高并发推理,到影视特效渲染、工业视觉质检,
    的头像 发表于 05-12 09:42 1002次阅读
    科技云报到:信通<b class='flag-5'>院</b>《智能<b class='flag-5'>算</b><b class='flag-5'>力</b>服务<b class='flag-5'>研究</b>报告(2026年)》深度解析 <b class='flag-5'>算</b><b class='flag-5'>力</b>产业迎来关键破局点

    天数助力DeepLink异构训推一体化升级

    当前,通用人工智能发展驶入快车道,大模型的需求呈现爆发式增长,异构的高效协同成为释放
    的头像 发表于 03-26 09:30 717次阅读
    <b class='flag-5'>天数</b>智<b class='flag-5'>芯</b>助力DeepLink<b class='flag-5'>异构</b><b class='flag-5'>算</b><b class='flag-5'>力</b>训推一体化升级

    工信部力推:国产训练芯片与异构引领AI新征程

    部将以落实《实施意见》为抓手,推动人工智能产业高质量发展,技术创新是重点,突破训练芯片、异构等关键技术是关键。  
    的头像 发表于 01-21 14:11 1.2w次阅读

    国产首证具身大脑模型训练实力:摩尔线程联合智研究院完成RoboBrain 2.5全流程训练

    随着具身智能成为人工智能的下一个战略高地,底层底座的自主可控显得尤为关键。近日,摩尔线程联合北京智人工智能研究院(以下简称:智)基于
    的头像 发表于 01-14 09:05 1061次阅读
    国产<b class='flag-5'>算</b><b class='flag-5'>力</b>首证具身大脑<b class='flag-5'>模型</b><b class='flag-5'>训练</b>实力:摩尔线程联合智<b class='flag-5'>源</b><b class='flag-5'>研究院</b><b class='flag-5'>完成</b>RoboBrain 2.5全流程<b class='flag-5'>训练</b>

    湘军,让变成生产

    脑极体
    发布于 :2025年11月25日 22:56:58

    科技:AI突破,新型堆叠EDA工具持续进化

    无法满足AI芯片对于异构集成的需求。日前,珠海硅科技有限公司创始人兼首席科学家赵毅博士在2025湾展上接受媒体采访,分享了AI
    的头像 发表于 10-31 09:16 1.4w次阅读
    硅<b class='flag-5'>芯</b>科技:AI<b class='flag-5'>算</b><b class='flag-5'>力</b><b class='flag-5'>突破</b>,新型堆叠EDA工具持续进化

    国产AI芯片真能扛住“内卷”?海思昇腾的这波操作藏了多少细节?

    反而压到了310W。更有意思的是它的异构架构:NPU+CPU+DVPP的组合,居然能同时扛住训练和推理场景,之前做自动驾驶算法时,用它跑模型时延直接降了20%。 但疑惑也有:这种
    发表于 10-27 13:12