0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

云天励飞推出IPU-X6000加速卡,针对大模型推理任务设计

云天励飞 来源:云天励飞 2024-07-24 11:03 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

近期,云天励飞推出IPU-X6000加速卡。该产品具备256T算力、128GB显存容量、486GB/S显存带宽;采用C2C Mesh互联技术,可实现卡间高速互联,带宽达64GB/s,最大可实现64张卡的互联;可应用于语言、视觉、多模态等各类大模型的推理加速,目前已适配云天天书、通义千问、百川智能、Llama2/3等近10个主流大模型。

IPU-X6000加速卡内置全国产工艺打造的大算力芯片DeepEdge200,该芯片采用D2D Chiplet技术,是基于DeepEdge10芯片平台打造的最新成果。DeepEdge10是云天励飞于2023年底正式发布的全国产14nm Chiplet大模型推理芯片。

IPU-X6000单卡可实现130B参数量大模型推理,在执行70B参数量大模型推理时性能达11 tokens/s,有望在大模型推理领域逐步实现国产替代。今年以来,大模型全面进入应用落地阶段,推理算力需求随之不断增长。根据IDC数据,预计到2026年中国数据中心用于推理的负载将达到62.2%。

作为国内领先的人工智能企业,云天励飞不仅持续开展芯片、大模型等关键核心技术的自主研发工作,也一直持续推进大模型等创新技术的应用落地,在推理算力领域进行了完备的部署。

今年云天励飞与德元方惠签署协议,提供总算力规模约4000 PFLOPS的AI训练及推理异构算力服务,预计未来3年将为云天励飞贡献约16亿的营收。

云天励飞推出的X6000加速卡,专门针对大模型推理任务设计,打造了一系列符合大模型演进趋势的统一工具链,包括分布式并行策略、基于硬件的流水线排布、先进的量化策略、多机并行的编译机制等,在同等条件下能够做到推理性能更高、消耗成本更低。未来X6000将进一步支撑云天励飞智算运营业务,为行业带来更丰富的算力服务。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 加速卡
    +关注

    关注

    1

    文章

    68

    浏览量

    11323
  • 云天励飞
    +关注

    关注

    0

    文章

    173

    浏览量

    12576
  • 大模型
    +关注

    关注

    2

    文章

    3440

    浏览量

    4964

原文标题:云天励飞推出全新云端推理加速卡X6000,夯实智算运营底座

文章出处:【微信号:IntelliFusion2,微信公众号:云天励飞】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    AI教父Hinton对话云天陈宁

    在大模型步入深水区的当下,AI 的下一个临界点究竟在哪里?在 2025 GIS 全球创新峰会现场,深度学习奠基人、“AI 教父” Geoffrey Hinton 与云天董事长兼 C
    的头像 发表于 12-03 14:04 313次阅读

    云天AI推理芯片如何赋能千行百业

    11月26日,云天会客厅第二期生态沙龙暨深商联高科技高成长创新营走进上市公司活动圆满举办。来自深圳科技领域的多位企业负责人齐聚云天,共同探讨AI
    的头像 发表于 12-03 13:58 209次阅读

    云天亮相2025中国国际半导体博览会

    2025年11月23日,第二十二届中国国际半导体博览会(IC China 2025)在北京国家会议中心启幕。在24日举办的 “人工智能及大模型芯片论坛” 上,云天智算研究院副院长沈
    的头像 发表于 11-25 11:29 348次阅读

    云天亮相2025中国具身智能机器人大会

    近日,在 2025 中国具身智能机器人大会上,云天副总裁罗忆从芯片厂商的视角出发,对具身智能产业的未来进行了深入剖析,并分享了公司在 AI 推理芯片与机器人应用场景方面的整体布局。
    的头像 发表于 11-25 11:26 499次阅读

    算力密度翻倍!江原D20加速卡发布,一双芯重构AI推理标杆

    的关键技术瓶颈。   在此背景下,江原科技推出采用自研AI芯片的AI加速卡江原D10,并在今年5月实现量产交付。在大算力AI芯片全流程国产化产业链实现首次突破后,11月11日,江原科技再次发布新一代全国产AI加速卡——江原D20
    的头像 发表于 11-14 08:21 9476次阅读
    算力密度翻倍!江原D20<b class='flag-5'>加速卡</b>发布,一<b class='flag-5'>卡</b>双芯重构AI<b class='flag-5'>推理</b>标杆

    云天与金蝶达成战略合作

    11月4日,在2025金蝶全球创见者大会上,云天与金蝶签署战略合作协议。
    的头像 发表于 11-05 18:09 1484次阅读

    云天亮相2025湾区半导体产业生态博览会

    在2025湾区半导体产业生态博览会(湾芯展)上,云天以“算力积木”为核心理念,携全栈AI推理产品体系重磅亮相,集中展示了从芯片到模组再到整机的完整布局,全面呈现在AI
    的头像 发表于 10-16 17:45 788次阅读

    云天正式加入OISA生态

    近日,云天正式加入 OISA 生态,携手产业伙伴共同推动国产 AI 芯片互联体系建设,为中国算力生态注入新的动力。
    的头像 发表于 10-11 13:59 413次阅读

    云天亮相2025全球AI芯片峰会

    9 月 17 日,全球 AI 芯片峰会在上海举行,云天董事长兼 CEO 陈宁出席并发表演讲。
    的头像 发表于 09-17 17:56 1094次阅读

    寒武纪基于思元370芯片的MLU370-X8 智能加速卡产品手册详解

    MLU370-X8智能加速卡是全面升级的数据中心训推一体AI加速卡,基于寒武纪全新一代思元370芯片,接口为PCIe 4.0 X16,是全高全长双宽(FHFL-Dual-Slot)的标
    的头像 发表于 04-24 17:57 4043次阅读
    寒武纪基于思元370芯片的MLU370-<b class='flag-5'>X</b>8 智能<b class='flag-5'>加速卡</b>产品手册详解

    云天AI技术为智慧教育注入新动能

    2月20日-21日,云天受邀参加“科学教育•社会协同”资源对接交流活动。在会上,云天全面
    的头像 发表于 02-21 14:13 1005次阅读

    云天收到深空探测实验室感谢信

    殷殷之谊,饮水思源。深空探测事业与深空探测实验室的高质量发展离不开云天的鼎力支持和指导帮助。云天
    的头像 发表于 01-14 16:09 1105次阅读

    科大讯即将发布讯星火深度推理模型X1

    ,标志着科大讯飞在AI技术领域的又一次重大突破。讯星火深度推理模型X1将为科大讯的智能体产品注入更为强大的AI能力,使其在处理复杂任务
    的头像 发表于 01-08 10:30 1025次阅读

    云天联合发布AI智能眼镜

    近日,云天飞在互动平台上宣布,公司与闪极科技、LOHO眼镜品牌携手合作,共同推出了全新的AI智能眼镜。这款眼镜不仅集成了云天
    的头像 发表于 12-26 11:05 1647次阅读

    云天首款AI眼镜正式发布

    近日,云天与闪极科技、LOHO联合打造的AI智能眼镜正式发布。该产品搭载云天自研大
    的头像 发表于 12-20 16:37 1135次阅读