0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

英特尔新推AI芯片Nervana

SSDFans 来源:cc 2019-01-24 09:54 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

在拉斯维加斯举行的2019年国际消费电子展上,英特尔数据中心集团执行副总裁Navin Shenoy宣布英特尔Nervana神经网络推理处理器将于今年投入生产。早在2016年,英特尔就以4.08亿美元的价格从圣地亚哥收购了拥有48人的AI SAAS初创公司Nervana。 Nervana当时是一家软件公司,提供一个名为Nervana Cloud的全栈软件即服务平台,在一个名为Neon的开源框架基础上支持定制深度学习应用程序的开发。

据报道,Nervana当时正致力于开发用于神经网络处理的定制芯片,他们声称使用这种芯片AI加速器的性能至少会领先GPU10倍。当然,开发自定义处理器对于小型软件团队来说是一项艰巨的任务,但是在它被英特尔收购后,要实现这一想法就变得现实多了。现在,英特尔宣布推出第一款产品,用于推理的英特尔Nervana神经网络处理器,简称NNP-I。该公司还宣布将在今年下半年推出代号为“Spring Crest”的神经网络训练处理器。Nervana Engine最初是采用28nm技术开发的,计划在发布之前升级到14nm。英特尔目前还没有做出回应,但我们推断今年交付的设备将采用英特尔的14nm FinFET技术,未来或许会改用10nm。

英特尔表示Nervana正在与Facebook合作开发,这是一个很有意思的消息,因为Facebook是“超七”数据中心公司,其加速策略一直是不公开的。谷歌开发了自己的处理器,微软,亚马逊和AWS等公司也在基于FPGA的加速方面投入了大量资金。和Facebook成为开发合作伙伴,应该能让Nervana在今年下半年全面上市时获得可靠的端到端认证

神经网络训练和推理是计算密集型的,涉及矩阵的张量乘法和卷积。多年来,图形处理单元(GPU)一直是人工智能训练加速的首选解决方案,而FPGA一直在努力开拓推理游戏中的竞争优势。就像现成的芯片一样,GPU可以充分利用其高度并行的矢量和线性代数功能,非常适合人工智能任务。但是,由于GPU并非专为人工智能而设计,所以当涉及到人工智能和深度学习的架构优化时,GPU仍然有很多问题需要解决。

类似地,FPGA可以通过更低的功耗为推理任务提供极高的并行性和性能,因为不同于训练,推理任务可以通过降低精度的定点计算来完成。大型数据中心和公有云已经开始利用FPGA集群来加速推理任务,在吞吐量、延迟和计算效率方面取得了显着成果。然而,与GPU类似,典型的FPGA上有许多不涉及AI计算的硬件,许多可编程架构使得FPGA作为通用设备非常棒,但作为AI处理器却不够理想。

Nervana是从GPU内核的深度学习开发人员的角度来解决这个问题的,这让他们深刻地认识到GPU对于AI任务的局限性。该公司表示,Nervana引擎是从头开始设计的,抛弃了GPU架构,重新开始。他们分析了许多深层神经网络,并提出了他们认为的最适合关键操作的架构。他们还提出了一种新的数字格式——FlexPoint,它试图最大化16位存储的精度。

由于人工智能计算可能非常耗费内存,因此Nervana需要能够快速移动大量数据。Nervana设备包括32GB的内置高带宽内存(HBM),可提供8Tb/s的内存访问带宽。HBM存储器通过芯片3D堆叠实现高容量。一个HBM芯片栈可以存储8GB的数据,其中包含8个1GB的独立内存模块。Nervana引擎包括4个HBM栈,提供32GB的存储。英特尔的多模封装技术将HBM与处理器核心阵列连接起来。我们推测这是由英特尔的2.5D嵌入式多模互连桥(EMIB)技术而不是新宣布的FOVEROS 3D封装完成的,不过英特尔并没有给出明确答案。

Nervana引擎由一系列“Tensor Processing Cores”组成,这些核心由HBM基板、内存接口和高速IO组成,旨在将许多Nervana设备组合在一起,以提供超大规模的网络部署。英特尔尚未给出新设备的具体性能或功耗数据,只是说功耗将达到数百瓦,和Movidius和Mobileye等边缘目标AI设备相比,Nervana明显将用于数据中心。

该设备包括六条双向高带宽链路,该公司表示该芯片能够在机箱内部或机箱之间无缝连接。该公司表示,这使用户能够通过简单地分配更多的计算,或者在不降低速度的情况扩展模型规模,从而在当前模型上获得线性加速。将多台设备连接在一起可以作为一个大处理器。

Nervana的目标是在数据中心抢食GPU和FPGA的市场。由于英特尔在其PSG部门(前身为Altera)拥有世界上最好的FPGA技术之一,因此它认为Nervana在推理方面超过FPGA,在训练方面比GPU具有更明显的优势。特别是英伟达(NVIDIA),它在AI训练领域占据着主导地位,显然是Nervana瞄准的目标。

随着更多不同领域的AI设备进入市场,目前的通用处理器芯片无法满足需求,会有越来越多的AI芯片出现,我们将拭目以待。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 英特尔
    +关注

    关注

    61

    文章

    10391

    浏览量

    183362
  • AI芯片
    +关注

    关注

    17

    文章

    2259

    浏览量

    37499

原文标题:英特尔推出AI芯片:Nervana

文章出处:【微信号:SSDFans,微信公众号:SSDFans】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    英特尔炮轰,AMD回击!掌机市场芯片之争

    电子发烧友网报道(文/李弯弯)近日在CES展会期间,英特尔与AMD在掌机芯片领域展开激烈交锋。英特尔高管Nish Neelalojanan火力全开,抨击AMD在掌机市场销售的芯片是“老
    的头像 发表于 01-12 09:09 6121次阅读

    英特尔亮相Hot Chips 2026 公开智能体AI时代全新芯片架构思路

    在2026年举办的Hot Chips芯片技术大会上,英特尔带来了面向智能体AI时代的全新硬件架构展示,把未来适配AI智能体运行的芯片设计思路
    的头像 发表于 08-27 09:25 464次阅读

    英特尔携手Google Cloud,共推AI驱动企业转型落地

    近期,全球芯片巨头英特尔与云服务领军者Google Cloud宣布深化战略合作,双方围绕英特尔全栈AI硬件与软件能力,在Google Cloud平台上打造一系列深度优化的
    的头像 发表于 07-22 09:23 401次阅读

    【新闻】英特尔亮相第四届链博会,AI PC生态伙伴艾为电子以全链路芯片点亮 AI PC 新升级

    6月26日,第四届中国国际供应链促进博览会在北京圆满落幕。作为国家级供应链展示平台,本届链博会首次设立人工智能专区,集中展示云端协同AI全产业链成果。英特尔以“AI落地,芯筑基石”为主题亮相展会
    的头像 发表于 07-02 18:33 392次阅读
    【新闻】<b class='flag-5'>英特尔</b>亮相第四届链博会,<b class='flag-5'>AI</b> PC生态伙伴艾为电子以全链路<b class='flag-5'>芯片</b>点亮 <b class='flag-5'>AI</b> PC 新升级

    英特尔亮相火山引擎,用系统协同推动Agentic AI落地

    云端之上,数字员工承接各类工作任务,端侧设备中,AI自动完成创意制作。在火山引擎FORCE原动力大会上,英特尔展示了包括上述应用在内的内容创作、AI算力加速、智能体部署等AI落地场景,
    的头像 发表于 06-29 10:34 3745次阅读
    <b class='flag-5'>英特尔</b>亮相火山引擎,用系统协同推动Agentic <b class='flag-5'>AI</b>落地

    英特尔携手长安天枢座舱 以AI Box Ultra打造全场景贴心智能驾乘体验

    在近期举办的第四届中国国际供应链促进博览会上,英特尔与长安汽车正式官宣达成深度合作,将搭载第三代英特尔酷睿Ultra处理器的AI Box Ultra硬件方案,首次大规模落地搭载于长安天枢AI
    的头像 发表于 06-25 09:39 1720次阅读

    英特尔AI Box Ultra首次量产上车,长安天枢座舱装上本地AI大脑

    近日,第四届中国国际供应链促进博览会期间,英特尔与长安汽车联合发布搭载英特尔AI Box Ultra的AI座舱解决方案,对应产品为长安天枢座舱AI
    的头像 发表于 06-24 10:35 1844次阅读

    Cadence宣布与英特尔代工扩大合作

    期协议将 Cadence 的代理式 AI 驱动 EDA 和设计 IP 解决方案,与英特尔的工艺创新和先进设计专长相结合。
    的头像 发表于 06-14 14:40 473次阅读

    英特尔在Computex发布多项AI创新成果

    英特尔在Computex发布 多项 AI创新 成果 从芯片到机架级AI解决方案,携手战略行业合作伙伴共同交付客户   今天,在Computex 2026,
    的头像 发表于 06-02 18:26 2288次阅读

    英特尔年底前将推出Crescent Island推理芯片

    英特尔计划在2026年年底前推出一款名为"Crescent Island"的AI推理芯片。这款芯片不与英伟达在模型训练赛道上正面交锋,而是专门瞄准A
    的头像 发表于 06-02 10:28 720次阅读

    英特尔推出全新至强6+、网络与AI系统解决方案,推动智能体AI落地生根

    6月1日,英特尔宣布数据中心领域最新进展,推出全新英特尔至强6+处理器,发布以太网800系列新成员—英特尔以太网E835控制器及网络适配器,以及AI加速器路线图的最新进展,包括Cres
    的头像 发表于 06-01 13:35 4007次阅读
    <b class='flag-5'>英特尔</b>推出全新至强6+、网络与<b class='flag-5'>AI</b>系统解决方案,推动智能体<b class='flag-5'>AI</b>落地生根

    苹果与英特尔正式达成代工协议,芯片供应链格局迎来重大调整

    经过一年多的密集磋商,苹果与英特尔近日正式达成代工合作协议。据业内多方消息,待英特尔18A-P工艺成熟上线后,英特尔或将为苹果代工CPU核心,而台积电继续负责GPU部分;另有观点认为,苹果可能先将上代手机
    的头像 发表于 05-09 11:12 2297次阅读

    AI工作站本地养龙虾!英特尔双芯混合算力,告别云端Token焦虑

    4月23日,英特尔公司在北京举办新一代AI工作站平台发布会,英特尔中国区技术部总经理高宇宣布,面向AI工作站,英特尔推出两大重磅产品:
    的头像 发表于 04-26 16:27 1.2w次阅读
    <b class='flag-5'>AI</b>工作站本地养龙虾!<b class='flag-5'>英特尔</b>双芯混合算力,告别云端Token焦虑

    英特尔与华阳通用联手推出全新AI Box解决方案

    英特尔宣布推出基于最新英特尔 酷睿 Ultra 架构的AI Box解决方案,将PC级旗舰算力引入汽车、工业自动化、轨道交通、机器人等多种工业环境,为各行各业接入AI大模型提供高效灵活的
    的头像 发表于 03-02 14:15 1129次阅读

    英特尔举办行业解决方案大会,共同打造机器人“芯”动脉

    11月19日,在2025英特尔行业解决方案大会上,英特尔展示了基于英特尔® 酷睿™ Ultra平台的最新边缘AI产品及解决方案,并预览了针对边缘侧的
    的头像 发表于 11-19 21:51 7645次阅读
    <b class='flag-5'>英特尔</b>举办行业解决方案大会,共同打造机器人“芯”动脉