0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

NOR闪存架构有怎样的特点和优势?

我快闭嘴 来源:半导体行业观察 作者:半导体行业观察 2020-09-28 16:19 次阅读

随着物联网时代的到来,海量的数据蜂拥而至。特别是各种应用终端和边缘侧需要处理的数据越来越多,而且对处理器的稳定性,以及功耗提出了越来越高的要求,这样,传统的计算体系和架构的短板就显得愈加突出,未来,具有更高效率和更低功耗的计算系统一定会大行其道。

在这样的背景下,存算一体(Computing In Memory,内存内计算)AI芯片应运而生。目前,不少国际上的领先企业和研究机构正在致力于各种新型存储器的研究,其中一个很大的驱动力就是希望能够实现具有更高效率的存算一体系统,而在这其中,AI的融入也是一大趋势。这些使得计算+存储+AI的融合发展成为了一大方向。

不仅是在国际上,最近几年,我国本土的一些企业和科研院所也在致力于这方面的研究工作。就在上周,合肥恒烁半导体科技公司与中国科大团队历时两年共同研发的基于NOR闪存架构的存算一体AI芯片系统演示顺利完成。这是国际领先的超低功耗存算一体的人工智能芯片。据悉,该芯片是一款具有边缘计算和推理能力的AI芯片,能实时检测通过摄像头拍摄的人脸头像并给出计算概率,可广泛应用于森林防火中的人脸识别与救援、心电图的实时监测、人工智能在人脸识别上的硬件解决方案等。

这也是我国本土企业在基于NOR闪存架构的存算一体AI芯片领域的又一次突破,实际上,在该领域,恒烁半导体并不是唯一一家,还有其它一些企业也在进行着基于NOR闪存架构的低功耗AI芯片的研究工作。那么,作为一种传统的、非前沿的存储技术,NOR闪存架构有怎样的特点和优势,能够使得这些企业对其投入资源和人力,进行相应的低功耗AI芯片和系统研发呢?

存算一体的优势

在谈基于NOR闪存架构AI芯片的特点和优势之前,先来看一下存算一体芯片的优势及其能够解决的主要问题。

目前来看,不论是PC还是超算,处理器和存储芯片都是分离的,这就是冯诺依曼50多年前确立的计算架构。随着技术的发展,存储计算分离的架构瓶颈越来越明显。

一般芯片的设计思路是增加大量的并行计算单元,比如上千个AI卷积单元,这样,需要调用的存储资源也在增大,然而,在传统的计算架构当中,存储一直是有限且稀缺的资源,随着运算单元的增加,每个单元能够使用的存储器的带宽和大小将逐渐减小,而随着人工智能时代的到来,这种矛盾显得愈加突出,特别是对于物联网来说,网络的每一层,现有权重和每个AI训练示例的元素都被加载到处理器的寄存器中,然后相乘,并将结果写回到存储器中。这样,性能瓶颈就不是在计算一侧了,而是处理器和存储器阵列之间的带宽。存储器和处理器之间的这种分离是冯·诺依曼架构的定义特征之一,并且存在于几乎所有现代计算系统中。

这种“存储墙”的高起正在阻碍着AI产业的发展,可以说,存储器是AI芯片发展的最大瓶颈。

在很多AI推理运算中,90%以上的运算资源都消耗在数据搬运的过程中。芯片内部到外部的带宽,以及片上缓存空间限制了运算的效率。因此,在业界和学术界,越来越多的人认为存算一体化是未来的趋势,可以很好地解决“存储墙”问题。

如果能够让计算和内存更紧密地结合在一起,甚至是在内存内进行计算,就可以大幅提升数据的传输效率,同时节省更多的电能,因为在内存和计算之间不再需要往返太多次数,一切处理过程都再同一芯片内完成了。

分类

为了应对物联网以及存算一体的应用需求,各种新型的、传统的存储技术和器件纷纷登场,想在这些新兴应用方面尽量地施展出自己的才华。

过去50年中,SRAMDRAM和Flash已经成为存储器的主力,这些存储结构在往更小的几何结构微缩的过程中都存在问题,很重要的原因在于它们都是平面结构,而新的存储技术,如基于电阻开关的存储技术是金属层结构,消除了许多制造问题。然而,由于DRAM和Flash技术已经非常成熟,成本又很低。所以,它们在存算一体方面依然有独到的优势,也正在被一些企业所采用

目前来看,新型的存储技术主要包括相变存储器(PCM)、铁电存储器(FeRAM)、磁阻RAM(MRAM)、电阻RAM(RRAM或 ReRAM)、自旋转移力矩RAM(STT-RAM)、导电桥RAM(CBRAM),以及氧化物电阻存储器(OxRAM)等。基于这些的存算一体研究或多或少地都在进行着,相应的成果也经常见诸于报端。以上这些都是新技术,目前来看,它们的主要问题就是成本,以及生态系统的完整度,还需要一些发展时间才能成气候。

而从存储与计算的结合方式来看,存算一体又可以分为两大类:一是在DRAM中植入逻辑计算单元,被称为内存内处理或者近数据计算,这种方式非常适合云端的大数据和神经网络训练等应用;二是存储和计算完全结合在一起,存储器件也即计算单元,如采用基于NOR闪存架构的存算一体AI芯片,其主要特点是能耗低、运算效率高、速度快且成本低,这种形式比较适合边缘侧的神经网络推理等应用。

NOR闪存架构的优势

基于NOR闪存架构的存算一体AI芯片,利用NOR Flash的模拟特性,可直接在存储单元内进行全精度矩阵卷积运算(乘加运算)。规避了数据在ALU和存储器之间来回传输的瓶颈,从而使功耗大幅降低、提高了运算效率。

其Flash存储单元可以存储神经网络的权重参数,同时还可以完成和此权重相关的乘加法运算,从而将乘加法运算和存储融合到了一个Flash单元里面。例如,100万个Flash单元可以存储100万个权重参数,同时还可以并行完成100万次乘加法运算。

在这样的芯片里面,深度学习网络可以被映射到多个Flash阵列,这些Flash阵列不仅可以存储数据,其深度学习网络同时还能完成AI推理,注意,这个过程是不需要额外逻辑计算电路的,一切处理都在这一块芯片内完成。相比于传统的冯诺依曼架构深度学习芯片,这种的运算效率非常高,而且成本低廉,因为省去了DRAM、SRAM以及片上并行计算单元,从而简化了系统设计。

目前来看,这种基于NOR闪存架构的存算一体AI芯片,其主要应用领域就是对成本和运算效率(特别是功耗)敏感的应用,如边缘侧的低功耗、低成本语音识别等。而随着人工智能和物联网的发展,它还可以拓展更多的应用场景。

结语

无论是新型存储技术,还是以NOR闪存为代表的老牌技术,在发展存算一体AI芯片方面,都需要不断完善生态系统建设,才能使整个产业发展起来。

因此,除了存储和计算技术本身之外,行业相关的接口标准跟进特别重要,特别是对于以存储为基础的新型应用来说,更加重要。另外,由于芯片内部集中了越来越多的功能块,片内总线和片内网络系统成为了一个新的课题,目前,这方面的研究和新技术越来越受到业界的重视,新的技术和IP也陆续推出。
责任编辑:tzh

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 处理器
    +关注

    关注

    68

    文章

    18024

    浏览量

    221539
  • 芯片
    +关注

    关注

    445

    文章

    47476

    浏览量

    407884
  • 存储器
    +关注

    关注

    38

    文章

    7080

    浏览量

    161686
  • 物联网
    +关注

    关注

    2860

    文章

    41250

    浏览量

    357384
收藏 人收藏

    评论

    相关推荐

    CYUSB3KIT-003如何集成一个NOR闪存

    一个 CYUSB3KIT-003。 我需要集成一个 NOR 闪存,我可以从中将固件读取到 RAM,然后 NOR 闪存的一部分内存应该EV
    发表于 03-05 07:23

    2024年1月,预计NOR Flash价格将上涨5%

     NOR Flash是一种基于NOR门结构的闪存NOR是逻辑门电路中的“或非”门。NOR Flash具有并行访问结构,这意味着每个存储单元
    发表于 12-27 14:37 302次阅读

    Nor Flash与NAND Flash闪存技术的关键特点区分

    Nor Flash采用NOR门结构,其中每个存储单元都有不同的地址用于直接访问。这种并行访问功能可以实现高效的随机访问和快速的数据检索。
    的头像 发表于 12-05 15:21 372次阅读

    Nor Flash的基本概念 Nor Flash的内部结构解析

    Nor Flash是一种非易失性存储技术,用于存储数据和代码。它是一种闪存存储器,类似于NAND Flash,但具有不同的特性和应用场景。
    的头像 发表于 12-05 13:57 880次阅读

    NAND Flash和NOR Flash的区别

    NAND Flash和NOR Flash是两种常见的闪存类型。
    的头像 发表于 11-30 13:53 774次阅读
    NAND Flash和<b class='flag-5'>NOR</b> Flash的区别

    NAND FLASH与NOR FLASH的技术对比

    目前,NOR FLASH和NAND FLASH是市场上主要的非易失性闪存技术,但是据我了解,还是有很多工程师分不清NAND FLASH与NOR FLASH。
    发表于 10-01 14:05 489次阅读
    NAND FLASH与<b class='flag-5'>NOR</b> FLASH的技术对比

    NOR Flash的技术体系和结构特点

    本文分析了NOR Flash的技术体系,结构特点,并对实现数据存储的基本原理以及发展趋势进行介绍。
    发表于 09-22 12:20 2063次阅读
    <b class='flag-5'>NOR</b> Flash的技术体系和结构<b class='flag-5'>特点</b>

    使用STARTUPE3对并行NOR闪存进行配置后访问的UltraScale FPGA应用说明

    电子发烧友网站提供《使用STARTUPE3对并行NOR闪存进行配置后访问的UltraScale FPGA应用说明.pdf》资料免费下载
    发表于 09-14 15:18 1次下载
    使用STARTUPE3对并行<b class='flag-5'>NOR</b><b class='flag-5'>闪存</b>进行配置后访问的UltraScale FPGA应用说明

    NAND Flash和NOR Flash的差别

    存储器,NOR 与NAND 存储逻辑的差异导致二者的应用场景有很大不同。NOR优势在于随机读取与擦写寿命,因此适合用来存储代码;NAND 的优势在于单位比特成本,花同样的钱可以获得
    发表于 09-11 16:59 1978次阅读
    NAND Flash和<b class='flag-5'>NOR</b> Flash的差别

    使用高速NOR闪存配置FPGA

    点击上方 蓝字 关注我们 NOR闪存已作为FPGA(现场可编程门列阵)的配置器件被广泛部署。其为FPGA带来的低延迟和高数据吞吐量特性使得FPGA在工业、通信和汽车ADAS(高级驾驶辅助系统
    的头像 发表于 08-15 13:55 337次阅读
    使用高速<b class='flag-5'>NOR</b><b class='flag-5'>闪存</b>配置FPGA

    谈一谈RISC-V架构优势特点

    RISC-V是基于精简指令集计算(RISC)原理建立的开放指令集架构,是一种与X86,ARM并列的一种计算指令集架构。RISC是一个开放的芯片架构,可以免费授权。客户可以添加自己的扩展,并为包括
    发表于 05-14 09:05

    iMX8QXP擦除NOR闪存的“boot0”分区时,没有任何反应是为啥?

    一个iMX8X iMX8QXP,我正在尝试在 NOR 闪存(最终是 eMMC)上设置辅助引导容器集。我试图在烧掉任何 OTP 保险丝之前验证基本功能,所以这就是我目前对 NOR
    发表于 05-05 10:40

    NOR闪存启动时,Core0如何获取启动代码?

    NOR 闪存启动时,Core0 如何获取启动代码? 电路板设置 (T1024RDB) 是: 开关将 RCW_SRC 设置为 NOR 闪存 PBL/RCW 设置为 BOOT_LOC
    发表于 05-04 07:16

    如何通过SPI-NOR闪存启动i.MX6Q?

    我正在尝试使用 i.MX6Q 从我的定制板上的 SPI-NOR 存储设备启动,但似乎几件事我不太明白。 1. 我是使用 mtdparts 还是 devicetree 对我的旋量内存进行分区?
    发表于 05-04 06:30

    定制板上的T1042 NOR无法启动是为什么?

    我们一个定制板,其中存在 T1042 处理器。以前我已经能够通过修改 T1042D4DRB QORIQ SDK 项目的 u-boot 源代码从 SDCARD 启动它。现在,我试图从 NOR 闪存启动它,但我无法成功。 我已经将
    发表于 04-17 07:55