0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

探究GDDR6给FPGA带来的大带宽存储优势以及性能测试(上)

Achronix 来源:Achronix 作者:黄仑 2021-12-03 11:31 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

1.概述

随着互联网时代的到来,人类所产生的数据发生了前所未有的、爆炸性的增长。IDC预测,全球数据总量将从2019年的45ZB增长到2025年的175ZB[1]。同时,全球数据中近30%将需要实时处理,因而带来了对FPGA等硬件数据处理加速器的需求。如图1所示。

在这样的数据高速增长的情况下,用于传输数据的网络带宽和处理数据所需要的算力也必须急速增长。传统的CPU已经越来越不堪重负,所以用硬件加速来减轻CPU的负担是满足未来性能需求的重要发展方向。未来的硬件发展需求对于用于加速的硬件平台提出了越来越高的要求,可以概括为三个方面:算力、数据传输带宽和存储器带宽。Achronix的新一代采用台积电7nm工艺的Speedster 7t FPGA芯片根据未来硬件加速和网络加速的需求,在这三个方面都做了优化,消除了传统FPGA的瓶颈。下面我们重点说一说为了提高存储器带宽,Achronix通过采用硬核GDDR6控制器所带来的优势。2.

GDDR6的发展

在GDDR的设计之初,其定位是针对图形显示卡所特别优化的一种DDR内存。因为2000年后电脑游戏特别是3D游戏的发展和火爆,使运行电脑游戏的显卡需要有大量的高速图像数据交互需求,GDDR在这种情况下应运而生。第一个GDDR标准是基于DDR的GDDR2,随后发展到了基于DDR3的GDDR5,在一段时间中非常流行。

2016年,GDDR5X正式发布,它引入了具有16n预取的四倍数据速率模式,但代价是访问粒度从GDDR5的32Byte提高到了64Byte。2018年,GDDR6发布,数据速率达到了16Gbps,带宽几乎是GDDR5X的两倍,同时采用了双通道设计,访问粒度和GDDR5一样是32Byte。

3.GDDR6和DDR4/5的比较

GDDR一直以来是针对图形显示卡所优化的一种DDR内存。因为显卡处理图像数据,特别是3D图像数据对显存带宽的要求更高,GPU和GDDR之间的数据交换非常频繁。而DDR内存专注于与CPU进行数据交换的效率,因此对于整体存取性能、低延迟更为看重,所以在CPU和传统的FPGA中基本都是用DDR4。

随着硬件加速需求对于存储器的带宽提出了越来越高的要求,传统的DDR4带宽显然已经无法满足要求,Achronix看重了GDDR6在数据存储中的带宽优势,创新地将GDDR6引入到了FPGA,彻底解决了传统FPGA存储带宽不够的瓶颈。2020年7月15日,JEDEC存储协会正式发布了DDR5 SDRAM的标准(JESD79-5),内存的频率相对DDR4的标准频率有了大幅的提升,总传输带宽也提升了38%,但是还是和GDDR6的带宽有一定的差距。GDDR6和DDR4/5的带宽对比。

473c6de8-52b8-11ec-b2e9-dac502259ad0.png

图2 GDDR与DDR带宽发展对比

如果实现同一个大带宽存储的应用,在提供相同的存储器带宽的情况下,无论在设计复杂度,PCB占用面积,还是在功耗方面,与DDR4相比,GDDR6的性能都有很大的提高,如图3所示[2]。

476b1eae-52b8-11ec-b2e9-dac502259ad0.png

图3 GDDR6和DDR4性能对比4.

GDDR6和HBM2的比较

HBM全称High Bandwidth Memory,最初的标准是由JEDEC在2013年发布。2016年1月,HBM的第二代HBM2正式成为工业标准。HBM的出现也是为了解决存储器带宽问题。与GDDR6不同的是,HBM内存一般是由4个或者8个HBM的Die堆叠形成,我们称之为一个Stack。如图4所示[4]。

4793243a-52b8-11ec-b2e9-dac502259ad0.png

图4 HBM Die的堆叠

我们以市面上带有HBM2的高端 FPGA为例,这个系列的FPGA集成了1~2个这样的HBM2 Stack。两个Stack之间是相互独立的,各自有自己的地址空间。

每个Die都有独立的两个128bit的Channel,所以4个Die 8个通道就是1024bit的位宽,HBM2的频率是900MHz,按DDR的方式访问,一个Stack总共带宽是 900(MHz)x 2(DDR)x 1024(位宽)/8 = 230GB/s,两个Stack最高可以到460GB/s的带宽。

Achronix的Speedster 7t FPGA集成了8个GDDR6的硬核,每个GDDR6的硬核支持双通道。总的带宽是 16Gbps x 16(位宽)x 2(通道)x 8(控制器)/8 = 512 GB/s,略高于带HBM2的FPGA存储器带宽。

从成本上来看,目前GDDR6与HBM2相比有着很大的优势,HBM2技术工艺要求高,目前芯片的良率和产量都会受到很大的影响。同时GDDR6使用起来更灵活,使用片外的DRAM,可以根据应用要求,选择不同速率,不同容量的GDDR6颗粒。HBM2的优势在于集成度高,不占用PCB板的面积。图5是DDR4、GDDR6和HBM2在成本上的一个综合比较。

编辑:jq

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • FPGA
    +关注

    关注

    1665

    文章

    22581

    浏览量

    641071
  • 存储器
    +关注

    关注

    39

    文章

    7771

    浏览量

    172477
  • 带宽
    +关注

    关注

    3

    文章

    1058

    浏览量

    43693
  • HBM
    HBM
    +关注

    关注

    2

    文章

    438

    浏览量

    15915

原文标题:GDDR6给FPGA带来的大带宽存储优势以及性能测试(上)

文章出处:【微信号:Achronix,微信公众号:Achronix】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    相变存储器 (PCM) 技术介绍

    ,这种结合的优势显著。它在提供更大存储器容量和更高集成度的同时,提高了性能并降低了功耗。 稳健可靠PCM技术经过开发和测试,可满足高温运行、抗辐射和数据保留要求。PCM的工作温度高达+
    发表于 04-29 15:58

    探究ISL62884CEVAL2Z评估板:设计、测试与应用

    探究ISL62884CEVAL2Z评估板:设计、测试与应用 在硬件设计领域,评估板是检验芯片性能和功能的重要工具。今天,我们就来深入了解一下ISL62884CEVAL2Z评估板,看看它如何展示
    的头像 发表于 04-13 18:05 468次阅读

    深入解析IGLOO2 FPGA与SmartFusion2 SoC FPGA性能、特性与应用

    、高性能和低功耗等优势,在众多领域得到了广泛应用。今天,我们就来详细探讨Microsemi公司的IGLOO2 FPGA和SmartFusion2 SoC FPGA,深入了解它们的特性、
    的头像 发表于 04-07 11:55 313次阅读

    探索Arria V系列FPGA:高性能与低功耗的完美结合

    ,更是在中高端市场中占据了重要的地位。今天,我们就来深入了解一下Arria V系列FPGA的特点、优势以及不同型号的具体信息。 文件下载: 5ASTFD3G3F35I3N.pdf 一、Arria V系列
    的头像 发表于 03-29 13:05 283次阅读

    RIGOL超便携示波器的性能优势

    投入承受较大压力。同时,面向现场应用的手持式仪器虽然提升了机动性,但普遍存在性能受限的问题,例如带宽不足、分析功能不完整、复杂信号处理能力偏弱,难以全面覆盖实际测试需求。
    的头像 发表于 03-14 15:32 2102次阅读
    RIGOL超便携示波器的<b class='flag-5'>性能</b>与<b class='flag-5'>优势</b>

    AMD 推出第二代 Kintex UltraScale+ 中端FPGA,助力智能高性能系统

    · 新款FPGA 可为下一代医疗、工业、测试与测量以及广播系统提供高带宽、实时性能与广泛连接。 · 借助成熟的工具、先进的安全特性
    的头像 发表于 02-04 16:11 6.3w次阅读
    AMD 推出第二代 Kintex UltraScale+ 中端<b class='flag-5'>FPGA</b>,助力智能高<b class='flag-5'>性能</b>系统

    性能网络存储设计:NVMe-oF IP的实现探讨

    ,给出如何测试以及结果。 https://www.bilibili.com/video/BV1f6mbBeEiH/?spm_id_from=333.337.search-card.all.click&vd_source
    发表于 12-19 18:45

    CW32L010F8P600的优势

    48MHz的ARM®Cortex®-M0+内核。 集成高精度模拟数字转换器(ADC):支持最多16+1路I/O接口。 ,CW32L010F8P600在存储容量、安全性、功耗控制、定时器设计、LatchUp测试成绩、ESD防护、性能
    发表于 11-13 07:07

    如何利用Verilog HDL在FPGA实现SRAM的读写测试

    本篇将详细介绍如何利用Verilog HDL在FPGA实现SRAM的读写测试。SRAM是一种非易失性存储器,具有高速读取和写入的特点。在FPGA
    的头像 发表于 10-22 17:21 4658次阅读
    如何利用Verilog HDL在<b class='flag-5'>FPGA</b><b class='flag-5'>上</b>实现SRAM的读写<b class='flag-5'>测试</b>

    FPGA测试DDR带宽跑不满的常见原因及分析方法

    FPGA测试 DDR 带宽时,带宽无法跑满是常见问题。下面我将从架构、时序、访问模式、工具限制等多个维度,系统梳理导致 DDR 带宽
    的头像 发表于 10-15 10:17 1407次阅读

    【上海晶珩睿莓1开发板试用体验】5、网络性能测试

    定的结果、JSON 输出(便于脚本化)以及更好的单次测试控制。 主要用途: 测量点对点带宽(客户端 ↔ 服务端) 测试不同协议(TCP/UDP)的吞吐量与丢包情况 验证链路质量、MTU
    发表于 08-19 10:25

    电极阻抗测试仪精度0.1%怎么选?行业工程师避坑指南

    :Bamtone班通的TDR阻抗测试仪基于时域反射原理设计,具有高带宽特性,适用于PCB硬板、FPC软板阻抗条快速测试以及高频电缆、双绞线、电线电缆的阻抗
    发表于 07-28 10:13

    简单认识高带宽存储

    HBM(High Bandwidth Memory)即高带宽存储器,是一种基于 3D 堆叠技术的高性能 DRAM(动态随机存取存储器)。其核心设计是通过硅通孔(TSV)和微凸块(Mic
    的头像 发表于 07-18 14:30 6085次阅读

    性能低功耗双核Wi-Fi6+BLE5.3二合一

    功耗无线专业知识,最大限度地发挥Wi-Fi和BLE在各种应用中的超低功耗优势。作为一款支持BLE模式和Wi-Fi 6双频连接的模块,它采用独立天线设计,互不干扰,为用户提供了更加稳定和可靠的无线连接性能
    发表于 06-28 21:42

    RDMA简介1之RDMA开发必要性

    灵活性、高并行能力及可高度定制化的特点,能够在各种应用场景下实现高带宽的数据采集、存储及传输。然而FPGA并不擅长进行数据存储工作,仅在内部集成少量片
    发表于 06-03 14:38