0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

把一个算法用RTL实现,有哪些比较科学的步骤?

FPGA之家 来源:FPGA之家 作者:FPGA之家 2022-04-26 10:19 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

针对近日技术交流群里讨论的算法与RTL实现问题,写篇文章,做一次总结。

新手遇到的是新问题,对于有相关经验的工程师而言,可能都遇到过。

作为算法、FPGA和IC等集中交流的平台,群贤毕至,集思广益,解决大家对相关知识和技术上的困惑,让问题变得更简单。

群友们提到一个很多人都会遇到的现实问题:

“把一个算法用RTL实现,有哪些比较科学的步骤?第一步干什么?第二步干什么?第三步干什么……?”

c5cfc0d6-c506-11ec-bce3-dac502259ad0.png

这个问题,对于FPGA、ASIC等逻辑电路设计人员来讲,是非常重要的问题。

通常来讲,我们做算法实现,需要有对标的算法模型,作为验证硬件逻辑设计是否正确的参考依据。

我们首先要根据实际需求,针对某方面的信号处理问题,做一个链路级或模块级快速仿真验证设计。最常见的比如通过MATLAB/C/C++等软件环境进行设计和验证。

c5ddef1c-c506-11ec-bce3-dac502259ad0.png

软件环境可以快速搭建仿真模型,并且进行验证,为硬件RTL实现提供参考依据。在具体算法设计时,必须考虑数据流的处理过程:数据从哪里来,数据需要经过哪些步骤处理,处理之后送到哪里。

接下来,我们需要将MATLAB、C++等算法模型由浮点转为定点,这个工作可以做好之后再去做逻辑设计,也可以省略,但一定要清楚是如何定点的。

做好算法设计后,需要进行性能评估,看是否符合预期要求,不符合则进一步优化,或者换一种设计方法。

在做逻辑实现之前,还有一个重要工作,就是对算法处理步骤进行一步一步分解,解决如何从a到b再到c的过程,落实到加减乘除。

当算法实际满足要求后,则考虑逻辑实现的问题。

首先,建议采用自顶向下的设计思想,进行系统架构设计,明确整个处理过程,需要执行哪些功能,涉及哪些接口

c5ea2908-c506-11ec-bce3-dac502259ad0.png

接下来,选芯片器件,评估资源占用情况,评估需要用多少乘法器,除法器,DSP,BRAM,GT等。

其次,评估处理时间要求,是否需要实时性处理,给予多少时间来处理,进而评估所需时钟频率,以及是否需要存在多个时钟域处理。

c605bc72-c506-11ec-bce3-dac502259ad0.png

对于信号处理系统,有的需要实时处理,有的则不需要实时处理。最具挑战的无疑是实时性要求高的通信、雷达和图像等领域的信号处理问题。

首先解决信号处理中的算法问题,为实现某一处理过程,需要分哪些步骤,最终得到什么样的结果。

为了实现实时处理,逻辑电路该怎么去设计?

c61816e2-c506-11ec-bce3-dac502259ad0.png

于是,算法问题既要研究如何处理数据流的问题,也要研究如何快速处理的问题。

电路实现时,则需要考虑资源消耗、并行处理结构,流水处理和控制逻辑。

c6233ac2-c506-11ec-bce3-dac502259ad0.png

如果有处理速率要求,则需考虑并行+流水的处理方式,并考虑单时钟下的数据位宽。

同时,务必明确数据流向,前后级接口,功能模块内部RTL逻辑处理,细化到每个时钟应该怎么处理,step by step。

c63a474e-c506-11ec-bce3-dac502259ad0.png

以上都比较明确后,可以着手进行RTL设计。RTL设计的核心,便是寄存器、RAM和FSM的灵活使用。其中,FSM占据了大部分功能。通常情况下,我们不只是操作纯数据流,而是在各种控制信号和参数下进行设计,此时涉及各种FSM和选择器设计,并注意是否需要进行流控。

c65190fc-c506-11ec-bce3-dac502259ad0.png

RTL代码设计完成之后,进行TestBench平台搭建和仿真验证是必要的,特别是对于复杂功能模块或系统设计而言。经验再丰富的工程师,也不敢保证,不经过仿真验证直接上板一定没问题。

验证也是一门重要的技术,这也是为什么存在IC验证岗位,目的就是为芯片成功流片严格把关,一旦流片失败,损失重大,影响深远。

FPGA的开发设计,同样需要进行仿真验证。通常,我们可以通过算法链路产生所需激励源,通过TestBench对功能模块进行验证,并进行结果对比分析。重点解决两个问题:

一是验证逻辑时序是否存在问题,比如信号是否对齐,有无接口处理不当导致数据丢失等。

二是信号处理过程是否得当,数据位宽、精度等是否符合算法要求。

解决功能性问题后,就需要考虑性能问题。定点是否合适,与浮点算法性能的差异有多大,或者软件中的定点处理与逻辑电路定点处理,误差有多大。在不断验证过程中,优化算法设计和逻辑电路设计。

剩下的逻辑综合、实现、比特流生成和调试等环节,属于常规操作,但对于逻辑综合、实现中的时序约束和相关策略设置,也是十分重要的。

c671246c-c506-11ec-bce3-dac502259ad0.png

最后,用一张图总结如何从算法到RTL实现。

c68b0e72-c506-11ec-bce3-dac502259ad0.png

本文只是粗略地分析了算法到RTL代码实现之间的逻辑关系,以及从实现角度,我们应该怎么去着手。

具体到某个信号处理算法实现时,必须清楚整个信号处理过程,对算法一步一步分解,再对信号流、定点和接口进行设计。

做任何事情之前,先谋划布局,磨刀不误砍柴工,扎扎实实做好每一步,功到自然成。

审核编辑 :李倩

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • FPGA
    +关注

    关注

    1655

    文章

    22287

    浏览量

    630314
  • 算法
    +关注

    关注

    23

    文章

    4761

    浏览量

    97147
  • 仿真模型
    +关注

    关注

    1

    文章

    31

    浏览量

    12768
  • RTL
    RTL
    +关注

    关注

    1

    文章

    393

    浏览量

    62398

原文标题:从算法到RTL实现,FPGA工程师该怎么做?

文章出处:【微信号:zhuyandz,微信公众号:FPGA之家】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    用于单片机几种C语言算法

    为克服随机干扰引起的误差,硬件上可采用滤波技术,软件上可采用软件算法实现数字滤波。滤波算法往往是系统测控算法
    发表于 11-27 06:00

    RC5算法协处理器设计实现

    1、RC5算法参数选择 通过三可变参数可确定组加密算法,可表示为RC5-w/r/b。w表示明文/秘文字分组后的字长,完整明文/秘文字长为2w;w
    发表于 10-30 08:25

    SM4算法实现分享(算法原理

    。而解密算法与加密算法采用同结构,只是轮密钥使用的顺序不同,加密采用顺序的,解密采用逆序的。 SM4加密算法是典型的分组密码算法,分组密
    发表于 10-30 08:10

    复杂的软件算法硬件IP核的实现

    看到整个实现只有状态“S0”。 对于复杂时序要求的操作,例如加密算法里面常见的 for 循环结构,在生成 begin 和 end 之
    发表于 10-30 07:02

    如何使用恢复算法实现开平方运算

    =0.1101,具体计算过程如下: 硬件实现架构图如下所示,其中我们将8比特的操作数X作为输入,从而得到的Q是4比特的。我们总共用到了17减法模块(SB,Subtract Block),每一个减法模块都是
    发表于 10-24 13:33

    Newton-Raphson算法实现浮点除法(七)

    的牛顿迭代算法,直逼近于f(x) = 0的点,则有xi+1 = xi (2 - xi b),这样我们能够用下述步骤实现a/b: 1)b
    发表于 10-24 07:53

    数据滤波算法的具体实现步骤是怎样的?

    (高频电磁、瞬时脉冲等),选择适配的滤波算法并落地。以下以电能质量监测中最常用的 IIR 低通滤波(抗高频干扰)、滑动平均滤波(抗瞬时脉冲)、卡尔曼滤波(抗动态波动) 为例,详解具体实现步骤
    的头像 发表于 10-10 16:45 429次阅读

    CW32L012实现外部flash下载算法

    外部flash或者内置的片上flash,都是编译器通过调用写好的FLM文件来实现下载,单片机内部的安装pack包就会有(官方实现),外部flash的情况比较复杂,例如用的哪种flash,
    的头像 发表于 10-09 17:38 1200次阅读
    CW32L012<b class='flag-5'>实现</b>外部flash下载<b class='flag-5'>算法</b>

    【「AI芯片:科技探索与AGI愿景」阅读体验】+AI的科学应用

    AI被赋予了人的智能,科学家们希望在没有人类的引导下,AI自主的提出科学假设,诺贝尔奖级别的假设哦。 AI驱动科学被认为是科学发现的第五
    发表于 09-17 11:45

    款内部4步骤交流直接LED驱动IC-WD15-S30A

    LED驱动芯片 - WD15-S30A是款交流直接LED驱动IC,内部4步骤。它可以从整流的交流电压下驱动几个系列的led。它将提供很大的方便的设计,因为它需要少量的外部组件。
    的头像 发表于 03-12 09:35 555次阅读
    <b class='flag-5'>一</b>款内部<b class='flag-5'>有</b>4<b class='flag-5'>个</b><b class='flag-5'>步骤</b>交流直接LED驱动IC-WD15-S30A

    FOC 算法实现永磁同步电机调整指南

    本文档介绍了使用 FOC 算法实现永磁同步电机 (Permanent Magnet SynchronousMotor,PMSM)调整所需的步骤和设置,该算法如 AN1078《PMSM
    发表于 03-03 01:53

    如何两个数据返回给调用函数

    已经知道函数会返回两个数据,提前申请两元素的内存,并且数组作为参数传递过去,返回值放在数组中就行。 第三种,定义全局的结构体变量,
    的头像 发表于 01-08 10:15 679次阅读

    电脑作为云存储,如何电脑作为云存储?

    。今天小编要为大家讲解如何电脑作为云存储。    将电脑作为云存储服务器是相对复杂的过程,但通过正确的步骤和注意事项,你可以轻松实现
    的头像 发表于 12-24 13:36 910次阅读
    <b class='flag-5'>把</b>电脑作为云存储,如何<b class='flag-5'>把</b>电脑作为云存储?

    个人电脑变成云电脑,个人电脑变成云电脑的步骤

        云电脑在现代工作和生活中扮演着越来越重要的角色,用户可以通过远程桌面软件,像操作本地计算机样访问和控制远程计算机,无论它们位于何处。今天小编给大家分享个人电脑变成云电脑的步骤。    将
    的头像 发表于 12-23 13:28 2395次阅读
    <b class='flag-5'>把</b>个人电脑变成云电脑,<b class='flag-5'>把</b>个人电脑变成云电脑的<b class='flag-5'>步骤</b>

    湿法刻蚀步骤哪些

    说到湿法刻蚀了,这个是专业的技术。我们也得用专业的内容才能给大家讲解。听到这个工艺的话,最专业的定就是讲述湿法刻蚀步骤。你知道其中都有哪些步骤吗?如果想要了解,今天是
    的头像 发表于 12-13 14:08 1291次阅读