0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

DPU性能评测系统框架与测试流程

智能计算芯世界 来源:智能计算芯世界 作者:智能计算芯世界 2022-12-02 14:30 次阅读

本文来自“专用数据处理器(DPU)性能基准评测方法与实现(2022)”介绍 DPU 性能测试系统框架与测试流程,包括测试系统、测试要求、测试活动三部分。具体的,测试系统定义了三种搭建 DPU 测试系统的方法,测试要求阐述了组建 DPU 测试系统时需要满足的要求,测试活动定义了DPU Benchmark 的选择策略、执行前准备、执行过程及测试结果报告。

DPU 测试系统(SUT)

DPU 测试系统(System Under Test,SUT)是测试 DPU 性能的平台,其结构在不同应用场景中,主要分为三类:单端型测试系统(Single-End)、端到端型测试系统(End-to-End)和多端型测试系统(Multi-End)。

单端型(Single-End)测试系统是主机与 DPU 通过总线互联构成的封闭测试系统,主要用于模拟无网络连接情况下,DPU 作为专用加速器执行主机端特定业务的过程。在这种系统中,计算与数据传输仅在主机与 DPU 之间进行,DPU 不与其他设备通信,仅执行特定计算业务。单端型测试系统主要测试 DPU 对特定计算任务的性能提升。

端到端型(End-to-End)测试系统将两个单端型测试系统通过简单网络相连(网线直连),其中一个为请求发起者(Initiator/Client),另一个为请求接受者(Target/Server)。

端到端型测试系统主要模拟 DPU 作为网络加速器执行双端操作的场景。在这种系统中,计算与数据传输不仅在主机与 DPU 之间进行,还通过网络传输到其他系统。DPU 在Server 端接收主机端发起的网络请求并通过网口转发,或者在 Client 端接收网络的请求并向作出响应。端到端型测试系统能够屏蔽网络性能(转发次数、交换设备的性能、转发设备的性能)对 DPU 性能的影响,主要测试 DPU 对网络协议卸载、网络数据包处理的峰值能力。

多端型(Multi-End)测试系统是多个单端型测试系统通过复杂的网络拓扑相连的开放测试系统。该测试系统主要模拟 DPU 作为网络加速器在复杂环境中处理网络任务的场景。在这种系统中,网络环境(网络拓扑)与资源分布(相同或者不同类型的 DPU 系统)情况复杂,DPU 不仅承担一对一的网络任务,还可能接收一/多个其他系统的请求(含背景流量甚至恶意攻击)或响应一/多个其他系统的请求。

单端型(Single-End)测试系统

主机与 DPU 通过总线(通常为 PCIe)直接相连形成的可独立工作的系统为单端型测试系统,系统包含支持 DPU 正常工作的软件和硬件。在这种测试系统中,DPU 作为专用加速器执行特点计算业务。

单端型测试系统模型的基本结构如图2.1(a) 所示。运行时环境(Run Time Environ-ment,RTE)代表运行中的 DPU 测试程序,交换设备(Switch)为 DPU 与主机系统(Host System)的互连结构(通常为 PCIe)。在单端型测试系统中,DPU 作为专用加速器,主机使用 DPU 加速某些任务的处理,如数据库查询、AI 训练等。任务数据首先从主机端搬运到 DPU,DPU 计算完成后,再将处理完的数据写回主机。在这种工作模式中,DPU测试程序可以以数据处理时间、数据处理规模作为性能指标。

32837232-3ee1-11ed-9e49-dac502259ad0.png

单端型测试系统具体由硬件和软件两部分构成,硬件主要有 DPU、CPU 以及其他

保证系统正常进行的硬件(内存、硬盘等),软件主要有操作系统、DPU 驱动、开源工具、DPU Benchmark,结构示意如图。各部分组件要求如下:

1. DPU Benchmark,评测 DPU 系统性能的基准测试程序;

2. 开源工具(Open Source Tools),一些广泛使用的性能测试工具,保证测试结果可重复,在不同的用户测试时可以获得相近的结果;

3. DPU Benchmark 驱动(Benchmark Driver),基于内核态的测试驱动或者基于用户态的测试驱动;

4. DPU 驱动(DPU Driver),包括 DPU 最底层的抽象,也包括 DPU 所提供给用户程序使用的接口;

5. 操作系统(Operating System),需要支持 DPU Benchmark 的版本,且相关信息需要在结果报告中明确写出,如操作系统版本,内核版本等;

6. 计算设备(Computing Device),通用 CPU,其上运行操作系统;

7. 连接设备(Connected Device),根据 DPU 板卡接口不同选择不同,常见的有PCIe、CXL;

8. IO 硬件(I/O),鼠标、键盘等保证系统执行所必须的硬件设备;

9. 被测 DPU 产品(DPU);

10. 其他硬件资源(Hardware Resources),如内存、硬盘。

端到端型(End-to-End)测试系统

端到端型测试系统是由两个单端型测试系统通过网线直连的方式组成的测试系统。在这种测试系统中,屏蔽了复杂的网络拓扑与其他系统流量的影响,可以测试 DPU 网络加速的峰值性能。

端到端型测试系统由两个单端型测试模型直接相连(如图所示),每个单端测试系统分别运行 DPU Benchmark 测试程序,一般其中一个运行发起者程序 (Initiator/-Client),另一个运行接收者程序 (Target/Server)。通过发起者发送请求,接收者响应请求,测量基于网络的端到端操作,例如 RDMA Send/Receive 操作,NVMe-oF 远程访问。在这种测试模型中,根据从一端 DPU 系统到另一端 DPU 系统的请求时间和流量等测试DPU 的延迟、吞吐量等性能。

329a2504-3ee1-11ed-9e49-dac502259ad0.png

端对端型测试系统在单端型测试系统的基础上,增加网络基础设备(通常为网线)

用于直接连接两个单端测试系统,其结构如图2.3所示。根据 DPU 所支持的网口速率不同,可采取不同的网络连接设备,缺省值为 100Gbs 连接。

多端型(Multi-End)测试系统

多端型测试系统是由多个单端型测试系统经由复杂网络(复杂的网络拓扑)连接形

成的测试系统。在这种测试系统中,可以模拟 DPU 所处的真实网络环境,测试 DPU 网络处理的实际性能。

多端型测试系统模型主要用于模拟基于 DPU 构建的数据中心,通过复杂的网络将

众多 DPU 系统 (功能相同或者不同) 互连起来,从而测试基于 DPU 系统实现的网络、存储或安全加速应用的真实性能,如NVMe-oF 读取不同结点存储系统的存储资源、RDMA访问不同结点的资源。在这种测试模型中,根据请求与响应时间、请求的数据量及并发的请求数等可以测试延时、吞吐量、连接能力等指标。

32c7fa6a-3ee1-11ed-9e49-dac502259ad0.png

多端型测试系统在单端型测试系统的基础上,需要增加更复杂的网络基础设备用于连接不同节点的 DPU 系统。这些网络基础设施包括但不限于集线器、交换机、路由器等。

32f25ecc-3ee1-11ed-9e49-dac502259ad0.png

在 DPU Benchmark 执行时,为了保证测试结果的准确性与可重复性,对于同一种测试用例执行两轮(特殊的情况在具体的测试用例说明)。每一轮分为三个部分:预热 (Warmup Run) 部分排除初始化干扰;负载执行 (Measured Run) 部分为真正的指标测试;结果检查 (Result Check) 部分检查结果的正确性 (数据传输的完整性,计算结果的正确性等)。每执行完一轮需要恢复至初始状态 (Clear up)。在预热部分与负载执行之间不允许执行其他任务。每一轮执行的过程中,DPU 测试系统配置不可以发生变化。

在 DPU Benchmark 执行过程中,DPU 测试系统不可以重启或者重新开始。如果 DPU系统测试应用、操作系统或者硬件发生不可恢复的错误时,这一轮的执行应作无效;如果 DPU 系统测试应用、操作系统或者硬件检测到可恢复的错误,并且错误纠正并恢复正常,那么这一轮的执行应作有效。在错误发生处理期间,测试者不能人工干预,否则,这一轮执行应作无效。

测试报告中除了给出不同测试用例的性能指标,还需要给出测试过程中的全部配置信息,包括:配置参数,包括服务器、存储、网络等其他硬件设施;安装的操作系统、文件系统、测试工具等软件版本;在测试过程中使用到的其他软件程序;程序编译优化选项。在执行 DPU Benchmark 时如果系统发送异常或者其他情况,需要在报告附录中指出。

本文来自“专用数据处理器(DPU)性能基准评测方法与实现(2022)”介绍 DPU性能测试系统框架与测试流程,包括测试系统、测试要求、测试活动三部分。完整内容请参看原报告。

审核编辑:汤梓红

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • cpu
    cpu
    +关注

    关注

    68

    文章

    10434

    浏览量

    206522
  • 测试系统
    +关注

    关注

    6

    文章

    749

    浏览量

    61782
  • DPU
    DPU
    +关注

    关注

    0

    文章

    293

    浏览量

    23965
  • 数据处理器
    +关注

    关注

    0

    文章

    23

    浏览量

    8564

原文标题:DPU性能评测系统框架与测试流程

文章出处:【微信号:AI_Architect,微信公众号:智能计算芯世界】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    《数据处理器:DPU编程入门》读书笔记

    关注计算能力的提升,通信基础设施的提升跟不上,那么数据中心的整体系统性能依然受限,无法发挥出真正的潜力。DPU的提出背景就是应对这些数据量和复杂性的指数级增长。未来,需要将计算移至接近数据的位置,这是
    发表于 12-21 10:47

    《数据处理器:DPU编程入门》DPU计算入门书籍测评

    一、DPU计算框架 通过一周多的时间翻阅这本书,基本上这本书是一本比较全面的,面向架构的新手指导数据。它在书中详尽介绍了关于DPU在计算机架构中的应用。 对于DPU来说,是一种平行于
    发表于 12-24 10:54

    移动APP测试的android性能测试

    当应用实现了新功能后,准备发布版本前,必须进行性能测试以确定没有性能问题,内存使用情况便是其中必须要测试性能之一。由于内存组成的复杂性,并
    发表于 06-09 16:17

    专⽤数据处理器 (DPU) 技术⽩⽪书

    513.3. 应用场景三:安全功能卸载 554.DPU软件栈五层模型584.1. 软件栈开发面临的挑战 584.2. DPU异构计算架构五层开发模型 584.3. 典型软件框架案例 635.业界产品概要介绍
    发表于 03-14 17:35

    【书籍评测活动NO.23】数据处理器:DPU编程入门

    ,拥有极高的安全性和强大的功能。 全球第一本系统性介绍DPU及其软件开发的图书 涵盖新一代计算单元——DPU的简介、技术优势及未来技术发展路径 基于NVIDIA DOCA软件框架开发软
    发表于 10-24 15:21

    什么是DPU

    DPU则进行数据处理。” 什么是DPU? 数据处理器 基于行业标准,高性能及软件可编程的多核CPU 高性能网络接口 灵活、可编程的加速引擎 DPU
    发表于 11-03 10:55

    《数据处理器:DPU编程入门》+初步熟悉这本书的结构和主要内容

    浪费等问题。DPU将数据处理和网络功能集成到同一块硬件中,可以实现更高效的数据处理和传输,同时减少系统复杂性和资源开销。这种集成可以提供更低的延迟和更高的吞吐量,从而改善应用程序性能和用户体验。 2
    发表于 12-08 18:03

    ServerScope集成性能评测系统框架

    介绍了ServerScope 集成性能评测系统框架结构的设计与实现实践证明利用框架技术显著降低了性能
    发表于 06-28 15:18 18次下载
    ServerScope集成<b class='flag-5'>性能</b><b class='flag-5'>评测</b><b class='flag-5'>系统</b><b class='flag-5'>框架</b>

    公有云存储系统性能评测方法研究

    云存储系统测试环境构建复杂,测试时间长,准备测试环境成本高;受网络因素及外界其他因素影响,评测结果不稳定。针对以上所述云存储
    发表于 12-03 11:48 0次下载
    公有云存储<b class='flag-5'>系统性能</b><b class='flag-5'>评测</b>方法研究

    NVIDIA推出基于 NVIDIA BlueField DPU 的 DOCA 1.2 软件框架

    NVIDIA 最近推出了基于 NVIDIA BlueField DPU 的 DOCA 1.2 软件框架 。此最新版本让已在 DOCA 早期访问计划中的合作伙伴和客户,可加快 DPU 上应用程序和整体零信任解决方案的开发。
    的头像 发表于 12-23 17:42 1473次阅读

    NVIDIA BlueField-2 DPU性能测试方法

    DPU(数据处理器)将服务器和存储之间的 IOPS 性能提升至 4100 万以上,超过之前世界纪录的四倍。
    的头像 发表于 01-04 14:25 2298次阅读

    模块系统和使用测试自动化框架的端到端验证

      Softnautics 拥有经过市场验证的开发验证和验证自动化套件的流程,在功能和/或性能覆盖率方面零妥协,以及使用内部 STAF和开源框架执行测试自动化。Softnautics
    的头像 发表于 06-01 09:14 1109次阅读

    模块系统和使用测试自动化框架的端到端验证

      Softnautics 拥有经过市场验证的开发验证和验证自动化套件的流程,在功能和/或性能覆盖率方面零妥协,以及使用内部 STAF和开源框架执行测试自动化。Softnautics
    的头像 发表于 06-21 09:37 706次阅读

    被称为数据中心“第三颗主力芯片”,DPU凭什么?

    2021年10月至今,中科院计算所面向全行业先后发布了《专用数据处理器(DPU)技术白皮书》和《专用数据处理器(DPU性能基准评测方法与实现》,两份白皮书较为全面地解释了,
    发表于 10-18 15:09 622次阅读
    被称为数据中心“第三颗主力芯片”,<b class='flag-5'>DPU</b>凭什么?

    显卡性能测试的方法和流程

    本文将详细介绍显卡性能测试的方法和流程,以帮助读者更好地了解如何评估自己的显卡性能。 一、测试软件和工具 要进行显卡
    的头像 发表于 12-07 17:21 1609次阅读