0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

利用NVIDIA产品技术组合提升用户体验

NVIDIA英伟达 来源:NVIDIA英伟达 2024-01-17 09:30 次阅读

案例简介

本案例通过利用NVIDIA TensorRT-LLM加速指令识别深度学习模型,并借助NVIDIA Triton推理服务器在NVIDIA V100 GPU上进行高效部署,帮助必优科技的文档智能体 UTalk-Doc 将用户指令识别服务吞吐量提升了 5 倍,单个请求响应时间缩减了三分之一,大幅提升服务运行效率,提升资源利用率。Triton 模型分析能力还协助必优科技,将寻找最佳推理配置所需的时间从数周减少到数小时。

智能体迭代和

用户增长的并发压力

必优科技旗下 UTalk-Doc 是新一代协助用户进行表达的办公产品。其中“用户指令识别”能力是产品组成中十分重要的一环。目前该能力主要由底层指令识别深度学习模型提供服务支持。

深度学习模型在运行过程中需要较大的计算量,在用 Pytorch 进行模型的推理时,一方面时延特别大,导致用户体验受损;另一方面,显存占用很大,导致推理请求的并发数上不去,请求失败的概率太高,只能通过增加机器的方式来提高并发能力,业务部署成本较高;再次,使用的模型经常变化,而业务需要更换后的模型能够快速地加速和上线部署。NVIDIA GPU 硬件和软件框架的强大性能帮助企业解决了海量计算需求,满足了必优科技多模态 office 智能体的迭代和用户几何倍增长的并发压力。

利用 NVIDIA产品技术组合

提升用户体验

基于以上挑战,必优科技选择了采用 NVIDIA 的 TensorRT-LLM SDK 对模型进行推理加速,并利用 NVIDIA Triton推理服务器在 V100 GPU 上进行在线部署,在提升用户体验的同时,大幅降低了服务成本。

通过使用 TensorRT-LLM 对指令识别深度学习模型进行加速,在都使用 FP32 的情况下,与 Pytorch 相对,时延降低 50% 左右。

使用 TensorRT-LLM 结合 NVIDIA V100 GPU 的 FP16 Tensor Core,在保证精度的同时,模型推理的时延进一步降低了 40%。

Triton 的 dynamic batch 及多实例特性,在满足时延要求的同时,提高了系统整体的并发能力。

TensorRT-LLM 可以对模型进行快速地加速,Triton 则可以对加速后的模型进行快速地部署,满足了业务对修改后的模型进行快速部署的需求,同时也大大减少了工程人员的工作量。

NVIDIA 赋能文档智能体

在 NVIDIA 技术和初创加速生态的加持中,必优科技旗下应用产品 ChatPPT(UTalk-Doc)在短短几个月内自然注册用户破 100 万,同时通过内容表达场景(如 PPT 演示),赋能了如金融、教育、医疗等垂直行业领域客户,并且在硬件生态合作等方面也做了更多的探索,共同推进整个 AI 行业的快速发展。

“NVIDIA 提供的 GPU 解决方案,解决了深度学习和机器学习的技术难题,是我们公司人工智能道路上一路狂飙所不可或缺的一环。”必优科技创始人兼 CTO 陈润天博士表示。

必优科技成立于 2020 年,是国内较早期就专注于人工智能领域的智能内容生成技术的科技型公司,公司目前主要围绕智慧办公场景做相关业务开发服务,如 2023 年 3 月上线的 Chatppt(AI 生成 PPT)6 个月用户过百万;全新下一代产品 UTalk-Doc——不拘泥于格式、自由切换文档格式的产品,将彻底颠覆、改变和引领下一代 office 产品,帮助用户更好地进行表达。

NVIDIA 初创加速计划

必优科技是 NVIDIA 初创加速计划 (NVIDIA Inception) 会员企业。NVIDIA 初创加速计划为免费会员制,旨在培养颠覆行业格局的优秀创业公司。该计划联合国内外知名的风投机构,创业孵化器,创业加速器,行业合作伙伴以及科技创业媒体等,打造创业加速生态系统。能够提供产品折扣,技术支持,市场宣传,融资对接,业务推荐等一系列服务,加速创业公司的发展。

审核编辑:汤梓红
声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • NVIDIA
    +关注

    关注

    14

    文章

    4592

    浏览量

    101717
  • gpu
    gpu
    +关注

    关注

    27

    文章

    4417

    浏览量

    126702
  • 深度学习
    +关注

    关注

    73

    文章

    5237

    浏览量

    119908

原文标题:NVIDIA GPU 解决方案加速必优科技新一代文档智能体

文章出处:【微信号:NVIDIA_China,微信公众号:NVIDIA英伟达】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    利用NVIDIA组件提升GPU推理的吞吐

    本实践中,唯品会 AI 平台与 NVIDIA 团队合作,结合 NVIDIA TensorRT 和 NVIDIA Merlin HierarchicalKV(HKV)将推理的稠密网络和热 Embedding 全置于 GPU 上进行
    的头像 发表于 04-20 09:39 159次阅读

    SAP与NVIDIA携手加速生成式AI在企业应用中的普及

    SAP SE 和 NVIDIA 宣布深化合作,致力于加速企业客户在 SAP 云解决方案和应用组合利用数据和生成式 AI 的变革力量。
    的头像 发表于 03-22 10:02 322次阅读

    NVIDIA TAO工具套件功能与恩智浦eIQ机器学习开发环境的集成

    恩智浦半导体宣布与NVIDIA合作,将NVIDIA经过训练的人工智能模型通过eIQ机器学习开发环境部署到恩智浦广泛的边缘处理产品组合中。
    的头像 发表于 03-22 09:11 171次阅读

    如何选择NVIDIA GPU和虚拟化软件的组合方案呢?

    NVIDIA vGPU 解决方案能够将 NVIDIA GPU 的强大功能带入虚拟桌面、应用程序和工作站,加速图形和计算,使在家办公或在任何地方工作的创意和技术专业人员能够访问虚拟化工作空间。
    的头像 发表于 01-12 09:26 275次阅读
    如何选择<b class='flag-5'>NVIDIA</b> GPU和虚拟化软件的<b class='flag-5'>组合</b>方案呢?

    AMD升级视频技术提升画质应用FSR

    去年10月,NVIDIA已向全体RTX显卡用户推出了利用AI技术实现更高清晰度的RTX视讯超解析功能(简称RTXVSR),该项技术可消除原生
    的头像 发表于 01-11 14:20 328次阅读

    如何提升单片机开发技术

    单片机开发是现代电子技术中的重要分支,其在各个领域都有着广泛的应用。单片机开发技术提升不仅可以提高工作效率,还可以提高工作质量和创新能力。那么,如何提升单片机开发
    发表于 01-05 10:14

    NVIDIA 知乎精彩问答甄选 | 查看关于 NVIDIA Omniverse 的相关精彩问答

    框架、资源和服务,以加速通用场景描述(即 OpenUSD)的采用。 NVIDIA 正在通过 NVIDIA Omniverse 与新的技术组合、ChatUSD 和 RunUSD 等云应用
    的头像 发表于 12-01 18:40 223次阅读
    <b class='flag-5'>NVIDIA</b> 知乎精彩问答甄选 | 查看关于 <b class='flag-5'>NVIDIA</b> Omniverse 的相关精彩问答

    利用封装、IC和GaN技术提升电机驱动性能

    利用封装、IC和GaN技术提升电机驱动性能
    的头像 发表于 11-23 16:21 270次阅读
    <b class='flag-5'>利用</b>封装、IC和GaN<b class='flag-5'>技术</b><b class='flag-5'>提升</b>电机驱动性能

    圆满落幕!NVIDIA 携前沿 AI 技术产品,惊艳亮相 2023 腾讯全球数字生态大会!

    NVIDIA 在本届大会带来了丰富的 AI 技术展示及专题演讲。现在就带您回顾五大活动亮点。 亮点一:NVIDIA 专场演讲 畅谈 AI 创新技术底座 洞察行业未来加速计算发展与新
    的头像 发表于 09-12 20:40 643次阅读
    圆满落幕!<b class='flag-5'>NVIDIA</b> 携前沿 AI <b class='flag-5'>技术</b>与<b class='flag-5'>产品</b>,惊艳亮相 2023 腾讯全球数字生态大会!

    如何利用讯维网络解码矩阵提升直播质量?

    在数字化时代,直播已经成为各种行业的重要宣传和互动方式。然而,直播质量一直是用户关注的重点,也是直播技术面临的挑战。为了提升直播质量,许多直播平台和技术提供商不断探索新的解决方案。其中
    的头像 发表于 09-04 10:10 254次阅读

    《揭秘 NVIDIA DPU &amp; DOCA》 第六讲上线!

    NVIDIA DOCA 软件框架,从 DPU 的技术发展背景,价值定位,到用户案例,DOCA 服务及安装部署等角度全方位揭秘,以帮助企业正确认识 NVIDIA BlueField D
    的头像 发表于 07-20 18:15 311次阅读
    《揭秘 <b class='flag-5'>NVIDIA</b> DPU &amp; DOCA》 第六讲上线!

    NVIDIA GPU 加速 WPS Office AI 服务,助力打造优质的用户体验

    案例介绍 金山办公与 NVIDIA 团队合作,通过 NVIDIA Tensor Core GPU、TensorRT 提升图像文档识别与理解的推理效率;借助 NVIDIA Triton
    的头像 发表于 06-29 21:35 395次阅读
    <b class='flag-5'>NVIDIA</b> GPU 加速 WPS Office AI 服务,助力打造优质的<b class='flag-5'>用户</b>体验

    《揭秘 NVIDIA DPU &amp; DOCA》 开讲啦!

    NVIDIA DOCA 软件框架,从 DPU 的技术发展背景,价值定位,到用户案例,DOCA 服务及安装部署等角度全方位揭秘,以帮助企业正确认识 NVIDIA DPU 的价值,同时助
    的头像 发表于 06-08 20:55 362次阅读
    《揭秘 <b class='flag-5'>NVIDIA</b> DPU &amp; DOCA》 开讲啦!

    利用3D可视化技术直观展现产品信息,提升产品销量

    随着科技的不断发展,3D可视化技术已经逐渐成为产品设计和营销中不可或缺的一部分。利用3D可视化技术,可以更直观地展现产品的外观、功能、性能等
    的头像 发表于 06-07 14:38 396次阅读

    NVIDIA AI 技术助力 vivo 文本预训练大模型性能提升

    vivo AI 团队与 NVIDIA 团队合作,通过算子优化,提升 vivo 文本预训练大模型的训练速度。在实际应用中, 训练提速 60% ,满足了下游业务应用对模型训练速度的要求。通过
    的头像 发表于 05-26 07:15 444次阅读
    <b class='flag-5'>NVIDIA</b> AI <b class='flag-5'>技术</b>助力 vivo 文本预训练大模型性能<b class='flag-5'>提升</b>