0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

强化学习与智能驾驶决策规划

jf_C6sANWk1 来源:阿宝1990 2023-02-08 14:05 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

本文介绍了强化学习与智能驾驶决策规划。智能驾驶中的决策规划模块负责将感知模块所得到的环境信息转化成具体的驾驶策略,从而指引车辆安全、稳定的行驶。真实的驾驶场景往往具有高度的复杂性及不确定性。如何制定一套泛化能力强的决策规划机制是智能驾驶目前面临的难点之一。强化学习是一种从经验中总结的学习方式,并从长远的角度出发,寻找解决问题的最优方案。近些年来,强化学习在人工智能领域取得了重大突破,因而成为了解决智能驾驶决策规划问题的一种新的思路。

01.强化学习的介绍

b38a4ebc-a220-11ed-bfe3-dac502259ad0.jpg

强化学习(Reinforcement Learning)近些年来是人工智能的一个前言领域,属于机器学习的一个重要分支。从定义上来讲,强化学习可以通过经验探索来学习到解决问题的最优策略,即累计回报值最大的动作选取策略。在没有任何初始经验的情况下,强化学习可以通过平衡探索未知动作的可能性,学习到解决问题的最优方法,从而达到自我学习的目的。因此,强化学习与其他机器学习算法的一个显著区别为不依赖初始人工标注数据集的大小,探索式的自我学习可大幅度的节省人力成本。近些年来,随着深度学习的迅速发展,将深度学习与强化学习相结合的深度强化学习成为人工智能研究的热门领域之一,并在游戏、控制等领域取得了令人瞩目的成就。

02.智能驾驶决策规划的任务

b39a4f2e-a220-11ed-bfe3-dac502259ad0.jpg

智能驾驶的主要目的是为人们提供安全、舒适及高效的出行体验。大多数的交通事故产生的原因来自于驾驶员人为因素,例如疲劳驾驶、情绪驾驶以及路况判断失误等。因此,合理的选择驾驶行为及路线规划是智能驾驶的一个重要环节。其中,行为决策负责在接收到全局路径后,根据从感知模块得到的环境信息(车辆速度、障碍物及道路信息等),做出具体的行为决策(如变道、跟车、减速等)。而规划的任务则是在接收到决策层的宏观动作指令之后,将其转化成一条更加具体的行驶轨迹,从而能够生成一系列控制信号(油门、方向盘转角、刹车等),实现车辆的自动行驶。如何应对不同的路况信息将做出合理的决策与规划是无人驾驶智能化的一个重要指标。

03.决策规划目前的难点

b3aff450-a220-11ed-bfe3-dac502259ad0.jpg

由于实际的交通场景千变万化,道路结构差异大(高速、十字路口、停车场等),如何去设计一套通用性强的决策规划机制是目前困扰着智能驾驶的一个主要难题。同时,其他交通参与者的行为存在不确定性,不仅需要对其行为做预测,还需要考虑本车与其他交通参与者的博弈。因此,需要对时刻变化的外部环境做出快速及准确的响应。如何应对感知模块提供的信息做不到100%的准确和100%的全覆盖也是智能车在决策规划时要考虑的重要因素。

04.强化学习对于智能驾驶决策规划的意义

b3ba2fec-a220-11ed-bfe3-dac502259ad0.jpg

强化学习适用于求解具有时序性的决策问题,这正与智能驾驶的决策过程相契合。结合神经网络的深度强化学习框架可以增加驾驶场景的泛化能力。同时,考虑部分不可观测环境的强化学习流程可以评估交通参与者的不确定性,并通过预测与推演的方式从长远的角度出发来寻求最优的驾驶方案。更重要的是,强化学习由于其自身具有应对外部环境改变而产生进化的能力。当未知的corner case产生时,智能体可以通过改变自身的驾驶策略来适应并探索学习到解决该问题的方法。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 人工智能
    +关注

    关注

    1819

    文章

    50298

    浏览量

    266844
  • 智能驾驶
    +关注

    关注

    5

    文章

    3037

    浏览量

    51373
  • 强化学习
    +关注

    关注

    4

    文章

    273

    浏览量

    11996

原文标题:强化学习对于智能驾驶决策规划的意义

文章出处:【微信号:阿宝1990,微信公众号:阿宝1990】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    上汽奥迪E5 Sportback车型升级搭载全新Momenta强化学习大模型

    近日,上汽奥迪宣布旗下 E5 Sportback 车型升级搭载 全新Momenta 强化学习大模型。
    的头像 发表于 04-09 09:33 170次阅读

    上汽大众ID. ERA 9X全球首发搭载Momenta R7强化学习世界模型

    3月30日,Momenta R7强化学习世界模型全球首发搭载车型——上汽大众ID. ERA 9X正式开启预售。
    的头像 发表于 03-31 13:48 340次阅读

    Momenta R6强化学习大模型上车东风日产NX8

    3月20日,东风日产NX8技术暨预售发布会在广州举办,官宣Momenta R6强化学习大模型正式上车东风日产新能源SUV——NX8。以全球顶级大厂合力,融合先锋科技力量,打造更适配全家出行的智能SUV,开启合资品牌智能化全新赛道
    的头像 发表于 03-24 09:08 813次阅读

    Momenta强化学习大模型助力别克至境世家纯电版正式上市

    3月17日,别克至境世家纯电版正式上市,这是别克与Momenta强化学习大模型的又一次深度联手。融合别克在MPV市场深耕27年的技术积淀,以更从容的智慧驾控,重新定义豪华与自在的出行体验。
    的头像 发表于 03-18 15:48 293次阅读

    Momenta R7强化学习世界模型即将推出

    3月16日,上汽大众举办以“人本科技”为主题的ID. ERA技术发布会,首次揭晓了ID. ERA 系列包括智能辅助驾驶在内的诸多核心技术亮点。会上,Momenta CEO曹旭东正式宣布:Momenta R7强化学习世界模型即将推
    的头像 发表于 03-17 13:57 1176次阅读

    自动驾驶中常提的离线强化学习是什么?

    [首发于智驾最前沿微信公众号]在之前谈及自动驾驶模型学习时,详细聊过强化学习的作用,由于强化学习能让大模型通过交互学到策略,不需要固定的规则,从而给自动
    的头像 发表于 02-07 09:21 344次阅读
    自动<b class='flag-5'>驾驶</b>中常提的离线<b class='flag-5'>强化学习</b>是什么?

    强化学习会让自动驾驶模型学习更快吗?

    [首发于智驾最前沿微信公众号]在谈及自动驾驶大模型训练时,有的技术方案会采用模仿学习,而有些会采用强化学习。同样作为大模型的训练方式,强化学习有何不同?又有什么特点呢? 什么是
    的头像 发表于 01-31 09:34 819次阅读
    <b class='flag-5'>强化学习</b>会让自动<b class='flag-5'>驾驶</b>模型<b class='flag-5'>学习</b>更快吗?

    智能强化学习(MARL)核心概念与算法概览

    (Multi-AgentReinforcementLearning,MARL),但是这样会很快变得混乱。什么是多智能强化学习MARL是多个决策者(智能体)在同一环境中交互的
    的头像 发表于 01-21 16:21 323次阅读
    多<b class='flag-5'>智能</b>体<b class='flag-5'>强化学习</b>(MARL)核心概念与算法概览

    上汽别克至境E7首发搭载Momenta R6强化学习大模型

    别克至境家族迎来新成员——大五座智能SUV别克至境E7首发。新车将搭载Momenta R6强化学习大模型,带来全场景的智能出行体验。
    的头像 发表于 01-12 16:23 480次阅读

    如何训练好自动驾驶端到端模型?

    [首发于智驾最前沿微信公众号]最近有位小伙伴在后台留言提问:端到端算法是怎样训练的?是模仿学习强化学习和离线强化学习这三类吗?其实端到端(end-to-end)算法在自动驾驶
    的头像 发表于 12-08 16:31 1589次阅读
    如何训练好自动<b class='flag-5'>驾驶</b>端到端模型?

    今日看点:智元推出真机强化学习;美国软件公司SAS退出中国市场

    智元推出真机强化学习,机器人训练周期从“数周”减至“数十分钟”   近日,智元机器人宣布其研发的真机强化学习技术,已在与龙旗科技合作的验证产线中成功落地。据介绍,此次落地的真机强化学习方案,机器人
    发表于 11-05 09:44 1154次阅读

    什么是自动驾驶决策系统?发展有何挑战?

    [首发于智驾最前沿微信公众号]把自动驾驶汽车想象成一个不断学习并做决定的人,车上的“眼睛”负责看(感知)、“记忆/推理”负责想(预测与决策)、“手脚”负责做(规划与控制),
    的头像 发表于 10-26 09:55 1698次阅读
    什么是自动<b class='flag-5'>驾驶</b><b class='flag-5'>决策</b>系统?发展有何挑战?

    自动驾驶中常提的“强化学习”是个啥?

    [首发于智驾最前沿微信公众号]在谈及自动驾驶时,有些方案中会提到“强化学习(Reinforcement Learning,简称RL)”,强化学习是一类让机器通过试错来学会做决策的技术。
    的头像 发表于 10-23 09:00 875次阅读
    自动<b class='flag-5'>驾驶</b>中常提的“<b class='flag-5'>强化学习</b>”是个啥?

    无人驾驶智能决策与精准执行的融合

    无人驾驶核心操控技术:智能决策与精准执行的融合 无人驾驶的核心操控系统是车辆实现自主驾驶的“大脑”与“四肢”,其技术核心在于通过感知、
    的头像 发表于 09-19 14:03 879次阅读

    18个常用的强化学习算法整理:从基础方法到高级模型的理论技术与代码实现

    本来转自:DeepHubIMBA本文系统讲解从基本强化学习方法到高级技术(如PPO、A3C、PlaNet等)的实现原理与编码过程,旨在通过理论结合代码的方式,构建对强化学习算法的全面理解。为确保内容
    的头像 发表于 04-23 13:22 1768次阅读
    18个常用的<b class='flag-5'>强化学习</b>算法整理:从基础方法到高级模型的理论技术与代码实现