0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

计算机视觉是否是深度学习落地的好赛道

电子工程师 来源:cg 2018-12-12 13:34 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

计算机视觉是目前AI在中国落地最顺利的技术。从目前的落地进展来看,移动互联网、安防、零售、物流、医疗、文娱、无人驾驶的商业化有待成熟。以旷视科技Face++、商汤科技、极链科技Video++为代表的AI头部企业战略,出现向平台企业或软硬一体化企业发展的分化趋势,及零售等新领域快速崛起。

计算机视觉在中国AI市场组成部分占比巨大。根据中国信通院2018年2月发布的报告数据,2017年,中国人工智能市场中计算机视觉占比37%,以80亿元的行业收入排名第一。

2018年信通院11月发布的《2018人工智能发展白皮书——技术篇》中以深度学习算法驱动的人工智能技术为主,数据显示,在全球人工智能产业蓬勃发展的今天,人工智能技术以机器学习,特别是深度学习为核心,在视觉、语音、自然语言等应用领域迅速发展,已经开始渗入到各个行业。BBC预测,2020年全球人工智能市场规模约183亿美元,年均增长20%。在人工智能产业应用上,从融资规模和市场结构来看,中国AI企业更集中于视觉和语音方向。

目前,深度学习几乎成了计算机视觉领域的标配,也是当下人工智能领域最热门的研究方向。计算机视觉的应用场景和深度学习背后的技术原理是什么呢?

深度学习背后的技术原理

机器学习

机器学习的本质其实是为了找到一个函数,让这个函数在不同的领域会发挥不同的作用。像语音识别领域,这个函数会把一段语音识别成一段文字;图像识别的领域,这个函数会把一个图像映射到一个分类;下围棋的时候根据棋局和规则进行博弈;对话,是根据当前的对话生成下一段对话。机器学习离不开学习两个字,根据不同的学习方式,可以分为监督学习和非监督学习两种方式。

监督学习中,算法和数据是模型的核心所在。在监督学习中最关键的一点是,我们对训练的每个数据都要打上标签,然后通过把这些训练数据输入到算法模型经过反复训练以后,每经过一次训练都会减少算法模型的预计输出和标签数据的差距。

通过大量的训练,算法模型基本上稳定下来以后,我们就可以把这个模型在测试数据集上验证模型的准确性。这就是整个监督学习的过程,监督学习目前在图片分类上应用得比较多。

非监督学习里跟监督学习不同的地方是,非监督学习不需要为所有的训练数据都打上标签。非监督学习主要应用在两个大类,第一类是做聚类分析,聚类分析是把一组看似无序的数据进行分类分组,以达到能够更加更好理解的目的。

另外是做自动编码器,在数据分析的时候,原始数据量往往比较大,除了包含一些冗余的数据,还会包含一些对分析结果不重要的数据。自动编码器主要是对原始数据做降维操作,把冗余的数据去掉,提高后面数据分析的效率。

通过不同的学习方式获取到数据后,算法是接下来非常重要的一环。算法之于计算机就像大脑对于我们人类,选择一个好的算法也是特别重要的。

神经网络

神经网络是受人脑神经元结构的启发,研究者认为人脑所有的神经元都是分层的,可以通过不同的层次学习不一样的特征,由简单到复杂地模拟出各种特征。

上图是计算机应用数学的方式来模拟人脑中神经元的示意图。a1到ak是信号的输入,神经元会对输入信号进行两次变换。第一部分是线性变换,因为神经元会对自己感兴趣的信号加一个权重;第二部分是非线性变换。

神经网络就是由许多的神经元级联而形成的,每一个神经元都经过线性变换和非线性变换,为什么会有非线性变换?从数学上看,没有非线性变换,不管你神经网络层次有多深都等价于一个神经元。如果没有非线性变换,神经网络深度的概念就没有什么意义了。

卷积神经网络

以上所讲的都是一般的全连接神经网络,接下来进入卷积神经网络。卷积神经网络是专门针对图片处理方面的神经网络。卷积神经网络首先会输入一张图片,这张图片有三个颜色通道的数据,这是输入层。下面是卷积层,有一个卷积核的概念,每一个卷积核提取图片的不同特征。

提取出来以后到池化层,就是把卷积层的数据规模缩小,减少数据的复杂度。卷积和池化连起来我们叫做一个隐层,一个卷积神经网络会包含很多个隐层,隐层之后是全连接层,全连接层的目的是把前面经过多个卷积池化层的特征把数据平铺开,形成特征向量,我们把特征向量输入到分类器,对图片进行分类。

简单来说,卷积神经网络更适合计算机视觉主要有两个原因,一是参数共享,另外一个是稀疏连接。

2015年基于深度学习的计算机视觉算法在ImageNet数据库上的识别准确率首次超过人类,同年Google在开源自己的深度学习算法。这些带动中美两国的科学家把计算机视觉算法运用到安防、金融、互联网、物流、零售、医疗、文娱、制造业等不同垂直行业。但在实际的运用当中,由于数据可得性、算法成熟度、服务的容错率等因素的影响,落地的速度开始出现分化。其中,移动互联网、安防、医疗、无人驾驶等发展较慢。

技术发展趋势

提高预测精度,降低数据标注成本随着技术的不断发展,计算机视觉能够识别信息的种类从最初的文字信息,到人脸,人的体态识别,以及各种不同的物体。

能够识别的精度也从最初的人1:1比对,到用于门禁系统等1:N比对,以及用在黑名单监控等场景的M:N动态监控。除了提高算法精度以外,提高数据标注的效率也是计算机视觉公司重要的课题之一。

企业发展战略开始分化,商汤向左,旷视向右,计算机视觉技术在中国的快速落地,吸引了以旷视科技Face++、商汤科技、极链科技Video++为代表的以算法为核心竞争力的AI初创公司,拥有强大数据采集及软件开发能力的互联网公司,以及华为这样的科技巨头。经过一年多的发展,各个公司都已经根据自己资源的不同,战略出现了分化。

各类公司初始时在产业环节中各有偏好,初创企业在算法与模型训练上占优,互联网企业则拥有天然的数据优势,安防企业则凭借极强的工程能力加速安防项目落地。

AI头部初创企业近年来融资动作频繁,受到资本市场的青睐,在资金方面暂无瓶颈,然而面临互联网巨头的挑战,各大初创企业应依托已有的独立设计算法的能力,构建平台型解决方案,在研发能力与方案落地速度上取胜。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • AI
    AI
    +关注

    关注

    89

    文章

    38090

    浏览量

    296520
  • 计算机视觉
    +关注

    关注

    9

    文章

    1714

    浏览量

    47450
  • 深度学习
    +关注

    关注

    73

    文章

    5590

    浏览量

    123900

原文标题:深度学习下的AI落地,计算机视觉是否一条好赛道

文章出处:【微信号:FPGAer_Club,微信公众号:FPGAer俱乐部】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    【团购】独家全套珍藏!龙哥LabVIEW视觉深度学习实战课(11大系列课程,共5000+分钟)

    累计5000+分钟内容 二、课程优势 技术壁垒构建: 形成\"视觉算法+运动控制+深度学习\"的复合技术栈,建立差异化竞争优势 项目落地能力: 掌握从需求分析→方案设计→硬件选型
    发表于 12-04 09:28

    【团购】独家全套珍藏!龙哥LabVIEW视觉深度学习实战可(11大系列课程,共5000+分钟)

    \"),通过后解锁下一阶段内容 2. 老手(包含资深工程师) 1)技术盲区突破 传统视觉进阶:九点标定误差补偿、手眼协调动态精度优化等高级技巧,提升系统稳定性 深度学习落地:模型轻量化
    发表于 12-03 13:50

    使用代理式AI激活传统计算机视觉系统的三种方法

    当前的计算机视觉系统擅长于识别物理空间与流程中的事件,却难以诠释场景细节及其意义,也无法推理后续可能发生的情况。
    的头像 发表于 12-01 09:44 327次阅读

    2025中国计算机大会DPU技术论坛成功举办

    近日,备受瞩目的第22届中国计算机大会(CNCC2025)在哈尔滨开幕。本届大会注册人数突破1.2万人,汇聚了来自全球计算机领域的顶尖学者、产业领袖、青年学子及国际组织代表。大会以“数智赋能、无限可能”为主题,旨在深度探讨数字智
    的头像 发表于 11-02 09:29 379次阅读

    如何在机器视觉中部署深度学习神经网络

    人士而言往往难以理解,人们也常常误以为需要扎实的编程技能才能真正掌握并合理使用这项技术。事实上,这种印象忽视了该技术为机器视觉(乃至生产自动化)带来的潜力,因为深度学习并非只属于计算机
    的头像 发表于 09-10 17:38 679次阅读
    如何在机器<b class='flag-5'>视觉</b>中部署<b class='flag-5'>深度</b><b class='flag-5'>学习</b>神经网络

    易控智驾荣获计算机视觉顶会CVPR 2025认可

    近日,2025年国际计算机视觉与模式识别顶级会议(IEEE/CVF Conference on Computer Vision and Pattern Recognition,CVPR 2025)在美国田纳西州纳什维尔召开。
    的头像 发表于 07-29 16:54 980次阅读

    自动化计算机经过加固后有什么好处?

    让我们讨论一下部署坚固的自动化计算机的一些好处。1.温度范围宽自动化计算机经过工程设计,配备了支持宽温度范围的组件,使自动化计算解决方案能够在各种不同的极端环境中运行。自动化计算机能够
    的头像 发表于 07-21 16:44 419次阅读
    自动化<b class='flag-5'>计算机</b>经过加固后有什么好处?

    自动化计算机的功能与用途

    工业自动化是指利用自动化计算机来控制工业环境中的流程、机器人和机械,以制造产品或其部件。工业自动化的目的是提高生产率、增加灵活性,并提升制造过程的质量。工业自动化在汽车制造中体现得最为明显,其中许多
    的头像 发表于 07-15 16:32 527次阅读
    自动化<b class='flag-5'>计算机</b>的功能与用途

    工业计算机与商用计算机的区别有哪些

    工业计算机是一种专为工厂和工业环境设计的计算系统,具有高可靠性和稳定性,能够应对恶劣环境下的自动化、制造和机器人操作。其特点包括无风扇散热技术、无电缆连接和防尘防水设计,使其在各种工业自动化场景中
    的头像 发表于 07-10 16:36 516次阅读
    工业<b class='flag-5'>计算机</b>与商用<b class='flag-5'>计算机</b>的区别有哪些

    如何选择合适的外形尺寸的工业计算机

    工业计算机尺寸的关键差异化因素工业计算机的尺寸因应用要求、环境限制和性能能力而异。以下是区分它们的关键因素:物理尺寸(宽度、深度和高度):确定系统是否适合空间受限的机柜、控制面板或机架
    的头像 发表于 04-27 12:10 511次阅读
    如何选择合适的外形尺寸的工业<b class='flag-5'>计算机</b>

    一文带你了解工业计算机尺寸

    一项艰巨的任务。本博客将指导您了解关键的工业计算机尺寸、使用案例。关键工业计算机外形要素及其使用案例一、工业微型PC尺寸范围:宽度:100毫米-180毫米深度:10
    的头像 发表于 04-24 13:35 790次阅读
    一文带你了解工业<b class='flag-5'>计算机</b>尺寸

    英飞凌边缘AI平台通过Ultralytics YOLO模型增加对计算机视觉的支持

    计算机视觉的支持,扩大了当前对音频、雷达和其他时间序列信号数据的支持范围。在增加这项支持后,该平台将能够用于开发低功耗、低内存的边缘AI视觉模型。这将给诸多应用领域的机器学习开发人员
    的头像 发表于 03-11 15:11 656次阅读
    英飞凌边缘AI平台通过Ultralytics YOLO模型增加对<b class='flag-5'>计算机</b><b class='flag-5'>视觉</b>的支持

    Arm KleidiCV与OpenCV集成助力移动端计算机视觉性能优化

    生成式及多模态人工智能 (AI) 工作负载的广泛增长,推动了对计算机视觉 (CV) 技术日益高涨的需求。此类技术能够解释并分析源自现实世界的视觉信息,并可应用于人脸识别、照片分类、滤镜处理及增强现实
    的头像 发表于 02-24 10:15 876次阅读

    AR和VR中的计算机视觉

    ):计算机视觉引领混合现实体验增强现实(AR)和虚拟现实(VR)正在彻底改变我们与外部世界的互动方式。即便是在引人入胜的沉浸式
    的头像 发表于 02-08 14:29 2124次阅读
    AR和VR中的<b class='flag-5'>计算机</b><b class='flag-5'>视觉</b>

    云端超级计算机使用教程

    云端超级计算机是一种基于云计算的高性能计算服务,它将大量计算资源和存储资源集中在一起,通过网络向用户提供按需的计算服务。下面,AI部落小编为
    的头像 发表于 12-17 10:19 942次阅读