0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

阿里达摩院提出MogFace:人脸检测新工作

CVer 来源:CVer 作者:CVer 2022-11-29 15:24 次阅读

一、开源

77fd25c0-6f37-11ed-8abf-dac502259ad0.png

MogFace: Towards a Deeper Appreciation on Face Detection

1. 论文链接:

https://openaccess.thecvf.com/content/CVPR2022/papers/Liu_MogFace_Towards_a_Deeper_Appreciation_on_Face_Detection_CVPR_2022_paper.pdf

2. 代码模型:

https://modelscope.cn/models/damo/cv_resnet101_face-detection_cvpr22papermogface/summary

3. 可玩应用:

https://modelscope.cn/studios/baigui/face_album/summary

二、背景

人脸检测算法是在一幅图片或者视频序列中检测出来人脸的位置,给出人脸的具体坐标,一般是矩形坐标。它是人脸关键点、属性、编辑、风格化、识别等模块的基础。本文通过实验观察发现,对应设计出如下三个模块构建出一个高性能的人脸检测器MogFace:1.)动态标签分配策略(dynamic label assignment),2.)误检上下文相关性分析(FP context analysis),3.)金字塔层级监督信号分配(pyramid layer level GT assignment)。该方法的模型在WIDER FACE榜单上取得了截止目前将近两年的六项第一。

三、观察

1.1 动态标签分配策略(dynamic label assignment)

为每个anchor点定义cls和reg目标是训练检测器的必要过程,在人脸检测中这个过程称之为标签分配(Label Assignment)。最近,标签分配吸引了诸多研究人员的注意,在人脸检测及通用物体检测领域提出了一系列方法,例如:OTA、PAA,ATSS以及HAMBox。如示例图(a),标签分配过程依赖4个元素。分别是:1.)offline information: a.)IoU (anchor与ground-truth框的IoU) , b.)CPD (anchor与ground-truth中心点的距离) ,2.)online information: a.)PCS (cls分支对anchor的前景分类概率值) ,b.)PLC (reg分支对anchor的预测坐标值)。

781a5fd2-6f37-11ed-8abf-dac502259ad0.png

但是,目前的标签分配方法存在三个问题。1.)若只用offline information做静态标签分配,那么会有很多具备更强回归能力的negative anchor无法被有效利用起来,会导致标签分配策略欠饱和。2.)若过度信任online information动态调整正负anchor时(如OTA和Hambox),由于online information属于预测信息可信度不高,会导致标签分配策略错误多, 极端情况下会陷入trivial 的分配结果。3.) 若引入大量超参 (K in ATSS, alpha in OTA)做标签分配,则当数据集分布发生变化时,需要大量的调参时间。

1.2 误检上下文相关性分析(FP context analysis)

在实际应用中,人脸检测器并不会十分care AP的指标,而对误检(false positive [FP])的数量十分敏感。针对这个问题,目前的做法是收集大量带有FP的图片去fine-tune或者from scratch训练检测器,来帮助检测器了解更多范式的FP,但是我们发现有些频繁出现在训练集中的的FP在这种策略下无法有效解决。这篇文章,我们发现了一个有趣的现象:对于同一个FP,当它的context发生变化时,对于同一个检测器来说它可能就不是FP了。如下图(c),最左面的图片里日历是FP,剩余两张日历都不是FP。

783f0d50-6f37-11ed-8abf-dac502259ad0.png

1.3 金字塔层级监督信号分配(pyramid layer level GT assignment)

scale-level 数据增强策略常常作通用物体检测以及人脸检测中解决scale variance主要手段。如图(b)所示,相对于COCO,人脸检测数据集Wider Face 中人脸的尺度分布更为严峻。为此,我们分提出了一个新的问题,如何合理的分配ground-truth 在不同pyramidlayer上的分布?即检测器的性能与每个pyramidlayer匹配ground-truth的个数之间的关系是什么?是否越多越好?通过严格的对比实验我们发现:“对于所有的pyramid layer来说,并不是这个pyramid layer匹配到越多的ground-truth就越好”。这说明要挖掘每一个pyramidlayer的最好性能,需要控制在这个pyramidlayer上的ground-truth分配的比例。

785e88d8-6f37-11ed-8abf-dac502259ad0.png

四、方法

2.1 Adaptive Online Incremental Anchor Mining Strategy (Ali-AMS)

针对上述“动态标签分配策略(dynamic label assignment)”观察分析,本文提出了在里面一种自适应的在线增量锚挖掘策略(Ali-AMS),它基于standard anchor matching 策略,并进一步adaptive 帮助outlier face匹配anchor。如下:

7880139a-6f37-11ed-8abf-dac502259ad0.png

2.2 Hierachical Context-Aware Module (HCAM)

基于上述“误检上下文相关性分析(FP context analysis)”观察分析,发现“对于同一个FP,当它的context发生变化时,对于同一个检测器来说他可能就不是FP了”,我们进一步提出了一个two-step的模块来显示的encode context 信息来帮助区分FP和TP,显著减少了FP的数量。

7895de46-6f37-11ed-8abf-dac502259ad0.png

2.3 Selective Scale Enhancement Strategy (SSE)

基于上述的“金字塔层级监督信号分配(pyramid layer level GT assignment)”观察分析,发现“对于所有的pyramid layer来说,并不是这个pyramid layer匹配到越多的ground-truth就越好”,我们提出通过控制pyramid layer 匹配的ground-truth的数量来最大化pyramid layer 的性能。

78b71a5c-6f37-11ed-8abf-dac502259ad0.png

五、实验

3.1 Ablation Study

78d401a8-6f37-11ed-8abf-dac502259ad0.png

3.2 Comparison with sota

79003fac-6f37-11ed-8abf-dac502259ad0.png

审核编辑 :李倩

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 模块
    +关注

    关注

    7

    文章

    2485

    浏览量

    46534
  • 检测器
    +关注

    关注

    1

    文章

    811

    浏览量

    47292
  • 检测算法
    +关注

    关注

    0

    文章

    117

    浏览量

    25148

原文标题:WIDER FACE六项第一!阿里达摩院提出MogFace:人脸检测新工作 | CVPR 2022

文章出处:【微信号:CVer,微信公众号:CVer】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    阿里达摩院放弃自动驾驶,团队全部并入菜鸟集团,技术终须回归应用场景

    电子发烧友网报道(文/黄山明)近日,市场曝出阿里达摩院自动驾驶业务线进行重大调整,自动驾驶实验室将并入菜鸟集团。对此,阿里方面也确认了此消息的真实性,并表示该调整是因为“业务需要”。而最开始,
    的头像 发表于 05-16 01:05 1831次阅读

    阿里达摩院北京公司新增AI业务

    阿里巴巴达摩院(北京)科技有限公司近日进行了工商变更,经营范围有所调整。具体来说,公司去除了智联网、芯片技术、量子计算等数据通信、电子产品、软件和硬件技术及产品的研究、开发等业务,而新增了人工智能应用软件开发、人工智能基础软件开发,以及第一、第二、第三类医疗器械生产、租赁
    的头像 发表于 02-23 11:39 603次阅读

    阿里达摩院在上海成立新公司,聚焦人工智能与软件开发

    天眼查信息显示,达摩院(上海)科技有限公司已正式成立,法定代表人为张建锋,注册资本为1000万人民币。该公司由阿里巴巴旗下阿里巴巴达摩院(杭州)科技有限公司全资持股。
    的头像 发表于 02-04 10:52 535次阅读

    【飞腾派4G版免费试用】飞腾派SeetafaceEngine人脸检测

    收到个飞腾派,周末有空玩玩。。。 Seetaface是2016年中科老师开源的的人脸识别引擎。https://github.com/seetaface/SeetaFaceEngine 源码
    发表于 12-18 10:53

    产学研三界顶级大咖分享:RISC-V场景Show暨开源生态高级别论坛定档12/19

    12月19日,RISC-V场景Show暨开源生态高级别论坛即将开幕。本次论坛将邀请来自中科计算技术研究所副所长包云岗、嘉楠科技AI软件总监张晓晶、阿里巴巴达摩生态总监陈炜、清华大学
    发表于 12-15 18:36

    阿里达摩院裁撤量子实验室证实!

    阿里达摩院证实,他们已经决定裁撤量子实验室,并将实验室及仪器设备捐赠给浙江大学。这一举措的目的是为了促进量子科技的协同发展,并将捐赠的实验室和设备开放给浙江大学及其他高校和科研机构使用。
    的头像 发表于 11-28 18:20 765次阅读

    阿里达摩院量子实验室裁撤 整体捐献给浙江大学

    日前,阿里达摩院量子实验室裁撤,达摩院量子实验室以及仪器设备全部被捐给浙江大学。相关信息从首席科学家施尧耘发布的动态可以印证;这可以说是来自官方的确认。 2015年阿里云和中国科学院开
    的头像 发表于 11-28 16:04 381次阅读

    如何在交互式人脸检测演示中将Web浏览器流用作目标输入?

    无法将 Web 浏览器流用作交互式人脸检测演示的目标输入。
    发表于 08-15 06:02

    DCNN网络结构 DCNN的人脸特征点检测

    摘 要:在介绍人脸特征点检测的理论知识的基础上,提出了一种基于深层卷积神经网络(Deep ConvolutionalNeural Network,DCNN)解决人脸5点特征点(眼角、鼻
    发表于 07-20 14:30 0次下载

    人脸识别是如何工作人脸识别技术的利与弊

    人脸识别是一种生物识别技术,通过对人脸图像或视频进行分析和比对,识别出人脸的身份。下面是简要的工作原理。
    发表于 06-30 15:02 930次阅读

    【EsDA应用】5分钟快速实现图像人脸检测

    人脸识别是一种高安全性的生物识别技术,广泛应用在安防、身份验证等领域。而人脸检测是进行人脸识别的重要前提,本文主要介绍如何基于EsDA设计的人脸
    的头像 发表于 05-18 10:48 401次阅读
    【EsDA应用】5分钟快速实现图像<b class='flag-5'>人脸</b><b class='flag-5'>检测</b>

    【EsDA应用】5分钟快速实现图像人脸检测

    人脸识别是一种高安全性的生物识别技术,广泛应用在安防、身份验证等领域。而人脸检测是进行人脸识别的重要前提,本文主要介绍如何基于EsDA设计的人脸
    的头像 发表于 05-17 12:20 381次阅读
    【EsDA应用】5分钟快速实现图像<b class='flag-5'>人脸</b><b class='flag-5'>检测</b>

    自动驾驶行业动荡:阿里达摩院撤出,图森未来面临退市

    阿里达摩院已将其自动驾驶团队全部并入菜鸟集团,自身将不再保留相关业务和团队。阿里的自动驾驶业务将转由菜鸟集团的技术团队负责,并将围绕物流服务展开。
    的头像 发表于 05-16 09:50 838次阅读
    自动驾驶行业动荡:<b class='flag-5'>阿里</b><b class='flag-5'>达摩</b>院撤出,图森未来面临退市

    阿里达摩院自动驾驶团队全部并入菜鸟集团!;塔塔集团将在印度生产苹果 iPhone 15 / Plus 手机

    热点新闻 1、消息称阿里达摩院自动驾驶团队全部并入菜鸟集团 近日,有媒体报道,阿里达摩院自动驾驶业务线重大调整,自动驾驶实验室或并入菜鸟集团。阿里
    的头像 发表于 05-15 23:35 615次阅读
    <b class='flag-5'>阿里</b><b class='flag-5'>达摩</b>院自动驾驶团队全部并入菜鸟集团!;塔塔集团将在印度生产苹果 iPhone 15 / Plus 手机

    重磅!阿里达摩放弃自动驾驶研发 团队全部转入菜鸟

    行业芯事时事热点行业资讯
    电子发烧友网官方
    发布于 :2023年05月15日 11:26:04