0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

Nomad AI计划开发适用于更广泛音频识别的应用

我快闭嘴 来源:36kr网 作者:李子月 2021-01-25 12:52 次阅读

Nomad AI由法国人Vivien Seguy于2018年创立,运营着三个App:和弦自动识别 Chord AI、图片识别词典Yomiwa(日语)和HanYou(中文)。公司注册于爱沙尼亚,得益于其e-residency政策(无论你实际居住在哪里,都可以在爱沙尼亚创建一家公司,并在线管理),Vivien可以一边工作一边旅行。现由于疫情原因回到家乡法国中部的克莱蒙费朗Clermont-Ferrand,办公室设在联合办公空间Turing 22。

Vivien 拥有法国巴黎综合理工学院(École Polytechnique)数学与计算机科学学士学位、英国帝国理工学院应用数学硕士学位,日本京都大学机器学习博士学位。Chord AI、Yomiwa和HanYou的iOS版属于Vivien的公司Nomad AI,他现在全职运营这三个App。Guillaume Bellec现任洛桑联邦理工学院(École Polytechnique Fédérale de Lausanne EPFL)博士后研究员,Chord AI的Android版在他注册的公司Bellec Research名下;Antoine Rolet目前在东京做自由软件工程师,Yomiwa和HanYou的Android版由他注册的公司管理。

进入博士项目前,Vivien已开始着手制作一个日语OCR(光学字符识别)应用。后于博士期间结识Antoine Rolet,正式开始开发日语词典Yomiwa,并进一步将其改编成中文词典HanYou。两个App分别发布于2013年和2014年,是最早的几款具有OCR功能的应用之一,甚至早于谷歌翻译。在Apple Store和Play store上有很多日语和中文词典的应用,以Pleco为代表,Pleco内容更加丰富,得益于其多年来与专业词典编辑的合作关系。Vivien表示,Yomiwa和HanYou是唯一具有光学识别、形态文字分析、手写识别、自动从新闻中获取词表等独特功能的词典应用,并计划进一步充实词典内容。Yomiwa和HanYou可以免费下载使用,一些特殊功能,如相机OCR或全自动每日单词列表,需要通过购买 “专业版 ”来解锁。模式为单次付费,而非会员制。

音频识别是Vivien更感兴趣的领域。博士期间Vivien和Antoine Rolet一起做了一个关于盲源分离的研究项目,目的是将混合的声音从单一的录音中分离出来。同时,Vivien的合伙人又发表了一篇名为 “Spectral Optimal Transport ”的论文,利用Vivien的研究课题--最优传输来建立一个钢琴音符识别算法。后来,Vivien在ICLR2018会议上认识了另一位博士生Guillaume Bellec,他也是一位业余音乐人,他们开始一起讨论如何实现这个想法,Chord AI项目由此才正式开始。

Chord AI利用机器学习算法自动识别音乐中的和弦、调性、节拍等,可以从本地文件、麦克风、甚至在同一设备中播放的YouTube上来获取音频。Vivien强调了大量准确标注数据的重要性。几个创始人最开始在公开的注释数据集(如Isophonics、JAAH和Billboard )训练算法,数据在数量和质量上非常有限,无法达到目标精度,Vivien希望能够实现在和弦识别方面远超最新研究论文中的最先进结果。因此他们很快就开始建立自己的数据库,并自己对音频进行标注,还对音乐进行程序化合成。他们还专门做了一个私人的iOS应用,专门用来简化用和弦和节拍注释歌曲的过程。因此,Vivien表示Chord AI在识别和弦精度上高于同类公司,如Chord Tracker和Chordify;Yamaha的应用 “Chord Tracker ”似乎比Chordify或MyChord精度更高,但它只能从本地文件中获取音频。Chord AI现可以免费下载和使用大部分功能。一些特殊的功能,如高级和弦识别或音高转换,需要解锁 “专业版”才能使用。费用为10美元/次(截至2021年1月),并不是会员模式。

Chord AI的iOS和Android版本共有约15万活跃用户,日下载增量1000次(大约50%在美国,30%在亚洲,20%在欧洲)。每天在这1000个新用户中,约有5%的用户最终购买了 “专业版”。Vivien表示,Chord AI在法国约有200-300万潜在用户,世界范围内潜在用户超过1亿。Yomiwa的iOS和Android版本共有约30万活跃用户,日下载增量300次,约有2%的新用户最终购买了“专业版”。 HanYou的iOS和Android版本拥有约3万活跃用户,日下载增量50次,约有3%的新用户最终购买了“专业版”。2020年,Chord AI、Yomiwa和HanYou的营业总额约为10万美金。Vivien预计三个App的总营业额在2021年至少能翻三倍。

Vivien正在筹划与Guillaume一起围绕Chord AI成立一个初创公司,并开发另一个不仅限于音乐,而是适用于更广泛音频的应用。总部将位于欧洲,但没有确定具体的城市。目前Nomad AI还没有融过资,前期费用都由创始人承担。现计划为新初创公司筹集100万欧元,用于团队建设,增添一名COO、一名CMO、两到三名机器学习工程师。
责任编辑:tzh

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 计算机
    +关注

    关注

    19

    文章

    6649

    浏览量

    84504
  • AI
    AI
    +关注

    关注

    87

    文章

    26443

    浏览量

    264038
  • iOS
    iOS
    +关注

    关注

    8

    文章

    3321

    浏览量

    149164
收藏 人收藏

    评论

    相关推荐

    Uhnder 推出首款适用于更广泛汽车市场的 4D 数字成像雷达芯片

    通道,且基于领先的数字编码调制(DCM),可以为更广泛的汽车市场提供 更具性价比的 4D 数字成像雷达解决方案 。   在自动驾驶领域,4D 成像雷达以其卓越的安全性能备受瞩目,然而,由于技术复杂和成本高昂,目前这一技术仅用于高端车型。为了解决这一问题,Uhnder
    发表于 04-24 09:17 280次阅读

    开发者手机 AI - 目标识别 demo

    功能简介 该应用是在Openharmony 4.0系统上开发的一个目标识别的AI应用,旨在从上到下打通Openharmony AI子系统,展示Openharmony系统的
    发表于 04-11 16:14

    英特尔宣布AI PC加速计划新增两项AI举措

    首先,“AI PC 开发计划”面向软件研发人员和独立软件开发商,为他们提供便捷的开发环境,助力加速大规模运用新型
    的头像 发表于 03-27 16:03 117次阅读

    FP_AI_VISION1工程是否可以适用于stm32f746discovery开发板?

    FP_AI_VISION1工程是否可以适用于stm32f746discovery开发板?使用STM32CUBEIDE打开FP_AI_VISION1工程为什么没有stm32可运行文件,不
    发表于 03-18 07:21

    安达发|APS计划排产软件适用于哪些场景?

    和生产效率的提升。那么,APS计划排产软件适用于哪些场景呢?下面我将从不同的角度来详细解答这个问题。 APS计划排产软件适用于制造业企业。制造业是国民经济的重要支柱产业,其生产过程中涉
    的头像 发表于 02-01 15:24 143次阅读
    安达发|APS<b class='flag-5'>计划</b>排产软件<b class='flag-5'>适用于</b>哪些场景?

    磁珠有什么功能?适用于哪些行业?

    磁珠有什么功能?适用于哪些行业? 磁珠是一种具有磁性的微小颗粒,通常由磁性材料如氧化铁或钴合金制成。磁珠具有许多独特的功能和用途,广泛应用于各个行业。在本文中,我将详细介绍磁珠的功能以及适用的行业
    的头像 发表于 01-11 15:59 282次阅读

    芯曜途科技发布适用于MEMS传感器阵列的STN100近感AI推理芯片

    近日,芯曜途科技发布了适用于MEMS传感器阵列的STN100近感AI推理芯片。
    的头像 发表于 12-15 15:51 724次阅读

    适用于电表的防干扰隔离反激式电源

    适用于电表的防干扰隔离反激式电源
    的头像 发表于 12-06 16:10 300次阅读
    <b class='flag-5'>适用于</b>电表的防干扰隔离反激式电源

    EVAL-AD7386FMCZ是否适用于其他带有FMC接口的FPGA开发板?

    请问EVAL-AD7386FMCZ是否适用于其他带有FMC接口的FPGA开发板,例如Xilinx公司的ML605开发板?
    发表于 12-04 07:30

    IGBT适用于ZVS 还是 ZCS?

    IGBT适用于ZVS 还是 ZCS?
    的头像 发表于 12-01 16:10 600次阅读
    IGBT<b class='flag-5'>适用于</b>ZVS 还是 ZCS?

    开发适用于高速车载接口的电源电感器

    开发适用于高速车载接口的电源电感器
    的头像 发表于 08-22 15:52 781次阅读
    <b class='flag-5'>开发</b><b class='flag-5'>适用于</b>高速车载接口的电源电感器

    请问FP_AI_VISION1工程是否可以适用于stm32f746 discovery开发板?

    FP_AI_VISION1工程是否可以适用于stm32f746discovery开发板?使用STM32CUBEIDE打开FP_AI_VISION1工程为什么没有stm32可运行文件,不
    发表于 08-07 08:37

    APS适用于什么场景

    APS适用于什么场景 使用Excel进行生产计划和排程,然而在我国很多的小微企业中,很多都是用EXCEL甚至手工进行生产计划和排程,不能实现系统优化生产计划和排程(APS)的智能制造是
    的头像 发表于 08-02 14:11 342次阅读

    是否有适用于LPC4357的替代屏幕?

    我正在考虑使用 LPC4357-K43WQA 开发板开始一些开发。它适用于需要 LCD 屏幕的项目。LPC ARM 设备是我们在这里体验最多的,因此使用 LPC4357 并带有 LCD 屏幕的
    发表于 06-02 07:57

    jscrane/TTS库不适用于NodeMCU 1.0吗?

    该库适用于 arduino nano,但我无法让它适用于 NodeMCU 1.0 esp8266。该库将文本转换为使用 PWM 信号生成为音频的现象。库 2 的 github 页面在其自述文件中确实
    发表于 06-01 06:01