0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

阿里研发全球首个实时翻译直播

hl5C_deeptechch 来源:DeepTech深科技 作者:DeepTech深科技 2020-10-30 10:28 次阅读

近几年来,直播电商到处开花,但绝大多数都是国内的中文直播。如果想买外国电商主播推荐商品,语言不通怎么办?

这一难题已被阿里巴巴(下称 “阿里”)攻克,阿里速卖通是面向全球海外消费者设立的电商平台,它和淘宝一样,也面向所有终端消费者,但区别是速卖通是面向全球 200 多个国家和地区的电商平台。

直播电商动辄 “几亿元带货” 的高歌猛进,也让跨境电商卖家对这一模式心动不已。然而,由于不同国家和地区的语言不同、文化不同、消费习惯也不同,所以要想在速卖通做直播,语言、物流、支付和技术都是非常复杂的系统,其中语言是最急需攻克的难题。

而在近日,阿里达摩院联合速卖通推出 AI 实时翻译直播,可同时进行中文到英、俄、西三种语向的翻译。据悉,这是全球首个启用 AI 实时翻译的电商直播,中国商家只需用中文一键开播,就能同时覆盖全球英语、西班牙语、俄语区的逾十亿人口。

“被迫” 研发的翻译引擎

两年前,速卖通开始探索直播,然而不同于淘宝直播的是,高峰期涌到直播间的用户来自 19 个国家,且说着不同的语言。当时,没有多元实时翻译,要么全部用英文直播,要么面向某一语言地区的用户专门用某种语言直播,比如法语或西班牙语。

据速卖通官方直播负责人陆嬿介绍,大部分实力雄厚的商家会请外国主播,而中小商家要么放弃,要么无声直播或用中式英语(Chinglish)尬播。数据显示,速卖通上近九成商家来自中国,而 82% 的中国商家因为语言困难而放弃跨境直播。

相比淘宝直播,速卖通直播更像一个婴儿,她需要强大的 “营养” 才能快速成长。这个营养就是能实现多译多功能的实时翻译工具。

在研发多译多之前,速卖通曾试用过现成的翻译引擎,但对直播间的翻译输出脚本来说,即便是质量最好的翻译引擎,其翻译结果也不合格。当时,还有俄罗斯和西班牙用户受邀参与评测,他们的评价也是完全听不懂。

速卖通研究后发现,这些翻译引擎之所以无法使用海外直播,其一是常规同传有专业的收音设备来保障翻译准确度。但是电商直播的环境很嘈杂,很多商家直接在档口就开始播,这样就难以保证较好的收音。

其二常规的同传词库是固定的,翻译工具得到有效训练后就能保证准确度。但是电商直播商品数量过亿,且每天都在变,根本没有办法让翻译工具快速学习。而且主播每个人都来自不同地方,有的说话还带有方言。并且有些主播语速很快,这都会极大地增加翻译难度。以上原因使得速卖通不得不自研引擎。

没有训练集,商家自己 “造”

随后,速卖通耗时 7 个月开发出中译英引擎,并于 2020 年 5 月份上线。上线后商家开播率已有 65%,今年 “828 大促” 期间线上 90% 的直播间都使用了该功能。

但仍存在不足,即使中译英能力做到极限,直播间里只有 30% 的用户能听得懂主播说的话,因为 AE 是一个跨全球平台,直播间里各种用户都有,英语用户最高比例是 30%,因此亟需推出中译多的功能。

两个月后,中译多功能完成,上线之后用户体验得到较高提升,部分店铺销量随之增加 3 倍。当时,很多商家直播间的购买转化,比达人直播的转化率还高。一些直播达人和海外商家发现后,也要求使用中译多功能,可是很多商家不说中文,为此速卖通增加了多译多功能,并于今年 7 月上线。

研发过程中也有很多困难。第一是跨团队协作,研发团队分布在美国、中国、新加坡三个国家。另外,60 多位研发人员几乎从未见过面,如何让他们快速建立信任、并快速推下去是一大难题。

第二是训练集的收集。跨境直播业务在全球都很少见,市面上没有现存训练集可以直接复用。好在阿里本身拥有较强的商家生态,很多商家都积极帮忙收集训练集。

第三是并发承载点。如果只做一场翻译,根本不会有压力。但是直播每天有上千场,翻译几国语言,这就需要几千个翻译,因此服务器的并发压力非常大。后来,阿里云对此做了改造,使得服务器得以承载得住。

第四个难题是自动化展示。多译多功能可自动识别用户种类,并展示出相应的语言,比如它能识别你是中国人,从而用中文展示主播说的话。之前大家看到同传效果都是在 PC 端上面,但是移动端很复杂,为此研发人员在其中做了不少自适应的工作。

自研更高效算法模型,可 “听懂” 主播口音

达摩院研发的统一多语言多领域融合模型,可把上百个语言,以及每个语言的多个领域压缩到一个神经网络模型中进行翻译,且翻译质量不变。据达摩院骆卫华介绍,达摩院 AI 翻译技术已创下多项业界第一,日均调用量超过 13 亿次,累计 3000 亿单词,可提供 214 种语言的高质量翻译。

据速卖通直播实时翻译产品负责人赵文倩介绍,速卖通上有上亿件商品、数百亿个商品相关的专业名词,对直播实时翻译技术的要求极高,需要克服口音不标准、直播环境复杂、商品专业名词多、新品新词更迭快等问题。

主要负责该难题的是阿里达摩院自然语言处理实验室的研究员樊楷,他表示为解决 AI 听不清、听不懂的问题,达摩院研发出更高效的语音算法模型,它不仅能在嘈杂环境中 “听清” 直播内容,还能 “听懂” 主播的口音。通过将多领域的知识融入翻译模型,该算法模型还能举一反三,无需重新训练便能快速学习不同场景里不断更迭的专业名词。

现在,速卖通平台支持 18 种语言,可以保证设计出来的频道和商品定位,能够符合当地文化,这种 “入乡随俗” 主要体现在以下三方面。

心有灵犀。速卖通上有大量多元的商品,除了给它们做分类,还得容易被搜到。因此平台得根据用户输入的词,马上就能获悉他的搜索目的。在多语言混合下,这种挑战会更大。以 “Case” 为例,它具有箱子和案子的双重意思,用户输入该词语时,到底想买什么,就需要结合具体情景。此外,同样的词在不同语言里的意思也不同,例如 “Basket” 在英语里有 “篮子” 的意思,在法语里还有 “球鞋” 的意思。

可面对数以亿计的商品搜索,全程由人工解决会很慢。为此,速卖通采用人工智能来解决,当然人工智能的初步训练是由算法工程师来解决。训练结束后,速卖通最终可做到无论用户输入什么,都能根据他前后搜索的词语,来知晓其购买意图。

了如指掌。速卖通希望用户能对商品了如指掌,因此商品标题需要承载很多内容。比如,这个商品是什么?怎么找到?为什么买?但是一些商家的标题,有的没有标点符号,标题手法上也没有特别规则。这一问题也可被人工智能解决,它会给标题加上标点符号,并可整理成当地用户熟悉的表达方式。

深信不疑。速卖通是跨境平台,很多商家位于海外,商品需要飘洋过海才能到用户手中。所以,用户对平台信用、商家信用和商品质量都有很高要求。而购买前想知道商品到底好不好?就只能通过用户评价去了解。但是用户评价非常多,涉及的语言种类也非常多。另外,用户会用各种不规范的语言来评价,比如 “Very gooooood” 这样的短语,有的评价还会用到表情符号。而采用 “多到多” 翻译引擎,上述问题也可得到解决。

由于疫情原因,2020 年很多此前从未涉足直播的商家,如中国山区的果农也开始直播卖货。有了速卖通,无论是江西赣南的脐橙、还是河北枣强的貂皮都可以走向全球各地。同样,中国用户也可以买到此前只有靠代购才能买到的产品。科技惠及的从来不只是某一个国家的用户,而是全世界。

-End-

原文标题:日均调用量超13亿次,阿里达摩院研发全球首个实时翻译直播

文章出处:【微信公众号:DeepTech深科技】欢迎添加关注!文章转载请注明出处。

责任编辑:haq

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • AI
    AI
    +关注

    关注

    87

    文章

    26129

    浏览量

    263712
  • 人工智能
    +关注

    关注

    1773

    文章

    43356

    浏览量

    230126

原文标题:日均调用量超13亿次,阿里达摩院研发全球首个实时翻译直播

文章出处:【微信号:deeptechchina,微信公众号:deeptechchina】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    吉利汽车成功完成全球首个无人驾驶漂移!

    吉利汽车成功完成全球首个无人驾驶漂移!
    的头像 发表于 03-27 14:17 432次阅读
    吉利汽车成功完成<b class='flag-5'>全球</b><b class='flag-5'>首个</b>无人驾驶漂移!

    比亚迪推出全球首个手掌钥匙功能

    在2024年的梦想日活动中,比亚迪在2024年的梦想日活动中正式宣布推出全球首个“手掌钥匙”功能,标志着从物理钥匙时代向生物识别钥匙时代的全面跨越。这一创新技术将为用户带来更加便捷、安全的车辆解锁体验。
    的头像 发表于 01-19 16:56 548次阅读

    直播预告 | 无缝联接生态,释放创新潜力!

    如何实现研发协同自动化和数据同步? 11月30日 16:00 锁定华为云直播间 点击下方链接 立即预约! 一站打通业界生态研发工具或应用, 轻松提高研发效率! 多平台同步
    的头像 发表于 11-29 17:40 196次阅读

    英诺赛科(苏州)全球研发中心正式启用

    11月20日,英诺赛科(苏州)全球研发中心正式启用 将打造成为新型宽禁带半导体材料与器件研发基地同时开展大规模量产化工程问题研究提升氮化镓材料与器件的整体竞争力。
    的头像 发表于 11-22 15:27 405次阅读

    阿里全球宕机:从阿里云故障看企业 IT 挑战

    2023 年 11 月 12 日晚,阿里云遭遇了一场全球性故障,导致其全产品线全部崩溃,包括阿里云盘、钉钉、淘宝、闲鱼等服务。这次故障的规模之巨大、影响之深远,在云计算历史上堪称史诗级事件。作为一名
    的头像 发表于 11-13 00:28 166次阅读

    阿里平头哥发布首个 RISC-V AI 软硬全栈平台

    转自https://m.ithome.com/html/714391.htm 2023 RISC-V 中国峰会8月23日在北京召开,平头哥在会上发布了首个自研 RISC-V AI 平台。 据介绍,该
    发表于 08-26 14:14

    人工智能会取代翻译

    在某些场景下,如翻译普通商务文档、新闻报道以及其他非技术性的文章等,机器翻译的正确率已经非常接近人类翻译了。然而,在涉及到一些重要的领域,例如法律、药学甚至是文学等相关领域,机器翻译
    的头像 发表于 08-14 14:29 661次阅读

    深耕AI直播技术,成功拓展数字人直播带货体验及商业应用范围

    渠道,通过直播带货等形式,消费者能够更加直观地了解产品,从而提高销售转化率。基于此,盈澜汇科技紧跟市场,创新性的开发出了“数字人直播”,一种利用人工智能和计算机图形学,将虚拟人物与真实人物进行实时互动的
    的头像 发表于 08-09 11:38 487次阅读
    深耕AI<b class='flag-5'>直播</b>技术,成功拓展数字人<b class='flag-5'>直播</b>带货体验及商业应用范围

    机器翻译研究进展

    机器翻译使用计算机将一种语言翻译成另一种语言,具有低成本、高效率和高翻译质量等优势,在语音翻译、同声传译自动化等许多领域得到广泛应用。 随着双语语料库的不断建设和完善,基于语料库的机器
    的头像 发表于 07-06 11:19 378次阅读
    机器<b class='flag-5'>翻译</b>研究进展

    直播回顾】虹科产线实时数采检测方案——高速采集助力智能化升级

    虹科云课堂直播回顾5月25日,虹科云课堂【虹科产线实时数采检测方案】圆满结束,感谢大家的观看与支持。本文将对直播要点进行回顾和总结,若需获取完整回放视频、直播课件或产品目录等,欢迎扫描
    的头像 发表于 06-22 10:15 288次阅读
    【<b class='flag-5'>直播</b>回顾】虹科产线<b class='flag-5'>实时</b>数采检测方案——高速采集助力智能化升级

    直播回顾 | 虹科实时操作系统INtime7——解决智能制造苛刻实时需求的关键RTOS

    6月15日晚2000,虹科技术工程师许工为大家分享了“虹科实时操作系统INtime7——解决智能制造苛刻实时需求的关键RTOS”主题直播课程,课程的主要内容包括实时操作系统的必要性、虹
    的头像 发表于 06-21 17:23 525次阅读
    <b class='flag-5'>直播</b>回顾 | 虹科<b class='flag-5'>实时</b>操作系统INtime7——解决智能制造苛刻<b class='flag-5'>实时</b>需求的关键RTOS

    成本更低、带货时间更长!数字人直播将颠覆直播行业?

    基于3D建模和虚拟现实技术,通过实时合成技术将一个真人的视频信息或者图片实时合成到一个虚拟人物身上。同时,为了让观众有更好的沉浸感和代入感,在观看时还有背景音乐可以播放,也可以进行互动。   数字人直播可能颠覆
    的头像 发表于 06-07 01:14 1861次阅读

    边缘计算加速视频直播场景:更清晰、流畅、实时

    直播清晰、流畅、实时的观看和互动体验?本文主要分享边缘计算在视频直播场景中的应用,核心内容如下: 1. 什么是直播? 2. 直播的系统架
    发表于 05-31 15:09 0次下载
    边缘计算加速视频<b class='flag-5'>直播</b>场景:更清晰、流畅、<b class='flag-5'>实时</b>

    如何开发直播平台:直播源码推拉流技术的实现(二)

    直播源码的拉流技术通俗来讲观看直播的人,通过拉流的相关协议和地址,拉取直播人的直播数据,在播放端,比如手机、平板、PC上就可以观看直播了。
    的头像 发表于 05-11 14:06 448次阅读
    如何开发<b class='flag-5'>直播</b>平台:<b class='flag-5'>直播</b>源码推拉流技术的实现(二)

    基于MQTT协议设计的实时图传系统(阿里云物联网平台)

    当前基于MQTT协议设计了一个实时图传系统,通过这个项目来演示,两个MQTT设备如何互相订阅,进行消息流转。 在阿里云服务器上创建2个设备,分为为设备A和设备B;设备A负责采集本地摄像头画面
    的头像 发表于 04-27 09:16 6258次阅读
    基于MQTT协议设计的<b class='flag-5'>实时</b>图传系统(<b class='flag-5'>阿里</b>云物联网平台)