机器翻译系统实现了自然语言处理的又一里程碑突破-电子发烧友网

微软昨天宣布其研发的机器翻译系统首次在通用新闻的汉译英上达到了人类专业水平，实现了自然语言处理的又一里程碑突破。

由微软亚洲研究院与雷德蒙研究院的研究人员组成的团队今天宣布，其研发的机器翻译系统在通用新闻报道的中译英测试集上，达到了人类专业译者水平。这是首个在新闻报道的翻译质量和准确率上媲美人类专业译者的翻译系统。

微软技术院士，负责微软语音、自然语言和机器翻译工作的黄学东博士表示，这是自然语言处理领域的一项里程碑式的成就。“这是我们的情怀，是非常有意义的工作，”黄学东告诉新智元：“消除语言障碍，让人们能更好地沟通，非常有价值，值得我们多年来不断为此付出努力。”

黄学东骄傲地说，2015年微软率先在图像识别ImageNet数据集达到人类水平，2016年在Switchboard对话语义识别达到人类水平，2017在斯坦福问答数据集SQuAD上达到人类水平，今天又在机器翻译上达到人类水平，一路走来，微软的进步激动人心，“这是我们共同的成就，我们是站在同行的肩膀上往上走”。

黄学东表示，微软语音和NLP组在成立时，便立下了要在两年后将机器翻译做到人类专业水平的目标。如今，这一目标提前实现，“除了计算力的大幅提高，深度学习方法的提高，我们还结合了以前在Switchboard上取得的经验，数据也做了很多整理，比如去除低质量的训练数据，等等。”黄学东说。

“这既是技术上的突破，也是工程上的突破，是技术和工程的完美结合，只有把过程中的每一件事情都做好，才能得到这样的结果。”

NLP里程碑式突破：首个媲美人类专业译者的机器翻译系统

这次微软的翻译系统是在数据集WMT-17的新闻数据集newstest2017上取得了上述成果。WMT是机器翻译领域的国际顶级评测比赛之一。WMT数据集也是机器翻译领域一个公认的主流数据集。其中，newstest2017新闻报道测试集由产业界和学术界的合作伙伴共同开发，包括来自新闻评论语料库的约332K个句子对，来自联合国平行语料库的15.8M个句子对，以及来自CWMT语料库的9M个句子对。

虽然研究人员只进行了汉译英的测试，但黄学东表示，英译汉结果也应该并无不同。“从技术上说，汉译英和英译汉是相同的，只要有足够的数据。”

为了确保翻译结果准确且达到人类的翻译水平，微软研究团队还邀请了双语语言顾问，将微软的翻译结果与两个独立的人工翻译结果进行了比较评估（全部盲测）。黄学东告诉新智元：“当机器翻译质量很差的时候，使用BLEU评分还行，但是当机器翻译质量提高以后，就需要靠人类来评价。”

具体说，当100分是标准满分时，微软的系统得分69.9，专业译者68.6，而众包翻译得分为67.6。

人类专家的评估结果（部分）：其中，Reference-HT为纯人工翻译；Reference-PE为使用Google Translate加人工后期编辑的翻译；Reference-WMT是WMT原始翻译，包含错误；Online-A-1710是2017年10月16日收集的Microsoft翻译商用系统（production system）；Online-B-1710是2017年10月16日收集的谷歌翻译商用系统；Sogou是搜狗NMT翻译系统，这是在2017年WMT中英机器翻译竞赛的冠军。

机器翻译提前7年超越业余译者，人工智能再下一城

机器翻译是科研人员攻坚了数十年的研究领域，曾经很多人都认为机器翻译根本不可能达到人类翻译的水平。

2017年中旬，牛津大学面向机器学习研究人员做了一次大规模调查，调查的内容是他们对 AI 进展的看法。这些研究人员预测，未来10年，AI 将在许多活动中超过人类，具体预测见下表：

微软的这次突破，将机器翻译超越人类业余译者的时间，提前了整整7年，远远超出了众多ML研究人员的预想。

虽然此次突破意义非凡，但微软研究人员也提醒大家，这并不代表人类已经完全解决了机器翻译的问题，只能说明我们离终极目标又更近了一步。微软亚洲研究院副院长、自然语言计算组负责人周明表示，在WMT17测试集上的翻译结果达到人类水平很鼓舞人心，但仍有很多挑战需要解决，比如在实时的新闻报道上测试系统等。

微软机器翻译团队研究经理Arul Menezes表示，团队想要证明的是：当一种语言对（比如中-英）拥有较多的训练数据，且测试集中包含的是常见的大众类新闻词汇时，那么在人工智能技术的加持下，机器翻译系统的表现可以与人类媲美。

突破当前神经机器翻译范式局限，性能再上一个数量级

为了能够取得中-英翻译的里程碑式突破，来自微软亚洲研究院和雷德蒙研究院的三个研究组，进行了跨越中美时区、跨越研究领域的联合创新。

在这篇有24位作者的论文《机器翻译：中英新闻翻译方面达到与人类媲美的水平》（Achieving Human Parity on Automatic Chinese to English News Translation ）中，微软研究团队描述了他们为新闻汉英翻译任务在规模数据集上实现人类水平所作的努力。

在论文中，作者表示他们解决了当前NMT范式的一些局限。他们的研究主要贡献包括：

利用翻译问题的对偶性（duality），使模型能够从源语言到目标语言（Source to Target）和从目标语言到源语言（Target to Source）这两个方向的翻译中学习。同时，这让我们能同时从有监督和无监督的源数据和目标数据中学习。具体而言，我们利用通用的对偶学习（dual learning）方法，并引入联合训练（Joint Training）算法，通过在一个统一的框架中反复提高从源语言到目标语言翻译和从目标语言到源语言翻译的模型，从而增强单语源和目标数据的效果。

NMT系统从左到右自动回归解码，这意味着在按顺序生成输出期间，之前的错误将被放大，并可能误导后续生成的结果。这只能部分通过波束搜索（beam search）进行补救。我们提出了两种方法来缓解这个问题：推敲网络（Deliberation Networks），这是一种基于双路解码来优化翻译的方法；以及在两个Kullback-Leibler（KL）散度正则化项上的新训练目标，鼓励从左到右和从右到左的解码结果变得一致。

由于NMT非常容易受到嘈杂训练数据、数据中的罕见事件以及总体训练数据质量的影响，论文还讨论了数据选择和过滤的方法，包括跨语言句子表示。

最后，我们发现我们的系统是完全互补的，因此可以从系统组合中获益很多，最终实现了机器翻译达到人类水平的目标。

四大技术加持，神经机器翻译将成今后机器翻译绝对主流

其中，微软亚洲研究院机器学习组将他们的最新研究成果——对偶学习（Dual Learning）和推敲网络（Deliberation Networks）应用在了此次取得突破的机器翻译系统中。其中，对偶学习利用的是人工智能任务的天然对称性。当我们把训练集中的一个中文句子翻译成英文之后，系统会将相应的英文结果再翻译回中文，并与原始的中文句子进行比对，进而从这个比对结果中学习有用的反馈信息，对机器翻译模型进行修正。

微软亚洲研究院副院长、机器学习组负责人刘铁岩

而推敲网络则类似于人们写文章时不断推敲、修改的过程。通过多轮翻译，不断地检查、完善翻译的结果，从而使翻译的质量得到大幅提升。“我们在深度学习和自然语言这两者中间找到了一个平衡点，我们想通过对机器翻译的研究，从自然语言的角度对机器学习做进一步的理解，找到一些直觉，再通过这个直觉反过来影响机器学习研究的路线，走出盲目尝试的状态。”微软亚洲研究院副院长、机器学习组负责人刘铁岩说。

那研究人员从推敲网络中获得的直觉是什么呢？他们发现，人在做翻译的时候，在看见或听完源语言后，脑子里会形成一个观点，这其实就是编码的过程。但是，我们真正把这句话当成目标语言讲出来，实际上是三思而后行的。我们不会一个字一个字往出蹦，我们会先酝酿一下要怎么讲，如果是文字翻译，还可能不断地修改，让语句更加通顺或者优美。

“我们常常说，人会做推敲的事情，是‘僧敲月下门’还是‘僧推月下门’，要琢磨琢磨，上下文关系用哪个字更好，如何在一个机器学习的模型中将这种推敲过程体现出来，就是推敲网络所要去尝试的一个点。”刘铁岩告诉新智元。

推敲，也就是在解码器，或者说在文本生成的过程多做点文章，把人的一些直觉放进去。“在我们的DeliberationNet里面，解码器是有多层的，解码器先做一遍，可能翻译得不太好，但从头到尾翻译完了，这句翻译会再扔给下一个解码器再做一遍，这个过程可以不断反复，不停地去修改之前翻译的完整结果，这其实就在做推敲。我们发现，这样推敲后的结果比只过一次要好很多，多过一次时间代价会增多，但是结果会更好。”

微软亚洲研究院副院长、自然语言计算组负责人周明

周明带领的自然语言计算组多年来一直致力于攻克机器翻译，这一自然语言处理领域最具挑战性的研究任务。周明表示，“由于翻译没有唯一的标准答案，它更像是一种艺术，因此需要更加复杂的算法和系统去应对。”

基于之前的研究积累，自然语言计算组在此次的系统模型中增加了另外两项新技术：联合训练（Joint Training）和一致性规范（Agreement Regularization），以提高翻译的准确性。联合训练可以理解为用迭代的方式去改进翻译系统，用中英翻译的句子对去补充反向翻译系统的训练数据集，同样的过程也可以反向进行。一致性规范则让翻译可以从左到右进行，也可以从右到左进行，最终让两个过程生成一致的翻译结果。

左边是联合训练：从源语言到目标语言翻译（Source to Target）P(y|x) 与从目标语言到源语言翻译（Target to Source）P(x|y)；右边是一致性规范

这次使用的技术，从对偶学习（Dual Learning）、推敲网络（Deliberation Network）到一致性规范（Agreement Regularization），都属于神经机器翻译（NMT）方法。而黄学东也认为，今后的机器翻译领域，NMT也将成为绝对主流。“相比统计机器翻译，神经机器翻译有一个很大的提高，而这次我们新的系统，相比普通的神经机器翻译，又有一个很大的提高。”

黄学东说：“我们这次的系统是把很多不同的机器翻译系统组合到一起，这些系统每一个都能独立工作，输出结果，最终，我们再将这些结果综合起来，输出一个最好的结果。”

深度学习NLP掌握着实现强人工智能的钥匙

对于语音识别等其它人工智能任务来说，判断系统的表现是否可与人类媲美相当简单，因为理想结果对人和机器来说完全相同，研究人员也将这种任务称为模式识别任务。

然而，机器翻译却是另一种类型的人工智能任务，即使是两位专业的翻译人员对于完全相同的句子也会有略微不同的翻译，而且两个人的翻译都不是错的。那是因为表达同一个句子的“正确的”方法不止一种。周明表示：“这也是为什么机器翻译比纯粹的模式识别任务复杂得多，人们可能用不同的词语来表达完全相同的意思，但未必能准确判断哪一个更好。”

复杂性让机器翻译成为一个极有挑战性的问题，但也是一个极有意义的问题。刘铁岩认为，我们不知道哪一天机器翻译系统才能在翻译任何语言、任何类型的文本时，都能在“信、达、雅”等多个维度上达到专业翻译人员的水准。不过，他对技术的进展表示乐观，因为每年微软的研究团队以及整个学术界都会发明大量的新技术、新模型和新算法，“我们可以预测的是，新技术的应用一定会让机器翻译的结果日臻完善。”

研究团队还表示，他们计划将此次技术突破推广到其他语言上面，同时应用到微软的商用多语言翻译系统产品中。

黄学东认为，神经机器翻译，或者说深度学习，最激动人心的地方在于，它能够学会自然语言内部的embedded feature，把语言的结构，语义结构和语义的表示学习出来，再反馈到系统，从而实现自然语言理解的突破。

“机器学习需要很多数据，NLP没有很多标注的数据，把表示学习出来，还能推广到其他系统。”黄学东说：“NLP掌握着今后实现强人工智能的钥匙。”

声明：本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人，不代表电子发烧友网立场。文章及其配图仅供工程师学习之用，如有内容侵权或者其他违规问题，请联系本站处理。举报投诉

AI

AI

+关注

关注
87

文章
26363

浏览量
263950
机器翻译

机器翻译

+关注

关注
0

文章
138

浏览量
14793
自然语言

自然语言

+关注

关注
1

文章
269

浏览量
13196

原文标题：【AI再创纪录】机器翻译提前7年达到人类专业翻译水平！

文章出处：【微信号：AI_era，微信公众号：新智元】欢迎添加关注！文章转载请注明出处。

自然语言处理的研究内容

自然语言处理（NLP）的最新发展改变了我们与AI系统的交互方式： 1. 预训练模型：像 GPT-3 这样的模型已经进步，使人工智能能够在聊天机器人和虚拟助手中生成更连贯的上下文感知响应

发表于 01-18 16:39 •185次阅读

2023年科技圈热词“大语言模型”，与自然语言处理有何关系

电子发烧友网报道（文/李弯弯）大语言模型（LLM）是基于海量文本数据训练的深度学习模型。它不仅能够生成自然语言文本，还能够深入理解文本含义，处理各种自然语言任务，如文本摘要、问答、

发表于 01-02 09:28 •1366次阅读

基于机器翻译增加的跨语言机器阅读理解算法

近日，阿里云人工智能平台 PAI 与华南理工大学朱金辉教授团队、达摩院自然语言处理团队合作在自然语言处理顶级会议 EMNLP2023 上发表基于机器

发表于 12-12 10:28 •351次阅读

大语言模型简介：基于大语言模型模型全家桶Amazon Bedrock

本文基于亚马逊云科技推出的大语言模型与生成式AI的全家桶：Bedrock对大语言模型进行介绍。大语言模型指的是具有数十亿参数（B+）的预训练语言模型（例如：GPT-3, Bloom,

发表于 12-04 15:51 •401次阅读

VisionFive 2成功集成Android开源项目（AOSP）!

非常高兴地向各位宣布，赛昉VisionFive 2上已成功集成了Android开源项目（AOSP），为用户带来了更多的软件解决方案以及与Android软件生态系统的无缝集成。这一里程碑源于与开源社区

发表于 10-16 13:11

自然语言处理和人工智能的区别

　　自然语言处理(Natural Language Processing，NLP)是人工智能(AI)中的一个分支，它利用计算机技术对自然语言进行处理，使得电脑能够理解和操作人类

发表于 08-28 17:32 •907次阅读

自然语言处理和人工智能的概念及发展史 自然语言处理和人工智能的区别

自然语言处理(Natural Language Processing, NLP)的定义是通过电脑软件程序实现人们日常语言的机器自动

发表于 08-23 18:22 •521次阅读

自然语言处理的概念和应用 自然语言处理属于人工智能吗

　　自然语言处理(Natural Language Processing)是一种人工智能技术，它是研究自然语言与计算机之间的交互和通信的一门学科。自然语言

发表于 08-23 17:31 •821次阅读

自然语言处理的优缺点有哪些 自然语言处理包括哪些内容

自然语言处理（Natural Language Processing）是一种人工智能的技术及领域，它致力于让计算机理解及处理人类语言。它可以帮助计算机对人类

发表于 08-23 17:26 •2463次阅读

Transformers是什么意思？人工智能transformer怎么翻译？

转换成目标语言并实现各种自然语言处理任务，例如文本分类、文本生成、机器翻译和命名实体识别等。该技术最近在各种

发表于 08-22 15:59 •2192次阅读

人工智能简称什么

自然语言处理：自然语言处理（NLP）是指让机器学会理解和使用自然语言的技术。这种技术在聊天

发表于 08-13 11:29 •2434次阅读

自然语言处理包括哪些内容 自然语言处理技术包括哪些

自然语言处理(Natural Language Processing, NLP)一般包括以下内容：语音识别(Speech Recognition)：将人类语言转换为计算机可以理解的形式。语音合成

发表于 08-03 16:22 •3823次阅读

机器翻译研究进展

成为主流，如神经网络机器翻译。神经网络机器翻译是机器从大量数据中自动学习翻译知识，而不依靠人类专家撰写规则，可以显著提升翻译质量，但在

发表于 07-06 11:19 •409次阅读

PyTorch教程10.5之机器翻译和数据集

电子发烧友网站提供《PyTorch教程10.5之机器翻译和数据集.pdf》资料免费下载

发表于 06-05 15:14 •0次下载

大语言模型的多语言机器翻译能力分析

以ChatGPT为代表的大语言模型（Large Language Models, LLM）在机器翻译（Machine Translation, MT）任务上展现出了惊人的潜力。

发表于 05-17 09:56 •972次阅读

搜索历史

机器翻译系统实现了自然语言处理的又一里程碑突破

评论

自然语言处理的研究内容

2023年科技圈热词“大语言模型”，与自然语言处理有何关系

基于机器翻译增加的跨语言机器阅读理解算法

大语言模型简介：基于大语言模型模型全家桶Amazon Bedrock

VisionFive 2成功集成Android开源项目（AOSP）!

自然语言处理和人工智能的区别

自然语言处理和人工智能的概念及发展史自然语言处理和人工智能的区别

自然语言处理的概念和应用自然语言处理属于人工智能吗

自然语言处理的优缺点有哪些自然语言处理包括哪些内容

Transformers是什么意思？人工智能transformer怎么翻译？

人工智能简称什么

自然语言处理包括哪些内容自然语言处理技术包括哪些

机器翻译研究进展

PyTorch教程10.5之机器翻译和数据集

大语言模型的多语言机器翻译能力分析