微信翻译闹笑话吴亦凡躺枪,AI翻译为何总“翻车”?

阅读: 评论:0

微信翻译闹笑话吴亦凡躺枪,AI翻译为何总“翻车”?

微信翻译闹笑话吴亦凡躺枪,AI翻译为何总“翻车”?

u003cpu003e昨天,有细心的网友发现,微信翻译出现故障,得出了很多让人啼笑皆非的翻译结果。比如流量明星们的名字被翻译成各种风马牛不相及的字眼,Cai Xukun被翻译成“傻蛋”也真是非常尴尬了。u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003e相比之下,谷歌翻译的同四个句子虽然效果也一言难尽,但是基本句式还是有据可循的:u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003e但粉丝可就不干了,直接把这个话题顶上了微博热搜。截至今日,“微信翻译是认真的吗”这个话题仍然挂在微博热搜榜上,热度不减。u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003e网友的评论区重点也是有点偏,俨然变成大型“反黑”现场,大量粉丝蜂拥而来表示“搬走”自家爱豆,众网友则是看热闹不嫌事大。当然,也有少数人没有偏离主题,把重点放在了翻译本身,有人对机器翻译水平表示担忧,有人给程序员小哥哥打气~u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003ch2u003e微信回应:翻译引擎误翻u003c/h2u003enu003cpu003e事件发生后,微信团队迅速做出回应,称这是微信翻译引擎在翻译一些没有进行过训练的非正式英文词汇时出现误翻,导致部分语句翻译出现问题,目前正在紧急修复中。 ​​​​u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003e经 AI 前线测试,目前正常的句式以及单词是可以正常翻译的,但是遇到不认识的词语,微信翻译干脆就“罢工”了,不知道仍然是故障状态还是说这是一个临时的解决方案?u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003ch2u003e全新神经网络翻译引擎u003c/h2u003enu003cpu003e我们来看一下这里提到的微信翻译引擎。在早些时候,有消息称微信的英译汉功能由有道实现,其他语种则由微软负责。而据微信相关方面说法,目前微信聊天对话及朋友圈的英中、中英翻译已经替换成其自行开发的全新神经网络翻译引擎,但该神经网络的具体信息无从得知,AI前线只找到关于它的零星信息。u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003e据知乎一位自称是微信翻译引擎开发团队一员的用户透露,微信翻译功能是由一个不到10人的小团队开发,但是上线之时非常低调,甚至很多人不知道这个隐藏小彩蛋的存在。u003c/pu003enu003cpu003e当初上线之时,这位工程师就承认产品是有一定局限性的,很多翻译还不完善。u003c/pu003enu003cpu003e而在“如何评价微信翻译功能”这一话题之下,大部分评论对微信翻译功能的评价都不太友好,尤其是在姓名的翻译上,微信甚至会给你起一个英文名…u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003e当然,也有人表示对微信翻译功能的支持,并真诚提出希望微信团队可以改善,甚至有人认为比百度、有道的翻译水平高。u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003e虽然我们无从得知微信所使用的机器翻译引擎具体信息,但是可以通过机器学习翻译引擎的基本工作原理,了解一下为什么微信会在翻译一些没有进行过训练的非正式英文词汇时出现误翻,导致部分语句翻译出现问题。u003c/pu003enu003cpu003e机器翻译的原理可以看作是如下这张图:u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003e翻译机器就是其中带有问号的黑箱,它的作用就是能够将一个语言的序列(如Economic growth has slowed down in recent years)转化成目标语言序列(如La croissance economique sest ralentie ces dernieres annees)。其中翻译机器在正式工作之前可以利用已有的语料库(Corpora)来进行学习和训练。u003c/pu003enu003cpu003e所谓的神经网络机器翻译就是利用神经网络来实现上述的黑箱翻译机器。它的架构如下图所示:u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003e其中,我们用一个神经网络替换了上图中的黑箱。在神经网络中存在着大量的链接权重,这些权重就是我们要通过数据训练、学习的参数。训练好的神经网络可以将输入的源语言转换为输出的目标语言。我们要让神经网络学习的目标就是要能准确的翻译。(来源:知乎ID:人工智能学习笔记)u003c/pu003enu003cpu003e我们是如何编写代码,让计算机翻译人类的语言呢?最简单的方法,就是把句子中的每个单词,都替换成翻译后的目标语言单词。下面是西班牙语-英语互译的例子,只需要逐字替代,就能够得到一个完整的翻译句子。但是由于上下文语境的关系,翻译结果并不完美。u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003eu003cstrongu003e为了解决这个问题,机器翻译系统需要使用了不同的方法,通过分析大量文本来分配文本中的规则,以改进结果。u003c/strongu003e也就是教会计算机语法规则,然后让它根据规则翻译句子。u003c/pu003enu003cpu003e可惜事情并不是这么简单,饱受学习外语之苦的你肯定知道,规则总是有很多例外。当我们尝试为程序描写所有这些规则及其特例以及特例的特例时,翻译的质量就无从保证。u003c/pu003enu003cpu003e深度神经网络可以在非常复杂的任务(语音/视觉对象识别)中取得优异结果,但尽管它们具有灵活性,却只能用于输入和目标具有固定维数的任务。u003c/pu003enu003cpu003e在这个过程中,训练的重要性不言而喻,训练数据的多样性、完整性,以及数量、质量、时间等各种维度都会对系统最后产生的结果产生重要影响。u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003e微信的翻译引擎出现误翻,按照官方的回应,是因为原文中出现没有进行过训练的非正式英文词汇,也就是说引擎系统“看到”了以前从未看到过的训练数据,因此影响了翻译的准确性也就不难理解了。u003c/pu003enu003ch2u003e翻车不止一次u003c/h2u003enu003cpu003e实际上,腾讯在翻译上不止翻过一次车。去年博鳌论坛期间,腾讯的翻译君就曾在会上闹过乌龙,AI前线对此做过报道:u003ca href="=MzU1NDA4NjU2MA==u0026amp;mid=2247489689u0026amp;idx=1u0026amp;sn=ef66e6f6686c50c571aaebf68fea5812u0026amp;chksm=fbe9a156cc9e28409b734ae2c98013391005a8c1d93cc9f62dc797de4e741bdf8df29161f252u0026amp;scene=27#wechat_redirect"u003e《腾讯AI同传博鳌会上闹乌龙,技术界和翻译界怎么看?》u003c/au003e。当时,翻译错误的地方多为常见的专用术语,如“一带一路”、“道路”等词汇,翻译还出现乱码结果,现场不得不再次聘请人工翻译“接盘”。u003c/pu003enu003cpu003eu003cimg src=".png?imageView2/0/w/800" alt="image" /u003eu003c/pu003enu003cpu003e事件后腾讯承认,面对博鳌亚洲论坛复杂的语言环境和高大上的专业内容,“腾讯同传”确实出现了错误,答错了几道题。腾讯表示,作为创新孵化和落地的 AI 产品,“腾讯同传”还在不断学习和成长当中,但是不足就是不足,不足的地方就要继续加强学习。u003c/pu003enu003cpu003e不止腾讯,科大讯飞也曾深陷“AI同传造假”事件,但事后以双方都确认误会的原因是同声传译人员在工作中把“讯飞听见”的转写功能错当成“机器同传”而告终。u003c/pu003enu003cpu003e不得不承认,虽然AI技术在不断进步,相关的自然语言处理技术也在不断取得突破,但仍然改变不了AI的智商不及四岁小孩的现实,尤其是在应用场景要求比较高的翻译领域,目前的技术水平还十分有限,不过,我们不应否认AI技术在翻译领域的成果,不积跬步,无以至千里,没有不断试错,就不会有成功。u003c/pu003enu003cpu003eu003cimg src=".png" alt="image" /u003eu003c/pu003en

本文发布于:2024-01-30 22:26:10,感谢您对本站的认可!

本文链接:https://www.4u4v.net/it/170662477323267.html

版权声明:本站内容均来自互联网,仅供演示用,请勿用于商业和其他非法用途。如果侵犯了您的权益请与我们联系,我们将在24小时内删除。

标签:闹笑话   翻车   亦凡   AI
留言与评论(共有 0 条评论)
   
验证码:

Copyright ©2019-2022 Comsenz Inc.Powered by ©

网站地图1 网站地图2 网站地图3 网站地图4 网站地图5 网站地图6 网站地图7 网站地图8 网站地图9 网站地图10 网站地图11 网站地图12 网站地图13 网站地图14 网站地图15 网站地图16 网站地图17 网站地图18 网站地图19 网站地图20 网站地图21 网站地图22/a> 网站地图23