点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:超级同传!AI实现101种语言即时翻译
首页> 科技频道> 综合新闻 > 正文

超级同传!AI实现101种语言即时翻译

来源:中国科学报2025-01-20 10:02

  中国科学报讯 科幻小说《银河系漫游指南》中的翻译动物“巴别鱼”,可能离现实更近了。美国互联网科技公司Meta的研究人员开发了一种机器学习系统,几乎可以立即将101种语言的语音翻译成36种目标语言中的任意一种。

  这种大规模多语言和多模态机器翻译(SEAMLESSM4T)系统还可以将语音转换成文本、文本转换成语音、文本转换成文本。相关研究成果1月15日发表于《自然》。

  Meta运营着脸书、WhatsApp和Instagram等社交媒体网站。该公司表示,在向全球学术研究人员成功发布LLaMA大语言模型后,将把SEAMLESSM4T开源用于非商业用途。

  过去几十年里,机器翻译取得了巨大进步,这在很大程度上归功于在大数据集上训练的神经网络。英语等主要语言的训练数据比比皆是,但其他语言的训练数据却少得可怜。这种不平等限制了机器可以翻译的语言范围。美国康奈尔大学的计算机科学家Allison Koenecke表示:“这影响了不经常出现在互联网上的那些语言。”

  Meta团队在之前语音对语音翻译工作的基础上,开启了一个名为“不让任何语言掉队”的项目,旨在为大约200种语言提供文本到文本的翻译。根据经验,Meta和其他机构的研究人员发现,即使在翻译那些训练数据有限的语言时,使翻译系统多语言化也能提高其性能,但原因尚不清楚。

  该团队从互联网和联合国档案等来源收集了数百万小时的音频文件,以及这些语音的人工翻译。他们还收集了其中一些演讲的文字记录。

  研究人员使用可靠的数据训练模型识别两份匹配的内容。这使研究人员能够将大约50万小时的语音与文本配对,并自动将一种语言的每个片段与其他语言的对应片段匹配。

  SEAMLESSM4T可以将语音转换成语音,而无须先将其转换为文本。语音合成器用于产生音频,它可以翻译101种语言中的任何一种语音,不过到目前为止,只有36种语言可输出。该系统还可以执行其他翻译任务,比如完成不同语言的文本到语音的翻译。

  论文作者之一、Meta的计算机科学家Marta Costa-juss表示,除了增加语言数量外,他们还通过整合文本和语音的不同组合提高系统性能。“这些是改善的关键。”她补充说,该系统的时间延迟通常为几秒钟,与专业人工翻译的表现相当。

  作者表示,他们对SEAMLESSM4T进行了微调,例如当翻译中出现与原文不符的攻击性语言时,可以限制这种情况发生。他们还对系统进行了控制,以防止它将一种语言中无性别的专有词汇(如英语中的“护士”)翻译成其他语言中有性别的对应词。

  Koenecke在评论中写道,为进一步限制自动翻译的潜在风险,“开发人员应该考虑如何在明确模型局限性的前提下输出翻译”,并考虑“在准确性有争议时完全放弃输出”。

  英国吉尔福德萨里大学的翻译研究员Sabine Braun说,在机器翻译被广泛采用前,应该进行更多审查,并就如何使用机器翻译进行教育培训,尤其是身处医疗或法律等关键工作岗位的人。 (李木子)

  相关论文信息:

  https://doi.org/10.1038/s41586-024-08359-z

  《中国科学报》 (2025-01-20 第2版 国际)

[ 责编:李欣哲 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 多彩开学第一课

  • 海南自贸港航空保税维修货值超450亿元

独家策划

推荐阅读
我国新型储能制造业全链条国际竞争优势凸显,优势企业梯队进一步壮大,产业创新力和综合竞争力显著提升,实现高端化、智能化、绿色化发展。
2025-02-18 09:33
新修订的科学技术普及法自2024年12月25日起施行。宣传贯彻科学技术普及法座谈会17日在京召开,全国人大常委会副委员长蔡达峰出席会议并讲话。
2025-02-18 09:32
迈着深深浅浅的步子走进葡萄园,脚下,枯叶作被覆盖着泥土;头顶,休眠的葡萄枝上零星挂着卷曲的叶子。果农们在葡萄架下来回穿梭,剪刀在手中翻飞,老练地修剪着葡萄枝条,随后,有条不紊地完成着开沟、窝肥、清园等“冬管清单”。
2025-02-18 09:32
2月13日,北京儿童医院,13位知名专家对1位8岁男孩的疑难病例展开缜密讨论。主持人是北京儿童医院院长、耳鼻咽喉头颈外科专家倪鑫,专家们则来自神经外科、肿瘤外科、口腔科等科室。
2025-02-18 09:28
2024年度河南省科学技术奖励名单上,河南农业大学“‘醛’球无敌”博士后科研团队的《木制细胞低碳增强结合关键技术》项目赫然在列。团队负责人彭万喜难掩笑意:“自2021年在全国博士后创新创业大赛拿金奖后,我们团队就荣誉不断。这背后,是国家对甲醛防控治理的日益重视。”
2025-02-18 09:27
重塑金身,树皮、籽壳和叶脉中的杜仲胶可作为首选材料。
2025-02-18 08:56
农业农村部近日制定印发《全国农业科技创新重点领域(2024—2028年)》,要求聚焦十大重点领域,加快推进高水平农业科技自立自强。
2025-02-17 10:16
2024年,中国智能算力规模达725.3百亿亿次/秒(EFLOPS),同比增长74.1%,增幅是同期通用算力增幅(20.6%)的3倍以上;市场规模为190亿美元,同比增长86.9%。
2025-02-17 10:14
我国第三代自主超导量子计算机“本源悟空”全球访问量突破2000万次,刷新了我国自主量子算力服务规模纪录。
2025-02-17 10:14
一部优秀的动画片,需要艺术和技术的高度合一。而《哪吒2》在本土先进动漫制作技术的托举之下,实现了这种合一。它的成功,是我国文化软实力和电影科技硬实力的并肩胜出和双重出圈,昭示着文化与科技碰撞产生的巨大张力。
2025-02-17 10:12
科普法第五十一条规定,利用财政性资金设立科学技术计划项目,除涉密项目外,应当结合任务需求,合理设置科普工作任务,充分发挥社会效益。
2025-02-17 10:11
成都大熊猫繁育研究基地科普团队成立于2000年,旨在面向公众传播以大熊猫为代表的生物多样性保护理念。
2025-02-14 10:26
食品添加剂是指为改善食品品质和色、香、味,以及为防腐和加工工艺的需要而加入食品中的化学合成或者天然物质。
2025-02-14 10:24
《自然》杂志13日报道我国发现迄今唯一确切的侏罗纪鸟类——政和八闽鸟。
2025-02-14 10:23
在当前的极寒天气下,机器狗更灵活、可携带更多仪器,巡检质效显著提高,让赛事电力保供更安心。
2025-02-14 10:22
国家税务总局发布的最新数据显示,2024年,现行支持科技创新和制造业发展的主要政策减税降费及退税达26293亿元,助力我国新质生产力加速培育、制造业高质量发展。
2025-02-14 10:11
独脚金是寄生在高粱上的一种植物,能导致高粱减产甚至死亡。近日,我国科学家首次从高粱中发现两个关键基因,敲除后,高粱对独脚金的抗性显著提高。
2025-02-14 10:04
基于AI大模型及领域数据资源,构建基于PC端和手机端应用的科特派数字人“小科”,为用户提供随时在线、多终端访问、7×24小时全天候资源对接,全方位服务于北京城市科技创新与管理。
2025-02-13 09:36
新时代以来,我国以更高站位、更宽视野、更大力度来谋划和推进新征程生态环境保护工作,全力推动生态环境根本好转。
2025-02-13 03:40
新年伊始,DeepSeek成为“热词”,其在各领域的应用也引发思考和讨论。在科研领域,人工智能驱动科学研究的新科研范式随之到来,对构建开放创新生态提出了更急迫的要求。
2025-02-13 03:50
加载更多