点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:超级同传!AI实现101种语言即时翻译
首页> 科技频道> 综合新闻 > 正文

超级同传!AI实现101种语言即时翻译

来源:中国科学报2025-01-20 10:02

  中国科学报讯 科幻小说《银河系漫游指南》中的翻译动物“巴别鱼”,可能离现实更近了。美国互联网科技公司Meta的研究人员开发了一种机器学习系统,几乎可以立即将101种语言的语音翻译成36种目标语言中的任意一种。

  这种大规模多语言和多模态机器翻译(SEAMLESSM4T)系统还可以将语音转换成文本、文本转换成语音、文本转换成文本。相关研究成果1月15日发表于《自然》。

  Meta运营着脸书、WhatsApp和Instagram等社交媒体网站。该公司表示,在向全球学术研究人员成功发布LLaMA大语言模型后,将把SEAMLESSM4T开源用于非商业用途。

  过去几十年里,机器翻译取得了巨大进步,这在很大程度上归功于在大数据集上训练的神经网络。英语等主要语言的训练数据比比皆是,但其他语言的训练数据却少得可怜。这种不平等限制了机器可以翻译的语言范围。美国康奈尔大学的计算机科学家Allison Koenecke表示:“这影响了不经常出现在互联网上的那些语言。”

  Meta团队在之前语音对语音翻译工作的基础上,开启了一个名为“不让任何语言掉队”的项目,旨在为大约200种语言提供文本到文本的翻译。根据经验,Meta和其他机构的研究人员发现,即使在翻译那些训练数据有限的语言时,使翻译系统多语言化也能提高其性能,但原因尚不清楚。

  该团队从互联网和联合国档案等来源收集了数百万小时的音频文件,以及这些语音的人工翻译。他们还收集了其中一些演讲的文字记录。

  研究人员使用可靠的数据训练模型识别两份匹配的内容。这使研究人员能够将大约50万小时的语音与文本配对,并自动将一种语言的每个片段与其他语言的对应片段匹配。

  SEAMLESSM4T可以将语音转换成语音,而无须先将其转换为文本。语音合成器用于产生音频,它可以翻译101种语言中的任何一种语音,不过到目前为止,只有36种语言可输出。该系统还可以执行其他翻译任务,比如完成不同语言的文本到语音的翻译。

  论文作者之一、Meta的计算机科学家Marta Costa-juss表示,除了增加语言数量外,他们还通过整合文本和语音的不同组合提高系统性能。“这些是改善的关键。”她补充说,该系统的时间延迟通常为几秒钟,与专业人工翻译的表现相当。

  作者表示,他们对SEAMLESSM4T进行了微调,例如当翻译中出现与原文不符的攻击性语言时,可以限制这种情况发生。他们还对系统进行了控制,以防止它将一种语言中无性别的专有词汇(如英语中的“护士”)翻译成其他语言中有性别的对应词。

  Koenecke在评论中写道,为进一步限制自动翻译的潜在风险,“开发人员应该考虑如何在明确模型局限性的前提下输出翻译”,并考虑“在准确性有争议时完全放弃输出”。

  英国吉尔福德萨里大学的翻译研究员Sabine Braun说,在机器翻译被广泛采用前,应该进行更多审查,并就如何使用机器翻译进行教育培训,尤其是身处医疗或法律等关键工作岗位的人。 (李木子)

  相关论文信息:

  https://doi.org/10.1038/s41586-024-08359-z

  《中国科学报》 (2025-01-20 第2版 国际)

[ 责编:李欣哲 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 习近平主持中俄蒙元首第七次会晤

  • 习近平会见蒙古国总统呼日勒苏赫

独家策划

推荐阅读
点击羽绒服胸前的按钮,2秒即可速热,实现四档温度调节……1日,在哈尔滨举行的第七届中国国际新材料产业博览会现场,一款造型时尚的智能温控羽绒服吸引不少观展者驻足围观。
2025-09-02 10:23
当地时间9月1日,世界知识产权组织发布最新报告显示,今年的全球创新指数(GII)集群研究将风险资本交易活动作为一项新指标。全球创新指数集群排行榜于2017年创设,通过三项核心指标,识别世界级创新活动在当地的集中程度。
2025-09-02 10:21
强制性国家标准《电动自行车安全技术规范》昨起实施。为保障新国标在本市顺利推行,近日,市市场监管局组织召开在京销售电动自行车生产经营企业约谈指导会。为保障新国标平稳落地实施,本市市场监管部门将强化监督抽检,保障本市电动自行车产品质量安全。
2025-09-02 10:18
会空翻、格斗,能叠衣、调饮,善聊天、“思考”……前不久举行的2025世界机器人大会上,各类机器人本领“进化”、各显神通,展现了人工智能的巨大潜力。如今,从旅游出行的智能助手,到工厂培训的“最强大脑”,再到装备升级的有力支撑,人工智能扮演着越来越重要的角色。
2025-09-02 10:15
零碳园区的建设,对于推动我国经济社会发展全面绿色转型具有重要意义。节能降碳,光靠“外套保温”不够,在园区地上、地下,还有“血液循环”系统来“保持恒温”。
2025-09-02 10:15
在这条新的赛道上,中国青年正在奋力奔跑。
2025-09-02 09:59
记者近日从国家发展改革委获悉,围绕《关于深入实施“人工智能+”行动的意见》(以下简称《意见》),相关部门将制定出台一系列配套文件。具体来看,一方面将围绕《意见》提出的6大行动若干重点行业领域,分别制定“人工智能+”具体实施方案,进一步细化各行业目标任务、重点方向和工作举措。
2025-09-01 09:56
8月26日,国务院印发《关于深入实施“人工智能+”行动的意见》。大力发展智能农机、农业无人机、农业机器人等智能装备,提高农业生产和加工工具的智能感知、决策、控制、作业等能力,强化农机农具平台化、智能化管理。
2025-09-01 09:55
生产车间里,抽气泵凹槽上蒸汽弥漫,极细的金属导体经过氯化液处理,三次涂漆后,再附上绝缘漆膜,最终制成直径仅0.012毫米的成品电磁线。 银西产业园甘肃康视达隐形眼镜有限公司的厂房内,智能化生产线高效运转,无人搬运车有序穿梭,整个流程高度自动化。
2025-09-01 09:53
江南大学是一所以轻工特色见长的“双一流”建设高校,发酵工程学科凭借深厚的学科积淀和前瞻性布局,成功跻身国家“A+”学科行列。学校与发酵行业龙头企业共建16个联合研究中心,聘请16名教授级高工和国家级科创人才担任工程技术导师,推动研究生深入产业一线。
2025-09-01 09:52
在山东省大学生创新大赛(2025)暨中国国际大学生创新大赛(2025)山东赛区比赛中,哈尔滨工业大学(威海)材料科学与工程学院参赛队共荣获10项金奖、1项银奖。 山东省特种焊接技术重点实验室是山东省焊接领域唯一的重点实验室,突出在特种环境、特种材料以及特种结构方面的焊接技术及装备制造研究。
2025-09-01 09:51
当前,全球科技革命与产业变革加速演进,人工智能(AI)正从“辅助工具”跃升为驱动社会变革的核心引擎。
2025-08-29 09:40
中国科幻完成了从文学、影视到互动娱乐的全产业链突破,步入业态融合与创新驱动的关键阶段。科幻阅读作为科幻产业链上游的基础产业,需率先探索高质量发展路径。
2025-08-29 09:38
作为太阳系中目前已知唯一拥有生命的天体,地球宜居性的形成与演化是地球系统科学研究的核心议题。
2025-08-29 09:35
国家气候中心统计数据显示,截至8月28日,华北雨季已持续55天,较常年雨季长度(30天)明显偏长。截至8月25日,华北雨季监测区累计雨量较雨季常年值偏多131%。
2025-08-29 09:18
8月29日是七夕节,在古代神话中,牛郎和织女因为被天上的银河隔开,只有在每年农历的七月初七才能通过鹊桥相会。那么,银河到底有多宽?
2025-08-29 09:17
浙江大学物理学院王浩华团队、杭州国际科创中心郭秋江超导量子计算团队联合清华大学邓东灵团队,在百比特超导量子芯片上观测到,“预热化”机制能有效抵御热激发扰动,使有限温度下的拓扑边缘态展现出了足够的稳定性,为保护脆弱的量子信息提供了新可能。
2025-08-28 09:47
6G时代,无论在城市楼群还是偏远山区,都需要数据的高速传输和快速接入,但基于纯电子技术的传统无线设备带宽受限、频段单一,难以动态调度频谱资源。
2025-08-28 09:47
8月26日,《关于深入实施“人工智能+”行动的意见》发布。为何要出台这份文件?这份文件重点说了些什么?记者采访了国家发展改革委参与文件起草的专家。
2025-08-28 09:45
从“人工智能+”发展进展来看,朱克力认为,在政策层面,形成了举国体制,算力基础设施、数据供给、人才体系等基础支撑全面强化。
2025-08-28 09:37
加载更多