点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:图片、文字、语音都能理解 这个AI平台是“全能”选手
首页> 科技频道> 综合新闻 > 正文

图片、文字、语音都能理解 这个AI平台是“全能”选手

来源:科技日报2021-07-12 09:20

调查问题加载中,请稍候。
若长时间无响应,请刷新本页面

  “小初,请以天宫为主题作首诗吧?”

  “天宫生殿开成,万花垂露照初。稠云不掩国志,飞天当触明霞。”

  “你能看懂这个视频吗?”

  “视频中,火箭正在发射。”

  “小初,图片中航天员正在干什么?”

  “航天员正穿着航天服站在机械臂上遨游太空。”

  ……

  7月9日,在2021世界人工智能大会(WAIC2021)上,中国科学院自动化研究所所长徐波发布了自动化所研发的跨模态通用人工智能平台——“紫东太初”。基于“紫东太初”平台打造的虚拟人“小初”在大会现场赚足了眼球。它不仅能读懂图片、看懂视频、中文续写、双语翻译,而且能吟诗作赋,生动证明了通过图片、文字、语音三种模态的关联与协同,可以有效地提升机器的理解和生成能力,让AI接近人类想象力。

  “紫东太初”平台是跨模态通用人工智能平台,以多模态大模型为核心,基于全栈国产化基础软硬件平台,可支撑全场景AI应用。“所谓跨模态是指它可以理解语音、文字和图片等多种模态信息;所谓全栈国产化是指这个平台的底层算力、模型、框架等都是自主研发的。”徐波解释道。

  多种模态预训练模型被广泛认为是从限定领域的弱人工智能迈向通用人工智能路径的探索。依托面向超大规模的高效分布式训练框架,自动化所构建了具有业界领先性能的中文预训练模型、语音预训练模型、视觉预训练模型,并开拓性地通过跨模态语义关联实现了视觉、文本、语音三种模态统一表示,构建了三模态预训练大模型,赋予跨模态通用人工智能平台多种核心能力。

  徐波介绍,“紫东太初”兼具跨模态理解和生成能力。与单模态和图片、文字两种模态相比,“紫东太初”采用一个大模型就可以灵活支撑图片、文字以及语音的全场景AI应用,具有了在无监督情况下多任务联合学习、并快速迁移到不同领域数据的强大能力。

  “引入语音模态后的多模态预训练模型,可实现共性图片、语音和文字的空间表征和利用,并突破性地直接实现三模态的统一表示。”徐波说,特别值得强调的是,该平台首次让“以图生音”和“以音生图”成为现实,对更广泛、更多样的下游任务提供模型基础支撑,让AI能够在视频配音、语音播报、标题摘要、海报创作等更多场景实现应用。

  同时,研发团队还提出了弱关联三模态数据的语义统一表达,可同时支持三种或任两种模态弱关联数据进行预训练,有效降低了多模态数据收集与清洗成本。

  “‘紫东太初’跨模态通用人工智能平台包括三大关键技术和六大核心能力。”徐波说,三大关键技术分别是多模态理解与生成多任务统一建模、面向国产化软硬件的高效训练与部署、多模态预训练模型架构设计与优化。六大核心能力则体现为多模态统一表示与语义关联、跨模态内容转化与生成、预训练模型网络架构设计、标注受限自监督模型学习、模型适配与分布式训练、模型轻量化与推理加速。

  徐波表示,“大数据+大模型+多模态”将改变当前单一模型对应单一任务的人工智能研发范式,多模态大模型将成为不同领域的共性平台技术,是迈向通用人工智能路径的探索,具有广阔的应用前景。

  同时,全栈国产化通用人工智能平台的实践将使人工智能研发的规则发生重大变革并逐渐形成壁垒,对我国实现AI领域科技创新、占领核心技术高地具有重要的战略意义。(陆成宽)

[ 责编:蔡琳 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 西藏和平解放75周年丨“天路”纵横 畅行高原

  • 浙江湖州开展国际生物多样性日主题活动

独家策划

推荐阅读
5月22日上午,在2026年文化强国建设高峰论坛“人工智能与媒体变革”分论坛上,中宣部副部长、国务院新闻办公室主任莫高义发表主旨演讲。
2026-05-22 13:22
中国科学技术大学何俊峰教授研究组与南方科技大学薛其坤院士、陈卓昱副教授研究组合作,在新型镍基高温超导的机理研究中取得重大突破。
2026-05-22 10:19
近年来,生产环节的技术革新,推动缝纫线产业转型向着上游拓展。
2026-05-22 10:19
在系列政策牵引下,学科专业动态调整正日趋常态化、精细化与特色化。
2026-05-22 10:14
“十五五”时期,如何推动我国生物多样性保护迈上新台阶?应着力在以下方面下功夫。
2026-05-22 10:13
当AI把数小时的工作压缩到转瞬之间,一个核心问题不得不让人思考:AI时代,未来教育最该培养学生什么能力?
2026-05-22 10:11
2026年亚太经合组织(APEC)贸易部长会议将于5月22日至23日在江苏省苏州市举办。苏州高新区镇湖绣娘姚琴华、岳琰创作的苏绣作品《朱荷图》《太湖一梦入姑苏》也一同展出。一根丝,在绣娘手中可以绣出江南山水;在现代工厂里,也可以进入高端面料、工业材料、绿色纤维和全球供应链。
2026-05-21 09:35
残障群体对无障碍环境建设最为敏感、利益最为攸关,但其话语权也相对较弱。不断完善相关法律体系,以充分保障残障群体在无障碍环境建设中各项权利。
2026-05-21 09:33
光,是宇宙中最神秘而又最常见的存在。从彩虹与翅膀的启示,到光子晶体与超材料的设计,人类在光学材料上的探索不断深化,实现了从“理解自然之光”向“设计与驾驭光”的飞跃。
2026-05-21 09:31
全球气候变化加剧,干旱灾害频发,正威胁世界粮食安全。
2026-05-21 09:30
2026年5月21日至23日,中国科学技术馆在河南省科学技术馆举办“全国科学家故事馆校众创展演活动”。
2026-05-21 09:27
近日,中国工程院院士、西安电子科技大学教授段宝岩率领团队自主研制的一对多动目标微波无线传能地面验证系统取得重大突破,在百米级距离实现了千瓦级的直流输出功率,直流—直流传输效率达到20.8%,波束收集效率高达88.0%。
2026-05-20 09:42
5月18日,随着“雪龙2”号凯旋,中国第42次南极考察圆满落下帷幕。
2026-05-20 09:37
逛一座馆,见证玻璃工业百年变迁。参观工业博物馆,一件件展品记录的是中国制造的发展史,是从落后到并跑、领跑的奋斗史。让我们以工业博物馆为支点,撬动工业旅游这个大市场,以工业文化涵养制造强国建设。
2026-05-20 09:34
近日,中国科学院天津工业生物技术研究所(以下简称天津工生所)糖生物合成与绿色制造攻关团队的研究成果被期刊接收。
2026-05-20 09:27
天津市河西区陈塘庄街道社区的医生向我们反馈,预警模式实现了高危人群的精准干预,社区脑卒中发病率与复发率明显下降。
2026-05-20 09:16
“雪龙2”号极地科考破冰船18日抵达上海,这标志着中国第42次南极考察圆满结束。
2026-05-19 09:54
5月18日,中国第42次南极考察圆满结束。中山大学共有4名老师参与本次任务——大气科学学院教授韩博,遥感科学与技术学院副教授梁琦、叶玉芳、王绍银。
2026-05-19 09:53
“琅琊”海洋大模型现已在国家海洋环境预报中心部署测试运行,实现实景应用。这意味着,这个从青岛走出的AI模型,开始真正为国家海洋预报工作贡献力量。
2026-05-19 09:52
打破传统学科分立格局,发挥工科见长优势,以工程需求催生基础研究、以基础研究赋能工科升级。
2026-05-19 09:50
加载更多