点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:图片、文字、语音都能理解 这个AI平台是“全能”选手
首页> 科技频道> 综合新闻 > 正文

图片、文字、语音都能理解 这个AI平台是“全能”选手

来源:科技日报2021-07-12 09:20

调查问题加载中,请稍候。
若长时间无响应,请刷新本页面

  “小初,请以天宫为主题作首诗吧?”

  “天宫生殿开成,万花垂露照初。稠云不掩国志,飞天当触明霞。”

  “你能看懂这个视频吗?”

  “视频中,火箭正在发射。”

  “小初,图片中航天员正在干什么?”

  “航天员正穿着航天服站在机械臂上遨游太空。”

  ……

  7月9日,在2021世界人工智能大会(WAIC2021)上,中国科学院自动化研究所所长徐波发布了自动化所研发的跨模态通用人工智能平台——“紫东太初”。基于“紫东太初”平台打造的虚拟人“小初”在大会现场赚足了眼球。它不仅能读懂图片、看懂视频、中文续写、双语翻译,而且能吟诗作赋,生动证明了通过图片、文字、语音三种模态的关联与协同,可以有效地提升机器的理解和生成能力,让AI接近人类想象力。

  “紫东太初”平台是跨模态通用人工智能平台,以多模态大模型为核心,基于全栈国产化基础软硬件平台,可支撑全场景AI应用。“所谓跨模态是指它可以理解语音、文字和图片等多种模态信息;所谓全栈国产化是指这个平台的底层算力、模型、框架等都是自主研发的。”徐波解释道。

  多种模态预训练模型被广泛认为是从限定领域的弱人工智能迈向通用人工智能路径的探索。依托面向超大规模的高效分布式训练框架,自动化所构建了具有业界领先性能的中文预训练模型、语音预训练模型、视觉预训练模型,并开拓性地通过跨模态语义关联实现了视觉、文本、语音三种模态统一表示,构建了三模态预训练大模型,赋予跨模态通用人工智能平台多种核心能力。

  徐波介绍,“紫东太初”兼具跨模态理解和生成能力。与单模态和图片、文字两种模态相比,“紫东太初”采用一个大模型就可以灵活支撑图片、文字以及语音的全场景AI应用,具有了在无监督情况下多任务联合学习、并快速迁移到不同领域数据的强大能力。

  “引入语音模态后的多模态预训练模型,可实现共性图片、语音和文字的空间表征和利用,并突破性地直接实现三模态的统一表示。”徐波说,特别值得强调的是,该平台首次让“以图生音”和“以音生图”成为现实,对更广泛、更多样的下游任务提供模型基础支撑,让AI能够在视频配音、语音播报、标题摘要、海报创作等更多场景实现应用。

  同时,研发团队还提出了弱关联三模态数据的语义统一表达,可同时支持三种或任两种模态弱关联数据进行预训练,有效降低了多模态数据收集与清洗成本。

  “‘紫东太初’跨模态通用人工智能平台包括三大关键技术和六大核心能力。”徐波说,三大关键技术分别是多模态理解与生成多任务统一建模、面向国产化软硬件的高效训练与部署、多模态预训练模型架构设计与优化。六大核心能力则体现为多模态统一表示与语义关联、跨模态内容转化与生成、预训练模型网络架构设计、标注受限自监督模型学习、模型适配与分布式训练、模型轻量化与推理加速。

  徐波表示,“大数据+大模型+多模态”将改变当前单一模型对应单一任务的人工智能研发范式,多模态大模型将成为不同领域的共性平台技术,是迈向通用人工智能路径的探索,具有广阔的应用前景。

  同时,全栈国产化通用人工智能平台的实践将使人工智能研发的规则发生重大变革并逐渐形成壁垒,对我国实现AI领域科技创新、占领核心技术高地具有重要的战略意义。(陆成宽)

[ 责编:蔡琳 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 神舟十八号载人飞行任务航天员与记者见面

  • 神舟十八号航天员乘组确定

独家策划

推荐阅读
日前,中国纤维质量监测中心发布2023年度新疆棉花生产加工过程质量状况监测结果。
2024-04-24 10:33
1998年,聂海胜成为我国首批航天员,先后执行过神舟六号、神舟十号、神舟十二号3次载人飞行任务。
2024-04-24 10:17
在北京航天飞行控制中心的统一调度下,酒泉卫星发射中心、西安卫星测控中心以及任务各测控站点实施联调联控,全面模拟发射准备、发射以及飞行过程中的各种技术状态和工作过程。
2024-04-24 10:16
1996年,我从技校毕业后,来到金川公司工作。当时总听师傅们讲,贵金属冶炼技术难以突破。提高我国铂族贵金属提炼的技术水平,对于守护国家安全极为必要。
2024-04-24 10:14
截至2023年底,我国大陆在运核电机组55台,总装机容量为57吉瓦,核准及在建核电机组36台,总装机容量为44吉瓦;全年核电发电量44万吉瓦时,占全国累计发电量近5%,相当于节约标煤1.3亿吨,减排二氧化碳3.5亿吨。
2024-04-24 10:05
截至2022年末,我国电动自行车社会保有量已达3.5亿辆。2023年,全国规模以上企业累计生产电动自行车4228万辆。
2024-04-23 04:00
22日是第55个世界地球日,今年的主题为“全球战塑”。国家发展和改革委员会宏观经济研究院经济体制与管理研究所当日发布的《废塑料化学循环综合性研究报告》显示,
2024-04-23 04:25
美国加州理工学院天文学家正在给黑洞做“计算机断层扫描”(CT)。超级计算机模拟显示,以吸积盘结构绕黑洞旋转的物质会在名为耀斑的高能事件中周期性喷发。
2024-04-23 10:03
4月25日至29日,以“创新:建设更加美好的世界”为主题的2024中关村论坛年会将在北京举办。
2024-04-23 10:02
最新数据显示,我国石油剩余技术可采储量38.5亿吨,天然气剩余技术可采储量66834.7亿立方米。
2024-04-23 10:01
在中国人民解放军海军成立75周年之际,全体海军将士初心如磐,正以崭新姿态阔步向前、逐梦海天,努力把人民海军全面建成世界一流海军。
2024-04-22 13:57
中央气象台预计,4月21日至22日,江南南部和东部、华南中东部和南部等地仍有强降水,局部地区有大暴雨并伴有雷暴大风或冰雹等强对流天气。
2024-04-22 10:03
苏州市吴江区文物保护管理所所长周春华介绍,在修缮古建筑时,文保团队也积极采用新技术。“通过保护促进利用,通过利用加强保护,让文物建筑活起来。
2024-04-22 10:02
21日,在2024年中国医学发展大会上,中国医学科学院发布了《中国21世纪重要医学成就》,“创建蛋白质组学体系”“基于髓系白血病发病机制发现新的白血病生物分子标志和药物靶标”“揭示非经典细胞焦亡的分子机制及鉴定有关蛋白家族成员”等三项成就入选。
2024-04-22 09:59
近日生态环境部会同农业农村部制定并发布国家生态环境标准《生态环境损害鉴定评估技术指南 生态系统 第1部分:农田生态系统》。
2024-04-22 09:58
我国首艘深远海多功能科学考察及文物考古船4月20日在广东广州出坞。该船由我国自主设计和建造,它的建造出坞,标志着我国在冰区深海科考装备和船舶设计自主可控方面取得重要进展。
2024-04-22 09:55
党的二十大报告提出,“坚持面向世界科技前沿、面向经济主战场、面向国家重大需求、面向人民生命健康,加快实现高水平科技自立自强”。
2024-04-19 11:08
科技成果只有转化为实用性技术,才能推动发展新质生产力,才能释放出驱动创新的力量,也才能推动构建现代化产业体系,为实现高水平科技自立自强和高质量发展提供有力支撑。
2024-04-19 02:45
自生成式人工智能(AI)程序,如ChatGPT发布以来,何时及如何利用它撰写研究论文成为人们争论的焦点。
2024-04-19 10:08
4月19日,清华大学基础医学院教授程功团队与合作者在《科学》发表论文,提出了一项阻断蚊虫传播传染病的新策略。
2024-04-19 10:07
加载更多