点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:图片、文字、语音都能理解 这个AI平台是“全能”选手
首页> 科技频道> 综合新闻 > 正文

图片、文字、语音都能理解 这个AI平台是“全能”选手

来源:科技日报2021-07-12 09:20

调查问题加载中,请稍候。
若长时间无响应,请刷新本页面

  “小初,请以天宫为主题作首诗吧?”

  “天宫生殿开成,万花垂露照初。稠云不掩国志,飞天当触明霞。”

  “你能看懂这个视频吗?”

  “视频中,火箭正在发射。”

  “小初,图片中航天员正在干什么?”

  “航天员正穿着航天服站在机械臂上遨游太空。”

  ……

  7月9日,在2021世界人工智能大会(WAIC2021)上,中国科学院自动化研究所所长徐波发布了自动化所研发的跨模态通用人工智能平台——“紫东太初”。基于“紫东太初”平台打造的虚拟人“小初”在大会现场赚足了眼球。它不仅能读懂图片、看懂视频、中文续写、双语翻译,而且能吟诗作赋,生动证明了通过图片、文字、语音三种模态的关联与协同,可以有效地提升机器的理解和生成能力,让AI接近人类想象力。

  “紫东太初”平台是跨模态通用人工智能平台,以多模态大模型为核心,基于全栈国产化基础软硬件平台,可支撑全场景AI应用。“所谓跨模态是指它可以理解语音、文字和图片等多种模态信息;所谓全栈国产化是指这个平台的底层算力、模型、框架等都是自主研发的。”徐波解释道。

  多种模态预训练模型被广泛认为是从限定领域的弱人工智能迈向通用人工智能路径的探索。依托面向超大规模的高效分布式训练框架,自动化所构建了具有业界领先性能的中文预训练模型、语音预训练模型、视觉预训练模型,并开拓性地通过跨模态语义关联实现了视觉、文本、语音三种模态统一表示,构建了三模态预训练大模型,赋予跨模态通用人工智能平台多种核心能力。

  徐波介绍,“紫东太初”兼具跨模态理解和生成能力。与单模态和图片、文字两种模态相比,“紫东太初”采用一个大模型就可以灵活支撑图片、文字以及语音的全场景AI应用,具有了在无监督情况下多任务联合学习、并快速迁移到不同领域数据的强大能力。

  “引入语音模态后的多模态预训练模型,可实现共性图片、语音和文字的空间表征和利用,并突破性地直接实现三模态的统一表示。”徐波说,特别值得强调的是,该平台首次让“以图生音”和“以音生图”成为现实,对更广泛、更多样的下游任务提供模型基础支撑,让AI能够在视频配音、语音播报、标题摘要、海报创作等更多场景实现应用。

  同时,研发团队还提出了弱关联三模态数据的语义统一表达,可同时支持三种或任两种模态弱关联数据进行预训练,有效降低了多模态数据收集与清洗成本。

  “‘紫东太初’跨模态通用人工智能平台包括三大关键技术和六大核心能力。”徐波说,三大关键技术分别是多模态理解与生成多任务统一建模、面向国产化软硬件的高效训练与部署、多模态预训练模型架构设计与优化。六大核心能力则体现为多模态统一表示与语义关联、跨模态内容转化与生成、预训练模型网络架构设计、标注受限自监督模型学习、模型适配与分布式训练、模型轻量化与推理加速。

  徐波表示,“大数据+大模型+多模态”将改变当前单一模型对应单一任务的人工智能研发范式,多模态大模型将成为不同领域的共性平台技术,是迈向通用人工智能路径的探索,具有广阔的应用前景。

  同时,全栈国产化通用人工智能平台的实践将使人工智能研发的规则发生重大变革并逐渐形成壁垒,对我国实现AI领域科技创新、占领核心技术高地具有重要的战略意义。(陆成宽)

[ 责编:蔡琳 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 杏林春暖:千年生态智慧的时代回响

  • 2026全球数字经济大会开幕

独家策划

推荐阅读
近年来,场景已成热词,一些企业甚至认为:“缺场景比缺资金还紧迫。我国有14亿多人口,庞大的人口基数孕育了巨大的消费市场和多样化需求,为新技术新产品提供了广阔而丰富的应用场景。
2026-07-03 09:50
夏日炎炎,海南三亚崖州湾,田间的南繁季已结束,而“数据田”里的育种仍在进行。走进海南大学南繁学院,基因组与大数据育种实验室里,不见培养皿与种苗圃,映入眼帘的是运转不息的机房。
2026-07-03 09:28
本次特检坞修历时25天,团队逐项攻坚100余项检修改造项目,同步完成全套船舶资质证书更新换发,完成燃油舱扩容升级,新增149立方米舱容,续航力由1.5万海里增加至1.8万海里,船舶自持力由60天提升至70天。
2026-07-03 09:21
北京经济技术开发区相关负责人表示,这座工厂把汽车、3C领域的精密制造经验“移植”到机器人身上,不仅让批量生产更稳、成本更低,还让每台机器人品质如一。作为世界机器人大会永久举办地,未来,北京亦庄将锚定“世界机器人看亦庄”的目标,在制造、数据、场景、安全治理上全面发力。
2026-07-03 09:20
据了解,2026年以来,我国搭载组合驾驶辅助功能的乘用车新车市场渗透率达到70%,其中,配备领航驾驶辅助功能(NOA)的车型渗透率超过30%。《智能网联汽车组合驾驶辅助系统安全要求》立足我国产业发展和行业监管需求,兼顾技术可行性、产品兼容性与落地实操性。
2026-07-03 09:20
生成式人工智能正以前所未有的力量重塑全球高等教育。面对这把“双刃剑”,如何在教育赋能与风险防控之间找到平衡,探索适应人工智能时代的高校治理路径,是全球高校共同面对的时代命题。全球高校对生成式人工智能的治理逐渐超越单纯的技术风险防控,迈向关于价值、规则与能力的系统性重构。
2026-07-02 09:20
今后钢铁厂、水泥厂、数据中心等用电大户,不能再随心所欲地使用煤电了,必须消费一定比例的可再生能源。长期以来,我国可再生能源产业发展重心锚定发电侧扩张,风电、光伏装机规模连年攀升,绿色能源供给能力实现跨越式增长。
2026-07-02 09:44
截至目前,全国配发832套流动科技馆,巡展7956站,服务公众2.57亿人次;科普大篷车累计配发1880辆,下沉乡镇及偏远地区,开展活动49.6万次,服务基层公众达4.07亿人次,行驶里程6188.5万公里,相当于绕地球1547圈。
2026-07-02 09:19
国家能源局日前发布《中国供电发展报告2026》,其中显示,我国已建成全球规模最大的电力供应体系,居民用户和小微企业告别了“花钱办电”的历史,人民群众用电获得感明显增强。
2026-07-02 09:40
农机装备是观察我国农业现代化水平的窗口,映射着农业新质生产力在田间地头的蓬勃脉动。用新技术、新场景锻造新农具,推进农机装备全程全面升级,一定能让更多农民挑上“金扁担”。
2026-07-02 09:22
随着SpaceX上市,太空算力再度成为全球科技竞争新焦点。据报道,中国已推动12颗计算卫星实现在轨运行,它们是于2025年5月14日发射升空的全球首个太空计算卫星星座。抓住机遇、乘势而上,中国完全有底气在这场太空算力竞赛中,跑出自己的加速度。
2026-07-01 09:38
电动汽车还与人工智能、新型电力电子技术加速融合,推动车辆从传统交通工具向智能能源终端转变。面对旺盛市场需求,中国电动汽车凭借完整产业链、智能化优势及快速交付能力,正改写全球汽车市场格局,成为稳定全球供应链的关键力量。
2026-07-01 09:33
中国世赛焊接团队全力对标产业升级需求,将比赛成果转化为实际应用,积极探索技能人才成长成才的实践路径。依托10余年的积淀与科学化的集训机制,中国焊接世赛团队终于迎来突破时刻,先后斩获第41届世赛银牌、第42届世赛优胜奖,并在第43届赛事中勇夺该项目的首金。
2026-07-01 09:29
短短几年,林场里农家乐和民宿如雨后春笋般涌现,如今增加到40多家,形成了一条远近闻名的“溪水农家院一条街”。每天午后,我都会沿着林场整洁的步道溜达溜达,一路景色宜人,一路自在惬意。
2026-07-01 09:26
国家税务总局30日发布最新数据显示,今年1至5月份,我国具身智能产业发展向好,呈现多方面亮点。目前,全国近九成具身智能产业企业集中在广东、北京、上海、浙江、江苏,其余少量分布在辽宁、山东、陕西、安徽等10个省市。
2026-07-01 09:24
在6月27日举行的首届西部商业航天大会现场,陕西西安高新区管委会主任陈辉端着一台银灰色的火箭发动机模型走向发布台。“我们要实现星箭总体环节的突破,大力引进培育卫星总体、火箭总体企业,支持卫星智能制造工厂和商业火箭总装线建设。
2026-06-30 10:01
近日,“共和国勋章”获得者、我国著名水稻专家袁隆平相关话题上了热搜。袁隆平带领我国科研工作者,通过雄性不育遗传工具,攻克了利用杂种优势的世界性难题,创建了系统化、原创性的杂交水稻育种体系,开辟出利用水稻杂种优势的新道路,有力保障了国家粮食安全。
2026-06-30 10:01
国家能源局29日发布数据显示,今年1至5月,全国累计完成电力市场交易电量30573亿千瓦时,同比增长24.8%。1至5月,从交易范围看,省内交易电量24361亿千瓦时,同比增长28.5%;跨省跨区交易电量6212亿千瓦时,同比增长12.2%。
2026-06-30 10:01
教育、科技、人才是全面建设社会主义现代化国家的基础性、战略性支撑。在资源配置方面,需要强化规划衔接、政策协同,推动教育、科技、产业等多部门资源在人才培养这一共同目标下统筹配置。
2026-06-30 10:00
今年入夏以来,雷电、暴雨、大风等强对流天气轮番登场,其瞬间释放的破坏力令人心生畏惧。若身处人流密集区域,同行人不牵手,应立即进入安装有防雷装置的建筑物、金属车身的汽车等安全区域。
2026-06-30 10:00
加载更多