点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:人人皆可“一语成画” AI作画神器来了!
首页> 科技频道> 人工智能 > 正文

人人皆可“一语成画” AI作画神器来了!

来源:光明网2022-08-19 18:18

  8月19日,中国图象图形大会CCIG 2022在成都召开。百度集团副总裁、深度学习技术及应用国家工程研究中心副主任吴甜在会上发表《跨模态大模型技术创新与实践》主题演讲,并正式发布AI艺术和创意辅助平台——文心·一格,这是百度依托飞桨、文心大模型的技术创新推出的“AI作画”首款产品。

  文心·一格为艺术创想插上科技羽翼,人人都能成为“艺术家”

  人学习作画一般得从基本功练起,大体上包括线条、色彩、明暗、形体、结构、透视、构图和空间。要想画得出众,除了日积月累勤奋练习,还需要一些天赋,以及对世界的精细观察和创作者独特的创想。这让大部分人只能当画作的观赏者而非创作者。但是,随着深度学习、大模型等技术的发展,AI 能够在极短的时间内“创造”出不同风格的画作,大幅降低了作画的门槛,让人人都能成为“艺术家”。

  文心·一格是基于文心大模型的文生图系统实现的产品化创新。在文心·一格官网,用户只需输入自己的创想文字,并选择期望的画作风格,即可快速获取由一格生成的相应画作。官网资料显示,文心·一格现已支持国风、油画、水彩、水粉、动漫、写实等十余种不同风格高清画作的生成,还支持不同的画幅选择。

  文心·一格面向的用户人群非常广泛。它既能启发画师、设计师、艺术家等专业视觉内容创作者的灵感,辅助其进行艺术创作,还能为媒体、作者等文字内容创作者提供高质量、高效率的配图。此外,文心·一格更是为大众用户提供了一个零门槛绘画创作平台,让每个人都能展现个性化格调,享受艺术创作的乐趣。

  文心·一格背后的跨模态大模型技术与系统创新

  吴甜表示,数据的井喷式增长、算力的持续突破、算法的持续创新为人工智能带来新机遇,预训练大模型凭借优越的泛化性、通用性和应用效果,成为人工智能发展的重要方向。跨模态大模型是在技术发展和产业实践中孕育而出的,也是百度文心知识增强大模型面向产业应用持续创新及建设的重要方向。

  面对日益增长的内容创作需要,如何准确理解用户需求,进而精准刻画并满足多样化风格、高质量生成的要求是技术要解决的关键挑战。文心知识增强跨模态理解大模型在模型创新方面,提出基于多视角对比学习的ERNIE-ViL 2.0,在预训练过程能够同时学习模态间和模态内的多种关联性,提升“图像”和“文本”跨模态语义匹配效果。知识增强跨模态图文生成大模型ERNIE-ViLG,将“文生成图”和“图生成文”任务融合到同一个模型进行端到端学习,从而增强文本和图像的跨模态语义对齐。在此次CCIG 2022会上,吴甜还分享了ERNIE-ViLG文图生成算法的升级,通过渐进式扩散模型,生成空间由小及大、生成轮廓由粗到细,同时根据生成阶段自动选择最优生成网络,文本生成图像的效果取得进一步提升。

  新技术在产业实践中应用并创造出价值必须要足够实用化。因此,百度基于文心大模型进行了系统创新,研发了支持AI作画的文生图系统,提供了从用户需求理解到满足的全流程解决方案。首先,基于知识的Prompt工程,理解用户需求并在此基础上丰富语义细节,降低用户输入描述成本。其次,基于扩散生成算法实现创意写实与恢弘构图的艺术画作生成。最后,基于跨模态匹配大模型进行生成画作的结果排序,自动选出语义与美观度最佳的画作。

  从技术创新到系统创新再到产品化创新,这一体系性的创新得益于飞桨产业级深度学习平台的夯实有力支撑。飞桨的端到端自适应分布式训练技术、4D混合并行策略、对异构硬件的自适应并行支持,锤炼出框架与算力、算法相结合三位一体的大模型训练优势。飞桨的自动模型压缩工具、自适应分布式推理技术,更是大幅节约了机器资源,让大模型的部署更加高效、便捷,能真正落地应用。

  吴甜认为,新技术应用于场景,需要从基础算法、技术系统、工程平台多方面同时创新,文心·一格就是依托于多项新技术综合创新的产品。

  除了推出一格这样的AI艺术和创意辅助平台,文心跨模态大模型还为广大开发者、科技爱好者提供了飞桨开源工具和API服务能力,满足开发者灵活探索等需求。对灵活性需求更高的开发者,可以使用飞桨的开源工具PaddleHub基于文图生成开源算法极简开发,并完成模型的管理和一键预测。对便捷性需求更高的开发者,可以使用文心ERNIE-ViLG API,极速获得沉浸式文图生成大模型的技术体验,更可灵活方便、高效地实现产品集成。

  据了解,为了帮助更多行业用户清晰了解、轻松应用基于大模型技术的AIGC能力,百度飞桨文心大模型已在8月开设AIGC系列公开课,课程深入浅出、体系全面并配套丰富的实践资源。

  让机器具备跨越文本、图像等多种模态的复杂场景理解与生成能力,是人工智能的重要目标之一,也是数字时代科技与产业深度融合创新,催生新业态新模式,加快产业智能化升级的新动能。人工智能在艺术领域的学习与创作能力正以蓬勃之势不断刷新我们的认知,同时也让公众对科技与艺术及文化的融合创新有了更大的想象空间。文心大模型正在成为推动AIGC(人工智能生成内容)发展的新引擎,基于文心大模型的AIGC将会带来创新性的探索,并赋能到广泛的行业领域。

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 世界经济论坛2026年年会在瑞士达沃斯开幕

  • 大寒迎年 古人是怎么忙着过年的?

独家策划

推荐阅读
2025年C919安全载客超过400万人次,而且今年又新开了广州往返南京的航线。
2026-01-20 07:00
工业和信息化部、国家发展改革委等五部门日前联合印发《关于开展零碳工厂建设工作的指导意见》。
2026-01-20 03:25
工业和信息化部日前印发最新修订的《优质中小企业梯度培育管理办法》,将科技型中小企业纳入优质中小企业梯度培育范围。办法自2026年4月1日起实施。
2026-01-20 03:20
近日,工业和信息化部印发最新修订的《优质中小企业梯度培育管理办法》,扩大了培育基础,首次将科技型中小企业纳入梯度培育范围。
2026-01-20 09:03
中国科学技术大学马骋教授针对全固态锂电池在循环时因需要维持良好界面接触而过于依赖外部压力、难以实际应用的问题,提出了一种低成本、较为适合商业化的解决方案。
2026-01-20 09:02
离子注入机是半导体制造关键设备,尤其是高能氢离子注入机研发难度大、技术壁垒高,我国长期依赖进口。
2026-01-20 09:02
对于行业的未来,赵同阳充满期待:“人形机器人行业未来也会出现几家顶级企业,我希望提起机器人,人们首先想到的是中国。
2026-01-20 08:57
当日9时34分,神舟二十号飞船返回舱在东风着陆场成功着陆。经现场检查确认,飞船返回舱外观总体正常,舱内下行物品状态良好,神舟二十号飞船返回任务取得圆满成功。
2026-01-19 11:36
血脑屏障横亘于血液与大脑之间,严格调控物质通行,将绝大多数药物拒之门外,这成为脑神经疾病新药研发面临的主要瓶颈之一。许多在实验室中表现优异的候选药物因无法有效透过血脑屏障,在临床试验阶段止步不前。
2026-01-19 03:10
随着国民健康意识的普遍觉醒与消费结构的深刻升级,以全谷物、豆类、薯类等为代表的杂粮,正悄然经历一场角色与意义的深刻变革。
2026-01-19 03:10
新年伊始,江苏无锡凯龙高科技股份有限公司的实验室内,一只机器人灵巧手在一个两米多高的透明检测设备中流畅地完成抓取、捏合、旋转等一连串精细动作,相关数据实时传出。这款具身智能机器人灵巧手全操作力智能检测平台于去年年底一经启动,便获得多张订单。
2026-01-19 03:10
日前,江苏徐圩核能供热发电厂1号机组核岛开始混凝土浇筑,标志着全球首个核能与石化产业大规模耦合项目进入主体工程建设阶段。这是今年我国开工建设的首台核电机组。
2026-01-19 03:10
为破解这一谜题,利用“中国天眼”的超高灵敏度优势,研究团队对重复快速射电暴FRB 20220529开展了2年多的持续监测。
2026-01-19 09:10
目前,依托DrugCLIP,团队完成了覆盖约1万个蛋白靶点、2万个蛋白口袋的虚拟筛选项目,分析筛选超过5亿个类药小分子,富集出超过200万个潜在活性分子,构建了目前已知最大规模的蛋白—配体筛选数据库。
2026-01-19 09:08
从中国地质调查局获悉,由该局广州海洋地质调查局自主研发的国内首台海底地层空间立体钻探与原位监测机器人,日前在南海1264米水深海域成功完成试验作业,各项性能全面达标,标志着我国深海勘探与地层原位监测技术取得重要突破。
2026-01-16 03:45
15日,国际学术期刊《自然》发表中国科研团队重大成果——由中国科学院大学主导、广西大学等多单位联合攻关的团队,首次直接观测到中子碰撞中的米格达尔效应,为人类搜寻轻暗物质粒子打开关键突破口,标志着我国在基础物理与探测器技术领域跻身国际前沿。
2026-01-16 03:45
15日12时01分,我国在酒泉卫星发射中心使用长征二号丙运载火箭成功将阿尔及利亚遥感三号卫星A星发射升空,卫星顺利进入预定轨道,发射任务取得圆满成功。
2026-01-16 03:45
进一步促进青年科技人才脱颖而出,需要凝聚多方合力、强化协同联动,从制度供给、环境营造、资源倾斜等方面精准施策、一体推进。
2026-01-16 03:45
展望未来,随着相关实践的不断普及和深化,数智赋能的流动公共服务将更加可及、公平普惠、精准高效,并为推进国家治理体系和治理能力现代化注入更多动能。
2026-01-16 03:45
中国医学科学院血液病医院(中国医学科学院血液学研究所)主任医师施均、研究员熊海清为通讯作者,博士后李若难、主治医师潘虹、主治医师张乐乐和研究生马佳秀为共同第一作者。
2026-01-16 09:04
加载更多