点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:AI大模型加速落地 “新蓝海”如何开拓
首页> 科技频道> 综合新闻 > 正文

AI大模型加速落地 “新蓝海”如何开拓

来源:光明网-《光明日报》2024-08-05 09:45

  上海,观众在世界人工智能大会上的AI模型平台屏幕前交流讨论。新华社发

  云南昆明,观众在第八届南博会上等待AI机器人制作素描画像。新华社发

  工作人员在湖北武汉一家AI智慧产业园的展示中心内工作。新华社发

  【圆桌对话】

  【编者按】

  当前,生成式人工智能技术在多个领域展现出广泛的应用潜力,逐渐成为科技领域的关注焦点。

  国家互联网信息办公室最新数据显示,截至目前,我国已经完成备案并上线、能为公众提供服务的生成式人工智能服务大模型已达180多个,注册用户突破5.64亿。

  大模型如何进一步赋能千行百业?今后还需要在哪些方面重点发力?本期,我们邀请专家学者就生成式人工智能发展过程中遇到的难点问题和未来发展趋势进行探讨,为读者呈现这一领域的最新动态。

  大模型是通向通用人工智能的路径吗?

  记者:有人说,大模型改变了人类对于整个世界的认知方式,让我们看到了实现通用人工智能的路径。您对这个观点怎么看?

  朱晓峰:相较于传统的人工智能,以大模型为核心的人工智能具有自主生成能力,不再是人类工程师教它什么,它会什么,而是在一定程度上像人类一样具有了自主学习和输出能力,可以从事那些人类工程师未事先赋予其相应能力的工作。这与通用人工智能的方向具有一致性。一般认为,通用人工智能具备三个关键特征,分别是自主定义任务、完成无限任务以及由价值驱动。虽然现有的生成式人工智能还不具备其中的任何一个特征,但大模型的出现和迅速发展,使我们看到了实现通用人工智能的可能道路。从这个意义上讲,这个判断是准确的。

  严骏驰:大模型技术正在以惊人的速度重塑我们对世界的认知,并为未来的智能技术开辟了广阔的前景。这些技术通过处理和分析大量数据,展现出了令人瞩目的智能特性。然而,要实现真正的通用人工智能,我们可能还需要更深入的理解和更复杂的技术创新。

  一方面,我们要知道大模型的“智能”并不是真正意义上的“智能”。当前的大型模型虽然在规模上达到了前所未有的水平,但它们的智能层次仍有局限性。这些模型能够执行特定的记忆任务,然而,真正的智能远不止于此。它涉及复杂的因果推理、逻辑思维等高级认知能力,这些是目前大模型所缺乏的关键要素。要实现通用人工智能,我们必须超越这些局限,模拟出更接近人类智能的全面认知能力。

  另一方面,我们需要了解实现真正“智能”的关键所在。大模型的智能程度高度依赖于数据和计算资源,这种依赖导致它们的智能更多是基于统计和记忆,而非深刻的理解或创造性。真正的智能应该能够识别和纠正现有知识的不足,并有能力探索和创造新知识。这是目前大模型所未能触及的领域,也是未来智能技术发展的关键所在,我们还需要创新的算法和更深层次的认知理解。

  大模型技术的发展为我们展示了实现通用人工智能的潜在路径,未来的智能技术发展将依赖我们在认知模型、算法创新和伦理研究等方面的持续努力和探索。

  陈昌凤:反过来说,是人类的认知革命驱动了大模型的诞生。大模型是科学发展与哲学变迁的产物。牛顿经典力学理论带动了自然科学的第一次大发展,催生了与之相适应的哲学思维——整个宇宙是机械运动的结果,生命乃至人类也可被看作机器,生命运动可以用机械运动去解释了。

  从20世纪中期开始,伴随着生物学和计算机科学的发展,人们尝试以计算的抽象思维去认识和把握世界。人工智能的奠基者图灵把人的大脑看作离散态的机器,论证认为人类心灵活动实质上是信息处理过程。计算机的奠基人冯·诺依曼提出细胞自动机的理论,认为生命的本质是计算的过程,此后更多的研究用计算思维来认识和理解生命,将生命的过程还原为计算的过程。

  认知科学由此也掀起了变革热潮。人类智能的可计算性是基础,认知计算主义认为,人类大脑和计算机都被看作一套处理符号的形式系统,人类的计算、感知和认知等智能行为,都可以被数据化、符号化,成为计算机模拟、处理的对象。这些都是人工智能发展的理论基础。在尝试了不同的路径之后,辛顿等科学家研究出了深度学习、神经网络系统,从而驱动了这一轮大模型的诞生。可以肯定的是,这一场技术变革将带来更深层次的认知变革,将进一步破解人类的思维密码。

  高质量中文语料短缺难题如何破解?

  记者:目前普遍认为,大模型技术的发展仍面临诸多挑战,其中最突出的问题之一是数据支持的不足,尤其是高质量的中文语料短缺,难以支撑算法模型的持续迭代和优化。这个问题如何破解?

  陈昌凤:当前,国际最先进的大模型几乎已经“学完”了人类已有的可获得的数字化文献。有研究指出,根据2023年数据消耗速度,高质量语言数据将在2026年前被耗尽,低质量语言数据将在2030年至2050年被耗尽;视觉数据将在2030年至2060年被耗尽。

  国际上,文本数据使用殆尽,而数据流通与版权保护形成的矛盾也限制了大模型的数据可使用性。已经有很多信息巨头公司正在将视觉化信息、音频类信息转为可训练的文本数据。有消息指出,大量转录的音频数据已经用于模型训练,不少“合成数据”也已经开始受到青睐。

  中文数据方面确实存在先天不足。一方面,在上世纪末的数字化浪潮中,中文领域对数字化的重视和投入均不足,初期的数字化信息质量也参差不齐,欠缺再利用的价值;另一方面,网络信息存储和数据化建设均难与技术发展相同步、相匹配。此外,迄今引进的部分数据库,带着固有的价值观烙印。亡羊补牢,为时未晚。如果从顶层设计部署到实践落实能够重视、弥补,相信仍有意义。

  严骏驰:在大模型技术发展的道路上,高质量中文语料的短缺问题日益凸显,成为制约技术迭代和优化的重要因素。为解决这一挑战,可以通过以下措施来提升中文语料的质量和可用性:

  一是挖掘和整合国内中文资源。我国拥有庞大的中文报纸、期刊、网站和App资源,这些都是构建高质量中文语料库的重要基础。例如,中国的报纸种类繁多,App市场活跃,国家图书馆的中文藏书也极为丰富。我们需要深入挖掘和整合这些资源,以提升中文语料的质量和多样性。

  二是加强数据合规监管。政府部门和监管机构需要建立相应的监管机制,以确保人工智能领域的数据合规。这包括对大模型的数据采集来源、处理方法以及合规性进行监督和审查。同时,我们还需建设集中的数据共享平台,在保证数据合规的前提下,增强中文数据的可用性,以推动大模型技术的发展,同时保障各方的合法权益。

  朱晓峰:还有两点也很重要。一是建立统一的中文语料库编码规范标准,提高中文语料数据的可使用性。我国目前的中文语料库的国家标准有《信息处理用现代汉语分词规范》《信息处理用现代汉语词类标记规范》等,但这些只是作为推荐性标准,行业采用率不高。实践中不同中文语料库采用不同的编码规范标准,形成了语料库之间的异构性,数据资源之间难以相互转换,同时导致重复建设。对此,考虑到元数据标准规范是中文语料库标准规范中最有条件、最容易实行的规范,可以依据这一规范,建设相应的中文语料库。

  二是建立Web检索,搭建由国家、省市图书馆和各高校图书馆主导的中文语料库资源共享平台,推动中文语料库共享进程。Web检索为语料库的访问提供了便利,但在实际应用中,尤其是对于语言信息处理研究和人工智能的使用来说,往往需要获取语料库的全文或特定子库的内容,这就对现有的Web检索系统提出了更高的要求,即需要建立更加广泛、全面且易于使用的中文语料库资源,以便满足这些高级需求。这意味着在现有Web检索技术的基础上,还需要不断优化和完善语料库的组织结构、检索方式以及用户界面等,以提高语料库资源的可访问性和易用性。

  大模型的“新蓝海”在哪里?

  记者:目前,大模型已经在自动驾驶、医疗健康等领域展现出巨大潜力。未来,大模型可能会在哪些领域开拓出新的“蓝海”市场?

  陈昌凤:大模型横空出世不足两年,一些“大模型”已经朝着“小模型”的方向转变,比如着力于开拓垂类应用模型——教育类、金融类、政务服务类、媒体类、医疗健康类等,并取得了可见的成效。一些可能朝着更细化的AI Agent(智能体)应用方向发展。目前一些人工智能产业正从应用层中寻求创新和价值。

  严骏驰:现阶段,我国生成式人工智能的应用主要聚焦于医疗、汽车、教育、金融、文化等消费级场景,但在高精尖领域,如自动化定理证明、电路芯片设计、科学文档理解和发现以及图表理解等方面,大模型技术的应用潜力尚未得到充分开发。这些领域对于技术的要求更高,同时也具有更大的创新空间。

  大模型技术在数学和逻辑推理方面有很大的潜力。通过处理和分析大量的数学和逻辑数据,大模型可以辅助自动化定理证明,提高证明过程的效率和准确性。例如,大模型可以辅助证明复杂的数学定理,帮助数学家解决一些长期未解的问题。此外,大模型还可以辅助自动化推理,例如在编程语言和形式化验证中的应用,从而提高软件开发和系统设计的效率和质量。

  大模型技术在芯片设计领域也值得关注。通过引入大模型技术,可以优化设计工作流程,缩短设计时间,并优化功耗、性能和面积。这不仅提高了设计效率,还帮助开发者解决整个系统堆栈中的复杂问题。此外,大模型还可以协助完成一些重复性的探索工作,帮助开发者更快达成目标,如优化测试周期、提高覆盖率并最小化测试向量数量等。

  大模型技术在科学文献分析方面的应用也显示出巨大潜力。通过处理和分析大量的科学文献数据,大模型可以帮助科学家更好地理解和发现科学知识。例如,大模型可以辅助科学家从大量的科学文献中提取关键信息,发现新的科学关联和趋势,从而推动科学研究的进展。此外,大模型还可以辅助科学文献的自动分类和索引,提高科学文献的检索效率和准确性。

  在大模型技术的发展中,图表理解领域的研究也值得期待。大模型技术能够帮助理解和分析图表数据,提取关键信息,并应用于各种领域,如市场分析、金融预测等。这种技术的应用能够提高数据分析和决策制定的效率和准确性。

  朱晓峰:大模型技术的特性和产业发展的要求决定了其需要大规模和长周期的投入和布局。在此过程中,我们不仅要尊重市场规律,肯定企业自身的努力,更要充分发挥国家层面的引导作用。例如在大模型基础设施建设、产业引导等方面,做出更多政策上面的引导和支持。

  同时,在一些特定领域,如医疗、生命科学、数字城市等,我国拥有独特的优势。应当充分利用并发挥这些优势,通过大模型来驱动创新,从而带动人工智能产业的全面发展进步。

  主持人:

  记者 方曲韵

  本期嘉宾:

  清华大学新闻与传播学院教授 陈昌凤

  中央财经大学法学院教授 朱晓峰

  上海交通大学人工智能学院教授 严骏驰

[ 责编:焦子原 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 江苏:系统布局 机器人产业“加速跑”

  • 湖南长沙:校园民俗活动迎接“二月二”

独家策划

推荐阅读
“遥感是人们在距离和感官上的延伸,是认知地球、探查资源、监测环境的重要技术手段。本次活动由全国科学道德和学风建设宣讲教育领导小组主办,中国科协科学技术传播中心、湖南省科学技术协会、中南大学、光明网联合承办。
2026-03-20 09:42
每年春季,花粉过敏会给不少人带来困扰。该检测试剂盒采用微量血清特异性洋白蜡花粉过敏原IgE定量检测,用以辅助诊断,成为目前用于花粉症精准诊断的主要方法。
2026-03-20 09:39
3月18日,记者从新疆电力交易中心有限公司获悉,自2010年启动“疆电外送”以来,新疆累计外送新能源电量已达3043.6亿千瓦时,约占总外送电量的三成。
2026-03-20 09:39
吕小康:从现实语义上看,情感AI既指能够识别、理解、模拟和响应人类情感的人工智能技术,也指基于这类技术设计和开发的情感智能体。吕小康:为引导青年群体健康使用情感AI,还需要进一步加强协同治理,培育积极有益的陪伴型人工智能应用环境。
2026-03-20 09:36
据3月17日农情调度,全国早稻育秧已三成半,同比略快。据介绍,北方冬小麦当前的田管重点是继续促进弱苗转化升级,抓好病虫防控,防范春旱、倒春寒、干热风等灾害。“近日国家启动投放1000余万吨氮磷及复合肥储备,作为国家化肥储备重要承储主体,全国供销合作社系统农资企业积极按要求将储备化肥及时集中投放市场,稳定市场价格。
2026-03-20 09:36
小时候我们背过一句话:万物由原子组成。这一路走来,从质子的异常,到夸克模型的提出,再到量子色动力学和标准模型的建立,人类把物质拆解到了17种基本粒子的层级。曾获国家六部委回国人员成就奖、德国洪堡研究奖、吴有训物理奖、中国科学院优秀研究生导师奖。
2026-03-20 09:35
吴晓民(右一)团队在野外工作。藏羚羊曾广泛分布于高原全境,其漫长的演化史与复杂的种群波动,始终是全球动物保护与演化生物学领域关注的焦点。研究团队还通过生态位模拟,锁定了藏羚羊的生命庇护所——青藏高原北部的可可西里、羌塘高原等区域。
2026-03-19 10:11
通知明确,各城市群应优先选择具备条件的燃料电池汽车、绿色氨醇、氢基化工原料替代、氢冶金以及掺氢燃烧等应用场景开展试点,积极探索氢能创新应用场景,形成“1个燃料电池汽车通用场景+N个工业领域应用场景+X个创新应用场景”的氢能综合应用生态。通知要求,氢能综合应用试点以城市群为主体开展申报,城市群应立足自身资源条件,因地制宜、宜氢则氢,避免各场景一拥而上、低水平重复建设。
2026-03-19 10:10
2026中关村论坛年会将于3月25日至29日在北京举办。
2026-03-19 10:04
日前发布的《中国地热产业发展报告2025》显示,我国地热产业多元化利用格局正在形成。在地热供暖发展带动下,我国地热产业规模长期稳居世界第一。
2026-03-19 10:00
由于土豆块茎外形粗陋、埋于地下,又不见于《圣经》,一度被殖民者视为“魔鬼之根”或带毒之物。另一方面,随着城市扩张与人口增长,粮食压力加剧,土豆因高产、耐寒、适宜在小块土地种植而被人们重视。
2026-03-19 10:00
作者:刘琦 仇焕广(分别系中国人民大学助理教授,辽宁大学党委常委、副校长)  今年《政府工作报告》提出,“推进先进适用农机装备研发应用,打通农业科技推广‘最后一公里’”。
2026-03-19 09:59
为此,生态环境法典针对重点流域、重要生态单元设置专门规范,明确长江、黄河等重点区域一体化保护要求,建立协同机制。生态环境法典第三编第六章“生态退化的预防和治理”,整合水土保持法、防沙治沙法的有关规定,分为水土保持、防沙治沙两节。
2026-03-18 09:38
“‘两弹一星’不是孤立的科技突破,而是面向国家需求‘从0到1’的科技创新。本次活动由全国科学道德和学风建设宣讲教育领导小组主办,中国科协科学技术传播中心、安徽省科学技术协会、安徽农业大学、光明网联合承办。
2026-03-18 09:27
对于1型糖尿病患者而言,胰腺中那些负责分泌胰岛素、调节血糖的胰岛β细胞,被自身免疫系统错误地当成了“入侵者”,日复一日地遭受攻击,直至彻底损毁。这3个病例,分别代表中国乃至全球再生医学领域的3个“首次”——世界首例自体、中国首例异体、世界首例青少年再生胰岛移植治疗1型糖尿病。
2026-03-18 09:27
记者3月17日从国家能源局获悉,2026年1至2月,全社会用电量累计16546亿千瓦时,同比增长6.1%。从分产业用电看,第一产业用电量223亿千瓦时,同比增长7.4%;第二产业用电量10279亿千瓦时,同比增长6.3%,其中,工业用电量同比增长6.4%,高技术及装备制造业用电量同比增长10.6%;第三产业用电量3231亿千瓦时,同比增长8.3%,其中,充换电服务业、互联网数据服务业用电量增速分别达到55.1%、46.2%。
2026-03-18 09:26
当前,以家庭农场、农民合作社、龙头企业为代表的新型农业经营主体已成为“强农兴村”的中坚力量,发展成效显著。夯实联农带农长效机制,还需构建多层次、可落地的政策环境,让农业经营主体有动力、有能力、有底气带动小农户共同增收。
2026-03-18 09:26
在成都温江区,骑行爱好者李先生沿着北林绿道前行,穿梭在虫鸣鸟叫、淡淡花香之中。”  一幅幅充满生机的新春图景,正是成都加快建设践行新发展理念的公园城市示范区的生动注脚。
2026-03-18 09:26
分享几个故事,一起走进地球科学的世界。
2026-03-16 18:39
工业和信息化部、财政部、国家发展改革委日前印发《关于开展氢能综合应用试点工作的通知》。通知提出,通过城市群试点,将氢能应用场景由燃料电池汽车向交通、工业等具备条件的多元领域拓展。
2026-03-17 09:35
加载更多