点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:语言智能的新发展与新挑战
首页> 科技频道> 综合新闻 > 正文

语言智能的新发展与新挑战

来源:光明网2023-02-20 09:56

  语言智能是人工智能的一个领域,主要关注人类语言的智能分析和处理,涉及语音识别、自然语言理解、自然语言生成、机器翻译等领域。近日,最能体现语言智能水平的ChatGPT引发各界的广泛关注,人们怀着极大的兴趣在讨论和尝试着这项崭新的技术成果。或兴奋,或迷茫或恐慌。兴奋的是语言智能技术真的使计算机能像人类一样和我们自如地聊天解惑了,并且话语自如、有理有据,可以拒绝不合理的提问,效果如此之好,竟引发了轰动效应;惶恐的是ChatGPT具有超强的生成能力,不仅可以聊天,还可以写文章、作诗、编码程序等,这样的话,ChatGPT就会代替人类和语言相关的工作和岗位,给人类生活带来颠覆性变化;迷惑的是我们的语言智能研究下一步朝着哪个方向走?如何理性地分析ChatGPT取得的突破和主要不足?赶上或超越它的机会和落脚点在哪里?对于语言智能的飞速发展,我们要有科学理性的态度,既要热情拥抱人工智能的新发展,让它更好地服务于人类社会,又要预防它带给我们的消极影响,看到我们的不足和差距,迎头赶上。

  一、ChatGPT的功能与不足

  ChatGPT是由openAI研发的一种人工智能聊天机器人程序,它是基于GPT3.5架构的大型语言模型并通过强化学习进行训练,可以和人类以自然语言对话的形式进行交互,还可以用于相对复杂的语言工作比如文本生成,自动问答,自动摘要等,同时具备一定的编写和调试计算机程序的能力。ChatGPT 的出现是语言智能领域的一大进步,标志着语言智能技术可以融合于信息搜索、人机交互、对话生成等方面,应用场景的落地具有广阔空间,潜力无穷。

  首先,ChatGPT是一个基于深度学习的大规模预训练对话模型,主要功能是对话聊天,它通过强化学习来理解提问者的话语意图,能够较好地引入人类反馈,具备主动承认错误,区分问题是否符合伦理要求,质疑不正确的问题等,并通过清晰的逻辑思路来组织话语,距离人类的聊天方式和口气越来越近。相对于以前的对话系统,ChatGPT的主要突破在以下几点:

  (一)超强的生成能力可以完成多种任务。ChatGPT除了与人对话聊天外,还能按照输入的关键词和表达的意图写小说、写论文、创作诗歌、作图、编写和纠正程序代码。还可以用在教案生成、资料查询、智能教学、智能创作和设计,在医疗、法律、教育、咨询服务等领域具有广阔应用前景。

  (二)与搜索引擎相结合,基于海量数据,实现更为符合人类需求的查询结果,实现交互式搜索,给用户带来全新的体验

  (三)交互能力大幅度提升。除了具有广博的知识,它还能很好地组织自己的话语,思路清晰,逻辑严密,“因此”“而且”“但是”等话语连接词使用恰当,几乎接近人类语言的能力。还能主动承认错误,拒绝不合理的提问等等。

  ChatGPT的主要功能在于提供信息和社交能力,有望成为人在精神陪伴,面对挫折困难的时候提供引导和安慰的帮手。总之,ChatGPT已经成为互联网时代的语言智能的技术领跑者,给人类社会带来更加智能化和便捷化的服务。

  当然,作为一种新兴人工智能模型,ChatGPT也存在一些问题和不足,主要在于:

  (一)尽管对话能力和交互能力大幅度提升,但经常出现事实性错误。由于它是数据驱动的模型,对于数据背后的真实世界的状态,原理和规则等缺乏足够的认知,因此会出现一本正经地胡说八道情况。不符合常理的话语会经常出现。

  (二)对于一般知识了解广泛,但无法提供专业性较强、有深度、有洞见的问题答案。例如对它进行物理学测试,简单常识性问题回答较好,越是难度增加,答案不能令人满意。说明ChatGPT掌握的知识并不深入、不专业。

  (三)基于多层复杂神经网络搭建的深度学习模型,目前还不能解释其算法逻辑,经常出现事实性错误,产出的结果不具有安全性保障。如果被恶意利用,将造成严重的安全隐患,或危害法律。

  二、ChatGPT 的工作范式

  ChatGPT是一个基于transformer神经网络架构和生成预训练技术的大型语言模型,通过对超大型文本语料的训练,来获得语言知识和世界知识。同时它还引入基于人类偏好的强化学习方法,将其应用于自然语言建模。训练的语料,除了海量无标注数据,ChatGPT还利用标注精细的专门语料库,训练机器更高的适应性和更准确的知识。这些知识是怎么被机器获得和输出的呢?ChatGPT使用的transformer神经网络结构对数据进行训练,可以输入序列,将其转化为对应的输出序列,知识是通过神经网络训练得到的。在训练过程中,ChatGPT使用了海量的自然语言文本数据来学习单词的嵌入表示,以及上下文之间的关系,这些知识被编码在神经网络的参数中,输出的结果都生成于这些参数之中。收到用户的问题时,ChatGPT会将其输入到神经网络中,神经网络会根据它学到的知识回答问题,反馈给用户。超强的记忆力是它的重要特征。ChatGPT作为一个现象级的技术产品,在生成内容方面无疑是革命性的,代表着人工智能大模型加大数据范式方法的成功,也说明采用统计模型方法模拟人类语言智能的新发展。ChatGPT在大模型的基础上,采用人类反馈强化学习的训练机制和提示引导模式,促使模型逐渐顺应人类思考逻辑,趋向人类认知和习惯,这是它的一大创新。

  三、对未来语言智能走向的影响

  ChatGPT除了对人类生活带来影响,对语言智能领域的研究范式和发展走向也会带来巨大的冲击。从大量的语言数据中学习,挖掘语言规律和语义关系,极大地改进了自然语言理解和生成的质量,取得惊喜的使用效果,使我们对大语言模型有了新的认知和思考:大模型范式是否成为未来语言智能的主流技术?学术界和企业界从事多年的自然语言处理研究还需要继续搞下去吗?ChatGPT会给AI领域的研究带来怎样的影响?

  预训练模型的出现代表了自然语言处理技术的飞跃,减少了对特征工程的依赖,逐渐带动整个领域研究范式的转变。这种范式转变带来的影响主要体现在:

  一是自然语言处理研究子领域的逐渐弱化,例如词性标注、命名实体识别、句法分析、指代消解等问题,它们在大模型+大数据独领风骚的背景下,将会逐渐失去吸引力,甚至被淡忘和遗弃。

  二是自然语言处理不同子领域的技术方法和技术框架日趋统一。多少年来,为了让机器理解人类语言,人们想尽各种方法来标注词性,理解语义。ChatGPT的出现,让人们看到了语言预训练模型威力,通过这种范式处理自然语言效果会更好。

  第三,从全球语言智能的发展来看,大模型范式的一路领航势必导致技术、资源、用户的高度趋合,最终走向技术和资源的单极垄断。

  四、未来发展

  尽管ChatGPT在智能交互方面获得惊人的能力,但它毕竟是一个预训练语言模型,基于预存知识和模型回答问题,并不具备真正的理解能力和创造能力,不能理解自己输出的内容。面对语言智能的新发展和新挑战,未来可以着重考虑以下几个着力点。

  (一)深度学习模型的优化。结合人类语言习得,语言使用规律和习惯,推进深度学习模型研究,提高语义理解能力,更好模拟人类语言能力。

  (二)多模态语言理解与生成。随着多模态数据的不断增加,如何在多模态语言理解任务中有效融合多种信息来源,提高语言理解的准确性是当前语言智能研究的一个重要方向。ChatGPT主要是文本的自动生成,多模态的语言理解和生成问题尚未完全解决。需要未来深入研究多模态学习和多模态生成技术。

  (三)领域知识图谱的构建。虽然ChatGPT可以搜索众多信息,对一般问题回答较好,但相对有深度和专业性较强的问题却表现得力不从心。如何更好地利用知识图谱的语义信息,提高自然语言处理任务的准确性,更好地服务于各类专业性用户,也是未来可以发展的一个领域。

  (四)加强人工智能伦理和数据安全等问题的研究。ChatGPT是生成型人工智能,不是简单地分析和处理数据,很可能会引发道德和法律方面的违规行为。比如,对信息数据来源无法进行事实核查,存在个人数据和商业秘密泄露,或提供虚假信息的隐患。学生使用ChatGPT写论文是否算抄袭等等,因此加强科技伦理研究,建立数据安全法规的约束机制,增强人们对技术变革的现代智慧是非常迫切的任务。

  作者:李佐文,系北京外国语大学人工智能与人类语言重点实验室教授、博士生导师

[ 责编:蔡琳 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 北京中学生演绎《呐喊》《茶馆》

  • 美丽中国丨邂逅洱海的夏日时光

独家策划

推荐阅读
6月1日,漳州核电4号机组核岛反应堆厂房堆腔换料水池模块吊装成功,为后续核岛主线关键路径施工奠定坚实基础。
2026-06-02 10:03
1日,2026年全国粮食和物资储备科技活动周在湖北武汉启动。今年科技活动周的主题是“奋进‘十五五’ 科技护粮储”,活动发布了“十四五”期间我国粮食和物资储备领域132项优秀科技成果、应用案例。
2026-06-02 09:51
全球约有2.5亿乙肝病毒感染者,多数需要长期甚至终身服药,难以彻底停药。当病毒入侵人体细胞时,它首先要“刷卡进门”——结合细胞膜上的特定受体蛋白,才能进入细胞内部。
2026-06-02 09:48
6月1日,长征十二号乙遥一运载火箭在东风商业航天创新试验区中国商火研试发射工位点火升空,成功将千帆星座第十批组网卫星送入预定轨道,首飞任务取得圆满成功。
2026-06-02 09:46
近日,中国民航局新增内设机构低空安全司,机构职责包括起草低空民航发展规划、统筹低空安全与发展、建设低空飞行服务调度平台和低空飞行服务站体系等。这是继2024年12月国家发展改革委成立低空经济发展司之后,国家成立的第二个低空概念管理机构,与低空经济发展有着不可分割的联系。
2026-06-02 09:43
生态环境部近日联合教育部等11个部门和单位发布《中国噪声污染防治报告(2026)》。这位负责人表示,生态环境部为此持续开展噪声治理“千件万户”投诉典型案件调度,推动解决了一批群众反映强烈的噪声问题。
2026-06-01 09:55
习近平总书记深刻指出,中国式现代化要靠科技现代化作支撑,实现高质量发展要靠科技创新培育新动能。生产线上,一批核心技术加速突破,为产业升级注入强劲动能……  习近平总书记强调,实现高水平科技自立自强,是中国式现代化建设的关键。
2026-06-01 09:55
作为全球海洋科技领域最具权威性与影响力的学术盛会,已创办近60年的国际海洋技术大会,一直被誉为全球海洋科技界的“风向标”与“孵化器”。”5月27日上午,中国科学院深海科学与工程研究所副所长彭晓彤汇报由中国科学家主导的国际合作“全球深渊探索计划(GHEP)”。
2026-06-01 09:54
6月1日,由工业和信息化部批准发布的《YD/T 6770—2026 人工智能 关键基础技术 具身智能基准测试方法》正式实施,标志着具身智能评测迈入“有标可依”的新阶段。不仅如此,《人形机器人 全生命周期管理规范》标准也于近期发布,通过“一机一码”,确保产品可进行全链条管理。
2026-06-01 09:54
1975年3月27日,远在大洋彼岸的杨振宁提笔给当时的复旦大学数学系教师谷超豪写了一封信。1975年9月,谷超豪、杨振宁联合署名,在《中国科学》上发表了论文《规范场理论的若干问题》。
2026-06-01 09:54
记者从农业农村部获悉,截至5月28日17时,各地已收夏粮小麦4897万亩、当日机收面积超过1000万亩,今年全国“三夏”大规模小麦机收全面展开。
2026-05-29 09:11
垦利10-2油田位于渤海南部海域,探明原油地质储量超1亿吨,是渤海湾盆地凹陷带浅层发现的首个亿吨级岩性油田。中国海油天津公司工程技术作业中心相关负责人介绍:“垦利10-2油田钻完井作业面临井型多、层系多、开发方式多等‘三多’难点。
2026-05-29 09:09
早上8时许,四川省南充市高坪区走马镇姜家祠村村民姜萧将孩子送到村委会“农忙托管班”。为解决农忙季小孩看护缺位问题,姜家祠村因地制宜开设季节性公益“农忙托管班”,为村内适龄儿童提供免费集中托管服务。
2026-05-29 09:06
中国卫星导航定位协会近日发布《2026中国北斗时空产业发展白皮书》。所谓“北斗时空产业”,是以北斗卫星导航系统为核心,深度融合遥感地理信息、移动通信等多种技术手段的综合性产业体系。
2026-05-29 09:02
据中国载人航天工程办公室消息,神舟二十一号和神舟二十三号航天员乘组于28日进行交接仪式,两个乘组移交了中国空间站的钥匙。
2026-05-29 08:52
  人工智能(AI)正以前所未有的速度重塑着教育形态。放眼全球,AI与教育深度融合已不是“未来时”,而是汹涌澎湃的“现在进行时”。在这场由硅基智慧引发的教育革命面前,世界各国都在“大显身手”,基于各自特有的文化背景、教育传统与国家发展战略定位,在“AI+教育”的实施路径上展现出“百花齐放”之势。
2026-05-28 02:10
  当前,我国科普阅读需求呈现出高意愿、高黏性、高集中度的特点。调研显示,成人科普图书核心读者以36岁以上成熟群体为主,占比达82%,女性读者占62%,绝大多数为本科学历以上,企业技术人员、教育科研工作者、都市职场人构成消费主力。超过六成读者每周阅读三次以上,近三分之一年均阅读10本以上,阅读稳定性显著高于其他大众图书。
2026-05-28 02:10
站在河北沧州南皮县乌马营镇徐和杨村的航丰家庭农场地头,放眼望去,成方连片的小麦已泛起嫩黄,一派“小满未满,将熟未熟”的景象。
2026-05-28 02:00
中国社会科学院考古研究所(中国历史研究院考古研究所)27日发布最新成果。2025年9月至今,考古研究所已出版考古报告13部,专著、学术资料、科普读物13部,图录、论文集、数据集8部,中英文顶级、权威期刊上的简报、论文30余篇,并积极建设实验室集刊平台。
2026-05-28 02:00
27日0时16分,我国在文昌航天发射场使用长征七号改运载火箭,成功将通信技术试验卫星二十四号发射升空,卫星顺利进入预定轨道,发射任务取得圆满成功。
2026-05-28 01:40
加载更多