点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:“科技春晚”放大招,这届机器人有自己的“GPT”了
首页> 科技频道> 创新创业 > 正文

“科技春晚”放大招,这届机器人有自己的“GPT”了

来源:光明网2025-01-13 16:24

  如果2024年是“AI元年”,那么2025年,AI技术将迎来怎样的变化?

  一年一度的“科技春晚”每年1月如期而至。作为全球最大、影响最广的消费类电子技术年展,今年的国际消费类电子产品展览会(简称CES)上“爆款”频出,其中英伟达发布的“NVIDIA Cosmos”作为首个世界基础模型更是格外吸睛。创始人黄仁勋表示,AI的下一个前沿就是物理AI(Physical AI)。“如果说ChatGPT定义了生成式AI,那么Cosmos将是机器人领域的‘ChatGPT时代’。”

“科技春晚”放大招,这届机器人有自己的“GPT”了

  世界基础模型将对哪些领域产生重要影响?对企业而言,如何运用AI技术真正创造商业价值?

  本期“视界”,小管邀请到复旦管院信息管理与商业智能系助理教授李文文分享对大模型升级、机器人技术革新及其商业应用的行业观察与思考。

“科技春晚”放大招,这届机器人有自己的“GPT”了

  李文文信息管理与商业智能系助理教授

  研究方向:商务智能,机器学习,医疗健康管理,平台管理

  01创造一个虚拟世界,让AI更了解“真实”

  “世界基础模型”利用生成式AI技术,模拟现实环境并基于文本、图像或视频输入预测准确结果。与利用大量文本数据进行训练的大语言模型不同,世界模型利用包括文本、图像和视频在内的输入数据来生成视频。通过从感官数据中学习表示和预测运动、力和空间关系等动态特性,它们能够理解物理世界中事物的性质、运行规律和空间特性。

  世界基础模型的作用并不是生成创意内容,而是帮助AI理解物理世界。例如,它能帮助AI理解物体如苹果受重力影响会掉落等基本物理规律,这种能力对于机器在物理世界中的交互非常重要。这项技术面向大众开放以后,每个开发者都可能有机会开发为下游应用或特定领域构建世界模型,例如工厂车间、仓库或高速公路,进而训练具有特定能力的机器人。

“科技春晚”放大招,这届机器人有自己的“GPT”了

  从英伟达目前已公开的信息来看,Cosmos模型基于在200万小时视频上完成训练,集成了生成式模型、tokenizer和视频处理管线,可以接受文本、图像或视频提示,生成高质量的虚拟世界状态,从而为自动驾驶和机器人应用提供定制化的视频输出。

“科技春晚”放大招,这届机器人有自己的“GPT”了

  在为训练机器人而生成的虚拟世界里,能够看到Comos模型可以生成工厂、仓库等环境,从而协助开发、训练机器人。例如,现实中,如果要使用真实的大型仓储环境为仓储机器人提供货物搬运、拣选、分拣等训练,需要花费大量成本,而通过Cosmos,就可以创建模拟的物理仓储环境,从而训练、观察、优化机器人的各种动作。

  02让自动驾驶真正“像人一样”开车

  实际上,世界模型的概念很早就已经提出。图灵奖得主杨立昆就认为,未来的人工智能发展方向, 应该是通过无监督的方式观察世界、与世界交互,然后进行学习,这条技术路线是GPT这样的大语言模型所不能实现的,我们需要训练的是世界模型。

  例如,原先让AI学会开车,需要投喂大量的开车视频让AI学习,类似于“题库刷题”,但人类在驾车时会遇到很多没有学过的状况,例如雪天路滑、前车追尾、人会下意识做出避让反应,无监督式的学习就是要让AI像现实里的人类一样,在世界模型里观察世界,然后行动,在这个过程中学会应对未知的状况。

  关于如何达到L4等级的高度自动驾驶技术,自动驾驶领域一直有着技术路线之争,世界模型的出现带来了新的方向。目前较为成熟的技术方案是使用激光雷达以及其他传感器来让汽车感知周围事物,成本比较高。

“科技春晚”放大招,这届机器人有自己的“GPT”了

  特斯拉最新提出的理念是采用“端到端”技术,基于摄像头所看到的环境进行实时判断,从而决定车辆行驶的路线、进行一系列驾驶操作等。小马智行则认为,首先需要一个世界模型去构造一个虚拟环境,包含各种道路情况,行人以及其他车辆的行为。然后让自动驾驶模型在这个环境中进行训练,就像人类一样去观察路况,通过强化学习去不断进化迭代,并应对可能发生的各种状况。Cosmo正好能够为这类技术路线提供世界基础模型的支持。

  但是现在Comos开放的测试环境有限,目前平台能够生成的虚拟世界还存在不少漏洞。例如,生成的自动驾驶测试环境里,路人的形象很模糊,前方会突然出现违背正常规律的车辆等,平台还有待进一步升级优化。

  03没有技术嗅觉,玩不转AI时代

  如果从商业应用角度来看AI技术,我们需要思考当前的大模型技术仅仅是昙花一现,还是可以在商业层面发挥实际作用,这也是许多企业面临的关键问题。

  在ChatGPT面世之前,大众对于人工智能的理解较为有限,通常局限于执行一些基础的智能化任务。然而,当GPT等产品推出之后,极大地激发了大众的想象力与需求。Sora的文生视频技术更是模糊了现实与虚拟的界限,开始将物理世界置于模拟器之中。

  但这些技术目前在商业上还没有取得显著成功,甚至Open AI本身也没有实现盈利。所以,无论是科技创新型公司还是大型企业,对他们的领导者而言,未来他们必须拥有一项综合技术与商业思维的新技能,我将其命名为“技术嗅觉”。

“科技春晚”放大招,这届机器人有自己的“GPT”了

  “技术嗅觉”是一个全新的概念,也是我认为在AI时代对管理者而言非常重要的概念。

  所谓技术嗅觉,就是将技术理解与市场洞察相结合的一种能力。这种能力不仅仅是指技术人员的专业技能,也不只是纯商业活动的一部分,它要求对技术的发展有一定理解,即便不是技术或科研人员,也需要知道技术能够解决什么问题。与此同时,还需要对市场需求有敏锐的洞察,了解用户真正需要的是什么,以及市场的发展趋势如何。最终,技术嗅觉可以帮助识别商业化机会。

  一个常见的决策场景是在技术发展的不同阶段,企业需要考虑切入的时机。例如,新技术刚刚出现时,企业是否应该立刻引入,还是等到技术成熟后再采纳,这需要权衡。企业应该根据自身定位,选择不同的切入时机和介入深度。

“科技春晚”放大招,这届机器人有自己的“GPT”了

  所有这些决策需要结合技术嗅觉,不仅依赖传统的商业嗅觉,这种综合能力是现代企业在动荡的技术环境中做出最佳决策的基础。从这点上说,在自动驾驶汽车、机器人技术发展日益蓬勃的当下,英伟达推出Cosmos模型也是一种技术嗅觉的体现。

  关于未来,有专家预测2025年将是“具身智能体元年”。“具身智能体”概念是人工智能落地化的重要一步,其核心不再仅仅是对话式的大型语言模型,而能够调用外部工具,如搜索引擎、知识图谱、思维导图工具等,进而执行更复杂的任务。

  这一变革将使得大型语言模型不再局限于生成自然语言,而是在行动上,尤其是在机器人领域实现更广泛的应用与实践。世界基础模型的出现和后续迭代升级,将对具身智能发展产生怎样的影响,非常值得期待。

  (来源:复旦管院 文字:傅文婧 编辑:王菲妮 图片:李文文老师、NVIDIA官网、部分由AI生成)

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 人民子弟兵帮助受灾群众尽快重建家园

  • “蛇”相关馆藏文物亮相三峡博物馆

独家策划

推荐阅读
近日,深空产业协同创新联盟成立大会暨第一届深空产业论坛在安徽合肥高新区举办,标志着深空探测产业化进程迈出坚实一步。此次活动的举办,也是合肥高新区着力发展未来产业的生动注脚。
2025-01-14 10:03
2025年,人工智能究竟将如何发展?哪些领域会诞生新的消费场景?我们又可以如何拥抱变化?
2025-01-14 09:56
为进一步加大对创新药的支持力度,国家医保局将研究出台一系列政策举措,包括拓宽创新药支付渠道、探索建立丙类药品目录等。
2025-01-14 09:42
13日从自然资源部中国地质调查局获悉,我国新一轮找矿突破战略行动实施以来,该局联合湖北省人民政府开展鄂西北竹山—竹溪地区庙垭超大型铌-稀土矿综合利用技术攻关,成功攻克铌资源高效利用关键核心技术,将盘活铌资源92.9万吨,实现庙垭超大型铌-稀土矿床的经济利用。
2025-01-14 09:41
捷龙三号运载火箭是一型四级固体运载火箭,由中国航天科技集团一院抓总研制,主要是为针对商业航天发射任务而研制,它可以兼顾海上和陆上发射。
2025-01-14 09:39
国产化“中农科·龙腾”饲料配方工业软件近日在北京发布。饲料研究所研发团队利用长期积累的科研成果,研发出饲料原料加工特性数据库、水产饲料营养数据库和反刍动物饲料营养数据库。
2025-01-13 09:40
业内人士提醒,开窗通风换气是最简单且经济的方法,通过增加室外的新鲜空气量,将含有甲醛的空气排到室外,可以快速降低室内甲醛浓度。
2025-01-13 09:15
习近平总书记指出:“中国高度重视人工智能发展,积极推动互联网、大数据、人工智能和实体经济深度融合,培育壮大智能产业,加快发展新质生产力,为高质量发展提供新动能。随着技术不断成熟与应用场景不断拓展,我国人工智能正朝着深度融合与创新驱动的方向稳步前进,为全球智能经济发展贡献中国智慧。
2025-01-13 09:39
数据作为新型生产要素,是发展新质生产力的关键力量。为发挥投资引领带动作用,将加力推进中央预算内投资,条块结合深入实施数字化转型工程,加快国家数据基础设施建设。
2025-01-13 09:21
不只是青年骨干,学术荣誉体系设计了从讲席教授、杰出讲席教授、资深讲席教授到荣誉讲席教授的荣誉晋升和激励机制,让有所成就的科技人才不甘于躺在“功劳簿”上。
2025-01-13 09:13
发布和定期更新全面、准确、透明的国家温室气体排放因子数据库,是建立统一、规范碳排放核算体系的重要基础。
2025-01-13 09:12
国家癌症中心研究团队通过对全球胃癌流行病学进行系统分析,发现早发性胃癌呈上升趋势,年轻人群的患病风险日益增加。这一疾病模式的转变对全球胃癌防控策略提出了新挑战。
2025-01-10 09:25
9日,记者从中北大学获悉,该校孙友谊教授团队利用胶体化学体积排斥作用,并结合二维片状纳米材料剥离新方法,实现了石墨烯高效宏量制备。相关成果日前发表在《自然·通讯》上。
2025-01-10 09:21
2024年,气象部门共建成27个国家气候观象台和8个国家大气本底站,实现气候关键区全覆盖;累计建成7.6万余个地面自动气象观测站,实现全国乡镇全覆盖,地面站网布局不断优化。
2025-01-10 09:15
天津大学教授胡文平、王雨、吴煌与诺贝尔奖得主詹姆斯·弗雷泽·司徒塔特教授合作撰写的论文《动态超分子扭棱立方体》1月9日在学术期刊《自然》上发表,文章介绍了他们在光电功能的手性阿基米德多面体的构筑上取得的最新研究成果。
2025-01-10 09:14
9日,中国地质大学(武汉)地球科学学院教授陈春飞携手长江大学教授刘勇胜、澳大利亚麦考瑞大学教授斯蒂芬·福利等科学家,在《自然》杂志上发表研究论文。
2025-01-10 09:13
中国科学院合肥物质科学研究院医用光谱质谱研究团队发展多培养基方法,研究并获得了肺癌细胞可重复的特征挥发性有机物,有望用于肺癌闻诊新技术开发。
2025-01-09 10:19
大模型通常具有高度的通用性和广泛的适用性,已经在自然语言处理、图像识别和语音识别等众多领域大放异彩。
2025-01-09 10:10
在新一轮找矿突破战略行动的推动下,该局联合各省地勘单位和矿业企业,于全国范围内展开找矿集中攻坚行动,在四川、新疆、青海、江西、内蒙古等地取得一系列重大突破,锂辉石型、盐湖型、锂云母型锂矿新增资源量均超千万吨,使我国锂矿储量全球占比从6%提升至16.5%,排名从世界第六位跃升至第二位。
2025-01-09 03:10
《自然》1月9日发表的一项研究评估了淡水动物群的灭绝风险,涵盖了2.3万多个物种,发现被研究物种中约24%面临灭绝风险。
2025-01-09 09:59
加载更多