点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:中国的“ChatGPT时刻”来临?
首页> 科技频道> 互联网 > 正文

中国的“ChatGPT时刻”来临?

来源:解放日报2025-01-28 11:01

  本报记者 查睿 裘雯涵

  1月26日—27日,短短两天内,国内AI创业公司DeepSeek(深度求索)遭遇两次短暂宕机,DeepSeek将其归因为新模型发布后导致访问量激增。

  新模型指的是刚发布的推理大模型DeepSeek-R1,由此带来的访问量有多大?27日,DeepSeek在苹果美区应用商店下载量力压ChatGPT,登顶免费App下载排行榜。

  2024年12月,DeepSeek发布新一代大语言模型V3,已引起行业不少讨论。1月20日发布的R1,将DeepSeek的热度推向了高潮。

  一年多时间内,DeepSeek成为大模型行业的“黑马”,是否意味着国内大模型迎来弯道超车的机会?

  硅谷都在谈论DeepSeek

  在硅谷,几乎每个人都在谈论DeepSeek。有报道称,硅谷“被吓坏了”,工程师正在疯狂分析DeepSeek。还有说法称,这是中国的“ChatGPT时刻”。

  DeepSeek究竟厉害在哪?高性能、低成本、开源是外界提到的高频词。

  舆论注意到,DeepSeek的推理计算效率极高,可以与业内一些顶尖的AI模型相媲美,与美国硅谷前沿发展保持同步。国外大模型排名榜单Arena最新测评显示,R1基准测试在全类别大模型中排名第三,其中在风格控制分类中与OpenAI o1并列第一,得分达到1357分,甚至略超OpenAI o1。这也几乎意味着,DeepSeek-R1跻身全球最强大模型之列。

  DeepSeek的官方测试也显示,R1在数学、代码、自然语言推理等任务上,性能比肩OpenAI o1正式版。在各自小参数版本的模型比拼中,R1-32B的数学推理明显优于o1-mini。

  加利福尼亚大学伯克利分校教授亚历克斯·迪马基评价,DeepSeek的技术路线揭示了达到顶尖性能未必需要天文数字投入,“这对硅谷的烧钱竞赛无异于釜底抽薪”。

  DeepSeek有多便宜?有数据显示,Deepseek V3的训练成本仅为558万美元,不足GPT-4o的二十分之一。推理模型R1的API(应用程序编程接口)服务定价为每百万tokens(词元)仅需1元(缓存命中)/4元(缓存未命中),每百万输出tokens为16元。大语言模型V3就更便宜了,每百万tokens仅需0.1元(缓存命中)/1元(缓存未命中),每百万输出tokens为2元。DeepSeek的定价约等于Llama 3-70B的七分之一,GPT-4 Turbo的七十分之一。

  开源是DeepSeek备受关注的另一个重要原因。这意味着它已经与其他企业和研究人员共享基础代码,其他人能用相同的技术构建和发布自己的产品。

  英伟达资深科学家吉姆·范称赞DeepSeek是“非美国公司践行OpenAI初心”的典范,通过开放技术细节和训练方法,为全球研究者赋能。

  出身国内算力最充足企业

  天眼查信息显示,DeepSeek背后的实控人是梁文锋,他所创立的幻方量化是国内知名的量化私募基金,这也给DeepSeek打下了良好的算力基础。

  不同于常规基金依赖基金经理,量化基金通过数量模型的计算寻找投资机会,因此对数据尤为敏感,高频交易更是离不开机器学习。为了从海量数据中挖掘投资机会,幻方量化早早开始囤积算力,先后斥资10亿元,在美国对芯片出口管制前购买了1万张英伟达A100型号GPU。机缘巧合下,幻方量化成为国内GPU算力最充足的企业之一。

  AI行业有条规模化法则,简单来说,就是算力越大、参数越多,训练出的大模型性能就越好。如果遵照这条规则,幻方量化的算力基础,成了DeepSeek最大的王牌之一。

  当然,光靠算力优势,DeepSeek显然无法与全球AI巨头抗衡。“DeepSeek爆火主要是创新的技术路线。”上海人工智能行业协会秘书长钟俊浩认为,架构机制、训练方法和管道并行算法等创新,展现了中国本土AI技术的潜力,颠覆了中国只是AI技术跟随者、应用方的传统认知。

  英国科技网站“生命科学”撰稿人本·特纳指出,美国限制向中企出口先进AI计算芯片,迫使DeepSeek-R1研发者采用更智能、更有效的算法,弥补计算能力的不足。ChatGPT据报道需要1万台英伟达的图像处理器处理训练数据,DeepSeek称仅用2000台图像处理器就取得了类似结果。

  DeepSeek公布的技术论文显示,R1在训练过程中实验了三种技术路径:直接强化学习、多阶段渐进训练和模型蒸馏,其中R1首次证明了直接强化学习的有效性。科技媒体在技术解读中打了个比方,面对同一道题目,大模型同时多次进行回答,系统将给每个答案打分,依照“高分奖励低分惩罚”的逻辑进行循环,最终得出更具优势的推理路径。

  中国“正在全力冲刺”

  “元”公司首席执行官扎克伯格日前在一档播客节目中坦言,DeepSeek技术非常先进。他表示,中国“正在全力冲刺”,担心这个开源模型会被全世界广泛使用,影响到美国科技行业的领先地位。

  一些美国专家也评论称,如果最好的开源技术来自中国,美国开发人员将在这些技术之上构建他们的系统,“从长远来看,这可能会让中国成为研发AI的中心”。

  在华盛顿州工作的技术专家阿尔文·王·格雷林认为,DeepSeek的进展显示,美国的领先优势正在缩小,各国应该采取合作方式建设先进AI,而不是在AI领域进行“军备竞赛”。

  在长文本交互和多模态的全球竞争中,国内大模型已经崭露头角,随着大模型推理能力的迭代,中国还有机会弯道超车。钟俊浩认为,高效利用计算资源、相对较低的成本,以及更高的市场活跃度,是国内训练推理大模型的优势所在。他表示,国内面临高端算力芯片紧缺的难题,但推理大模型能更集约利用有限的算力资源,同时国内算力基础设施较为完备,训练硬件成本较低。

  更重要的是,中国的人工智能市场处于开放竞争的状态,不仅有阿里、字节、商汤等大型AI厂商,还有阶跃星辰、MiniMax等高水平的AI创业企业。更多市场参与者,就有更多创新想法,意味着市场更活跃。

  此外,中国具有极强的政策引导能力。例如上海发布“模塑申城”实施方案,就进一步明确“5+6”应用场景,为人工智能企业在推理方面的应用拓宽了发展空间,加速其商业化进程。

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 光明的故事丨我为什么入党

  • 浙江嘉兴:学习传承红船精神迎“七一”

独家策划

推荐阅读
随着SpaceX上市,太空算力再度成为全球科技竞争新焦点。据报道,中国已推动12颗计算卫星实现在轨运行,它们是于2025年5月14日发射升空的全球首个太空计算卫星星座。抓住机遇、乘势而上,中国完全有底气在这场太空算力竞赛中,跑出自己的加速度。
2026-07-01 09:38
电动汽车还与人工智能、新型电力电子技术加速融合,推动车辆从传统交通工具向智能能源终端转变。面对旺盛市场需求,中国电动汽车凭借完整产业链、智能化优势及快速交付能力,正改写全球汽车市场格局,成为稳定全球供应链的关键力量。
2026-07-01 09:33
中国世赛焊接团队全力对标产业升级需求,将比赛成果转化为实际应用,积极探索技能人才成长成才的实践路径。依托10余年的积淀与科学化的集训机制,中国焊接世赛团队终于迎来突破时刻,先后斩获第41届世赛银牌、第42届世赛优胜奖,并在第43届赛事中勇夺该项目的首金。
2026-07-01 09:29
短短几年,林场里农家乐和民宿如雨后春笋般涌现,如今增加到40多家,形成了一条远近闻名的“溪水农家院一条街”。每天午后,我都会沿着林场整洁的步道溜达溜达,一路景色宜人,一路自在惬意。
2026-07-01 09:26
国家税务总局30日发布最新数据显示,今年1至5月份,我国具身智能产业发展向好,呈现多方面亮点。目前,全国近九成具身智能产业企业集中在广东、北京、上海、浙江、江苏,其余少量分布在辽宁、山东、陕西、安徽等10个省市。
2026-07-01 09:24
在6月27日举行的首届西部商业航天大会现场,陕西西安高新区管委会主任陈辉端着一台银灰色的火箭发动机模型走向发布台。“我们要实现星箭总体环节的突破,大力引进培育卫星总体、火箭总体企业,支持卫星智能制造工厂和商业火箭总装线建设。
2026-06-30 10:01
近日,“共和国勋章”获得者、我国著名水稻专家袁隆平相关话题上了热搜。袁隆平带领我国科研工作者,通过雄性不育遗传工具,攻克了利用杂种优势的世界性难题,创建了系统化、原创性的杂交水稻育种体系,开辟出利用水稻杂种优势的新道路,有力保障了国家粮食安全。
2026-06-30 10:01
国家能源局29日发布数据显示,今年1至5月,全国累计完成电力市场交易电量30573亿千瓦时,同比增长24.8%。1至5月,从交易范围看,省内交易电量24361亿千瓦时,同比增长28.5%;跨省跨区交易电量6212亿千瓦时,同比增长12.2%。
2026-06-30 10:01
教育、科技、人才是全面建设社会主义现代化国家的基础性、战略性支撑。在资源配置方面,需要强化规划衔接、政策协同,推动教育、科技、产业等多部门资源在人才培养这一共同目标下统筹配置。
2026-06-30 10:00
今年入夏以来,雷电、暴雨、大风等强对流天气轮番登场,其瞬间释放的破坏力令人心生畏惧。若身处人流密集区域,同行人不牵手,应立即进入安装有防雷装置的建筑物、金属车身的汽车等安全区域。
2026-06-30 10:00
美国核能初创企业Antares宣布,其在爱达荷国家实验室安装的小型模块化核反应堆“Mark-0”首次测试达到临界状态,成为特朗普政府发布加速核电发展行政命令以来,第一个突破这一门槛的新型反应堆设计。
2026-06-29 09:43
目前,油田油水井、站库的数字化覆盖率已分别超过97%和93%,物联网将油气生产的每一个末梢都纳入了智慧之网。
2026-06-29 09:41
中国共产党党员、中国工程院院士、著名金属材料专家、华中科技大学教授崔崑同志,因病医治无效,于2026年6月26日在武汉逝世,享年101岁。
2026-06-29 09:40
科学家成功把一束在纳米尺度下被高度囚禁的光,变成了一把能感知原子级形变的超级“尺子”,对材料内部埋藏的微小变形实现了无损探测。
2026-06-29 09:40
27日,国家重大科技基础设施“聚变堆主机关键系统综合研究设施”最大的超导部件——环向场磁体在安徽省合肥市完成最后制备工艺,并通过专家验收。
2026-06-29 09:37
当地时间24日,世界气象组织在日内瓦为中国工程院院士、中国气象局卫星气象专家许健民颁发第七十届国际气象组织奖,表彰他为天气预报、卫星气象事业以及气象业务服务作出的卓越贡献。
2026-06-26 09:28
来自英国伦敦国王学院与加拿大麦克马斯特大学衍生公司Block Biosciences等机构的科学家,正在研制一类靶向IMPDH2酶的候选药物。团队已设计并合成了数百种靶向IMPDH2的候选药物,正从中层层筛选最优化合物,力争尽快推向临床开发。
2026-06-26 09:26
6月25日,以“弘扬伟大抗疫精神 走好疾控新长征路”为主题的2026年“我和我的疾控故事”宣讲会在中国疾病预防控制中心举办。中国疾病预防控制中心性病艾滋病预防控制中心综合防治与政策室主任单多的故事,要从一双生了冻疮的手讲起。
2026-06-26 09:23
届链博会期间,贸促智库交流活动暨全球供应链报告与指数发布会在京举办。2018—2025年,促进指数、连接指数、创新指数、韧性指数均呈上行态势,表明全球供应链继续朝着更具韧性、更有效率、更富活力的方向发展。
2026-06-26 09:20
需要看到,保护耕地是推进乡村全面振兴、建设宜居宜业和美乡村的重要组成部分,广大农民是保护耕地的重要行动主体。
2026-06-26 09:19
加载更多