点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:中国的“ChatGPT时刻”来临?
首页> 科技频道> 互联网 > 正文

中国的“ChatGPT时刻”来临?

来源:解放日报2025-01-28 11:01

  本报记者 查睿 裘雯涵

  1月26日—27日,短短两天内,国内AI创业公司DeepSeek(深度求索)遭遇两次短暂宕机,DeepSeek将其归因为新模型发布后导致访问量激增。

  新模型指的是刚发布的推理大模型DeepSeek-R1,由此带来的访问量有多大?27日,DeepSeek在苹果美区应用商店下载量力压ChatGPT,登顶免费App下载排行榜。

  2024年12月,DeepSeek发布新一代大语言模型V3,已引起行业不少讨论。1月20日发布的R1,将DeepSeek的热度推向了高潮。

  一年多时间内,DeepSeek成为大模型行业的“黑马”,是否意味着国内大模型迎来弯道超车的机会?

  硅谷都在谈论DeepSeek

  在硅谷,几乎每个人都在谈论DeepSeek。有报道称,硅谷“被吓坏了”,工程师正在疯狂分析DeepSeek。还有说法称,这是中国的“ChatGPT时刻”。

  DeepSeek究竟厉害在哪?高性能、低成本、开源是外界提到的高频词。

  舆论注意到,DeepSeek的推理计算效率极高,可以与业内一些顶尖的AI模型相媲美,与美国硅谷前沿发展保持同步。国外大模型排名榜单Arena最新测评显示,R1基准测试在全类别大模型中排名第三,其中在风格控制分类中与OpenAI o1并列第一,得分达到1357分,甚至略超OpenAI o1。这也几乎意味着,DeepSeek-R1跻身全球最强大模型之列。

  DeepSeek的官方测试也显示,R1在数学、代码、自然语言推理等任务上,性能比肩OpenAI o1正式版。在各自小参数版本的模型比拼中,R1-32B的数学推理明显优于o1-mini。

  加利福尼亚大学伯克利分校教授亚历克斯·迪马基评价,DeepSeek的技术路线揭示了达到顶尖性能未必需要天文数字投入,“这对硅谷的烧钱竞赛无异于釜底抽薪”。

  DeepSeek有多便宜?有数据显示,Deepseek V3的训练成本仅为558万美元,不足GPT-4o的二十分之一。推理模型R1的API(应用程序编程接口)服务定价为每百万tokens(词元)仅需1元(缓存命中)/4元(缓存未命中),每百万输出tokens为16元。大语言模型V3就更便宜了,每百万tokens仅需0.1元(缓存命中)/1元(缓存未命中),每百万输出tokens为2元。DeepSeek的定价约等于Llama 3-70B的七分之一,GPT-4 Turbo的七十分之一。

  开源是DeepSeek备受关注的另一个重要原因。这意味着它已经与其他企业和研究人员共享基础代码,其他人能用相同的技术构建和发布自己的产品。

  英伟达资深科学家吉姆·范称赞DeepSeek是“非美国公司践行OpenAI初心”的典范,通过开放技术细节和训练方法,为全球研究者赋能。

  出身国内算力最充足企业

  天眼查信息显示,DeepSeek背后的实控人是梁文锋,他所创立的幻方量化是国内知名的量化私募基金,这也给DeepSeek打下了良好的算力基础。

  不同于常规基金依赖基金经理,量化基金通过数量模型的计算寻找投资机会,因此对数据尤为敏感,高频交易更是离不开机器学习。为了从海量数据中挖掘投资机会,幻方量化早早开始囤积算力,先后斥资10亿元,在美国对芯片出口管制前购买了1万张英伟达A100型号GPU。机缘巧合下,幻方量化成为国内GPU算力最充足的企业之一。

  AI行业有条规模化法则,简单来说,就是算力越大、参数越多,训练出的大模型性能就越好。如果遵照这条规则,幻方量化的算力基础,成了DeepSeek最大的王牌之一。

  当然,光靠算力优势,DeepSeek显然无法与全球AI巨头抗衡。“DeepSeek爆火主要是创新的技术路线。”上海人工智能行业协会秘书长钟俊浩认为,架构机制、训练方法和管道并行算法等创新,展现了中国本土AI技术的潜力,颠覆了中国只是AI技术跟随者、应用方的传统认知。

  英国科技网站“生命科学”撰稿人本·特纳指出,美国限制向中企出口先进AI计算芯片,迫使DeepSeek-R1研发者采用更智能、更有效的算法,弥补计算能力的不足。ChatGPT据报道需要1万台英伟达的图像处理器处理训练数据,DeepSeek称仅用2000台图像处理器就取得了类似结果。

  DeepSeek公布的技术论文显示,R1在训练过程中实验了三种技术路径:直接强化学习、多阶段渐进训练和模型蒸馏,其中R1首次证明了直接强化学习的有效性。科技媒体在技术解读中打了个比方,面对同一道题目,大模型同时多次进行回答,系统将给每个答案打分,依照“高分奖励低分惩罚”的逻辑进行循环,最终得出更具优势的推理路径。

  中国“正在全力冲刺”

  “元”公司首席执行官扎克伯格日前在一档播客节目中坦言,DeepSeek技术非常先进。他表示,中国“正在全力冲刺”,担心这个开源模型会被全世界广泛使用,影响到美国科技行业的领先地位。

  一些美国专家也评论称,如果最好的开源技术来自中国,美国开发人员将在这些技术之上构建他们的系统,“从长远来看,这可能会让中国成为研发AI的中心”。

  在华盛顿州工作的技术专家阿尔文·王·格雷林认为,DeepSeek的进展显示,美国的领先优势正在缩小,各国应该采取合作方式建设先进AI,而不是在AI领域进行“军备竞赛”。

  在长文本交互和多模态的全球竞争中,国内大模型已经崭露头角,随着大模型推理能力的迭代,中国还有机会弯道超车。钟俊浩认为,高效利用计算资源、相对较低的成本,以及更高的市场活跃度,是国内训练推理大模型的优势所在。他表示,国内面临高端算力芯片紧缺的难题,但推理大模型能更集约利用有限的算力资源,同时国内算力基础设施较为完备,训练硬件成本较低。

  更重要的是,中国的人工智能市场处于开放竞争的状态,不仅有阿里、字节、商汤等大型AI厂商,还有阶跃星辰、MiniMax等高水平的AI创业企业。更多市场参与者,就有更多创新想法,意味着市场更活跃。

  此外,中国具有极强的政策引导能力。例如上海发布“模塑申城”实施方案,就进一步明确“5+6”应用场景,为人工智能企业在推理方面的应用拓宽了发展空间,加速其商业化进程。

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 坚守岗位过除夕

  • 走近春节,从一枚入境章开始

独家策划

推荐阅读
近期,我国“天关”卫星(爱因斯坦探针卫星)观测到一例伽马暴EP240315a,这是首次探测到宇宙早期爆发现象的软X射线信号,将为开展早期宇宙相关研究开启一扇新窗口。1月23日,相关成果论文在国际学术期刊《自然·天文》在线发表。
2025-01-27 09:44
日前,由机器人天工、天轶、小柒与现场主持人共同发布的,以“畅享科技 乐酷亦庄”为主题的北京经济技术开发区2025年文商旅体发布活动,在北京智慧融媒创新中心举办。
2025-01-27 09:35
近年来,我国种业快步发展。从种子生产到App订单运输、催芽厂催芽作业、智能秧棚育秧、轨道车运输、智能驾驶插秧、田间水肥管理、App订单驾驶收获,我国已经形成科技范十足的种子生产链条,跑出独具中国特色的农业科技创新“加速度”。
2025-01-27 09:34
乙巳蛇年将至,国家自然博物馆“灵蛇献瑞——2025乙巳蛇年生肖文物大联展”和升级焕新的基本陈列“脊椎动物的崛起”向公众开放,不少大朋友和小朋友在浓浓的年味中迎来一场科普之旅。
2025-01-27 09:34
车辆扎进山体,穿过17.5公里长的锦屏山隧道后,周遭终于从昏暗变得明亮,一座“地下城”出现在眼前——这里是中国锦屏地下实验室(以下简称“锦屏地下实验室”)二期。
2025-01-27 09:27
快过年了,当很多人渐渐放下手头工作时,团队河南安阳育种站负责人阎俊研究员和往常一样出门了,目的地依然是他熟悉的育种田。
2025-01-26 09:19
1月25日,国家林草种质资源设施保存库雄安库开工建设,标志着我国林草种质资源设施保存体系基本形成,对于全面提升我国林草种质资源保护利用水平和林草种业整体水平具有重大意义。
2025-01-26 09:17
北京大学物理学院量子材料科学中心王健团队与合作者展开研究,成功制备出铜氧化物高温超导体薄片器件,并在其中观测到零磁场下工作温度可达72开尔文的高温超导二极管效应。
2025-01-26 09:17
修复后的影片不仅没有划痕、噪点等老电影身上常见的“毛病”,而且质量比原片高很多,比如没有了威亚,色彩更亮,非常符合如今观众的观看习惯。
2025-01-26 09:16
110万吨!这是“中麦578”2024年的订单收购量。要知道,2024年全国小麦总产量是14010万吨,以此对比,“中麦578”的订单量相当于全国小麦产量的1/140。能取得这样的成绩,我特别自豪!
2025-01-26 09:15
国家统计局最新数据显示,2024年,我国全社会研究与试验发展(R&D)经费投入总量超过3.6万亿元,比上年增长8.3%,实现稳定增长,投入总量稳居世界第二位。
2025-01-24 10:01
“我们种植的是‘捷麦19’‘沧麦6002’,最高亩产已超过300公斤。”后仙庄村党支部副书记刘玉锁说,“‘春天白茫茫,夏天雨汪汪,十年九不收,糠菜半年粮。’这首民谣道尽了我们过去在盐碱地里种粮的艰难。如今,科技引领让‘盐碱滩’蝶变‘米粮川’。”
2025-01-24 10:00
记者从国家统计局获悉:2024年,我国全社会研究与试验发展(R&D)经费投入为36130亿元,同比增长8.3%。我国支持科技创新的政策体系不断完善,多元化投入格局加快构建,企业科技创新主体地位不断增强,为研发经费持续增长提供了有力支撑。
2025-01-24 09:58
在禁食或运动期间,免疫细胞(红色)迁移至胰腺并刺激产生胰高血糖素的细胞(橙色)来调节血糖,其中细胞核以蓝色显示。这表明免疫细胞不仅是抵御威胁的“战士”,还能像应急响应人员一样,在必要时介入确保机体的能量供给。
2025-01-24 09:58
1月14日,上海豫园灯会蛇年吉祥灯笼成网红文创伴手礼,其可爱的造型吸引众多游客购买。在十二生肖中,很少有谁拥有同蛇一样复杂的象征意味,兼具毁誉参半的双重文化色彩。秦汉以后,我们祖先对蛇的热情也并未减少,但属于蛇的正面形象的意蕴更多地被投射到龙身上。
2025-01-24 09:58
冰岛基因解码公司科学家完成了一项重要研究。他们绘制了一份人类基因组完整改组图谱,即详尽的人类DNA在生殖过程中混合方式的地图。
2025-01-23 10:19
考古人员在位于湖南省常德市澧县城头山镇的李家岗遗址,发现彭头山文化时期“古稻田”遗迹,这将长江中游早期稻田的出现时间提早到距今8000多年。
2025-01-23 10:14
日前国际学术期刊《大气科学进展》上发布2024年全球海温变化研究报告:2024年全球海表平均温度、海洋上层2000米热含量再一次达到了人类有观测记录以来的最高值。
2025-01-23 10:09
日前,新疆农业大学科研人员李德强所在的研发团队研发出一种新型可注射水凝胶,并将其用于抗癌药物的负载,可显著降低药物副作用。
2025-01-23 10:10
呼吁更多的人转变观念,认识到从“能用”到“多用”再到“好用”的国内装备自主可控,对于面临复杂多变的国际环境意义重大。
2025-01-23 09:59
加载更多