点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:中国的“ChatGPT时刻”来临?
首页> 科技频道> 互联网 > 正文

中国的“ChatGPT时刻”来临?

来源:解放日报2025-01-28 11:01

  本报记者 查睿 裘雯涵

  1月26日—27日,短短两天内,国内AI创业公司DeepSeek(深度求索)遭遇两次短暂宕机,DeepSeek将其归因为新模型发布后导致访问量激增。

  新模型指的是刚发布的推理大模型DeepSeek-R1,由此带来的访问量有多大?27日,DeepSeek在苹果美区应用商店下载量力压ChatGPT,登顶免费App下载排行榜。

  2024年12月,DeepSeek发布新一代大语言模型V3,已引起行业不少讨论。1月20日发布的R1,将DeepSeek的热度推向了高潮。

  一年多时间内,DeepSeek成为大模型行业的“黑马”,是否意味着国内大模型迎来弯道超车的机会?

  硅谷都在谈论DeepSeek

  在硅谷,几乎每个人都在谈论DeepSeek。有报道称,硅谷“被吓坏了”,工程师正在疯狂分析DeepSeek。还有说法称,这是中国的“ChatGPT时刻”。

  DeepSeek究竟厉害在哪?高性能、低成本、开源是外界提到的高频词。

  舆论注意到,DeepSeek的推理计算效率极高,可以与业内一些顶尖的AI模型相媲美,与美国硅谷前沿发展保持同步。国外大模型排名榜单Arena最新测评显示,R1基准测试在全类别大模型中排名第三,其中在风格控制分类中与OpenAI o1并列第一,得分达到1357分,甚至略超OpenAI o1。这也几乎意味着,DeepSeek-R1跻身全球最强大模型之列。

  DeepSeek的官方测试也显示,R1在数学、代码、自然语言推理等任务上,性能比肩OpenAI o1正式版。在各自小参数版本的模型比拼中,R1-32B的数学推理明显优于o1-mini。

  加利福尼亚大学伯克利分校教授亚历克斯·迪马基评价,DeepSeek的技术路线揭示了达到顶尖性能未必需要天文数字投入,“这对硅谷的烧钱竞赛无异于釜底抽薪”。

  DeepSeek有多便宜?有数据显示,Deepseek V3的训练成本仅为558万美元,不足GPT-4o的二十分之一。推理模型R1的API(应用程序编程接口)服务定价为每百万tokens(词元)仅需1元(缓存命中)/4元(缓存未命中),每百万输出tokens为16元。大语言模型V3就更便宜了,每百万tokens仅需0.1元(缓存命中)/1元(缓存未命中),每百万输出tokens为2元。DeepSeek的定价约等于Llama 3-70B的七分之一,GPT-4 Turbo的七十分之一。

  开源是DeepSeek备受关注的另一个重要原因。这意味着它已经与其他企业和研究人员共享基础代码,其他人能用相同的技术构建和发布自己的产品。

  英伟达资深科学家吉姆·范称赞DeepSeek是“非美国公司践行OpenAI初心”的典范,通过开放技术细节和训练方法,为全球研究者赋能。

  出身国内算力最充足企业

  天眼查信息显示,DeepSeek背后的实控人是梁文锋,他所创立的幻方量化是国内知名的量化私募基金,这也给DeepSeek打下了良好的算力基础。

  不同于常规基金依赖基金经理,量化基金通过数量模型的计算寻找投资机会,因此对数据尤为敏感,高频交易更是离不开机器学习。为了从海量数据中挖掘投资机会,幻方量化早早开始囤积算力,先后斥资10亿元,在美国对芯片出口管制前购买了1万张英伟达A100型号GPU。机缘巧合下,幻方量化成为国内GPU算力最充足的企业之一。

  AI行业有条规模化法则,简单来说,就是算力越大、参数越多,训练出的大模型性能就越好。如果遵照这条规则,幻方量化的算力基础,成了DeepSeek最大的王牌之一。

  当然,光靠算力优势,DeepSeek显然无法与全球AI巨头抗衡。“DeepSeek爆火主要是创新的技术路线。”上海人工智能行业协会秘书长钟俊浩认为,架构机制、训练方法和管道并行算法等创新,展现了中国本土AI技术的潜力,颠覆了中国只是AI技术跟随者、应用方的传统认知。

  英国科技网站“生命科学”撰稿人本·特纳指出,美国限制向中企出口先进AI计算芯片,迫使DeepSeek-R1研发者采用更智能、更有效的算法,弥补计算能力的不足。ChatGPT据报道需要1万台英伟达的图像处理器处理训练数据,DeepSeek称仅用2000台图像处理器就取得了类似结果。

  DeepSeek公布的技术论文显示,R1在训练过程中实验了三种技术路径:直接强化学习、多阶段渐进训练和模型蒸馏,其中R1首次证明了直接强化学习的有效性。科技媒体在技术解读中打了个比方,面对同一道题目,大模型同时多次进行回答,系统将给每个答案打分,依照“高分奖励低分惩罚”的逻辑进行循环,最终得出更具优势的推理路径。

  中国“正在全力冲刺”

  “元”公司首席执行官扎克伯格日前在一档播客节目中坦言,DeepSeek技术非常先进。他表示,中国“正在全力冲刺”,担心这个开源模型会被全世界广泛使用,影响到美国科技行业的领先地位。

  一些美国专家也评论称,如果最好的开源技术来自中国,美国开发人员将在这些技术之上构建他们的系统,“从长远来看,这可能会让中国成为研发AI的中心”。

  在华盛顿州工作的技术专家阿尔文·王·格雷林认为,DeepSeek的进展显示,美国的领先优势正在缩小,各国应该采取合作方式建设先进AI,而不是在AI领域进行“军备竞赛”。

  在长文本交互和多模态的全球竞争中,国内大模型已经崭露头角,随着大模型推理能力的迭代,中国还有机会弯道超车。钟俊浩认为,高效利用计算资源、相对较低的成本,以及更高的市场活跃度,是国内训练推理大模型的优势所在。他表示,国内面临高端算力芯片紧缺的难题,但推理大模型能更集约利用有限的算力资源,同时国内算力基础设施较为完备,训练硬件成本较低。

  更重要的是,中国的人工智能市场处于开放竞争的状态,不仅有阿里、字节、商汤等大型AI厂商,还有阶跃星辰、MiniMax等高水平的AI创业企业。更多市场参与者,就有更多创新想法,意味着市场更活跃。

  此外,中国具有极强的政策引导能力。例如上海发布“模塑申城”实施方案,就进一步明确“5+6”应用场景,为人工智能企业在推理方面的应用拓宽了发展空间,加速其商业化进程。

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 河南淅川:千年古刹藏山林

  • 第二十九届成都国际汽车展开幕

独家策划

推荐阅读
2013年,东正光学的创始团队在广东深圳租下第一间厂房。4年后,当工业光学与电影影像的积累具备向更广泛创作者群体转化的条件时,东正光学重返消费市场,推出Thypoch(叙)品牌。
2026-08-21 07:20
7月17日,习近平主席在2026世界人工智能大会暨人工智能全球治理高级别会议开幕式上发表题为《携手构建公正合理的全球人工智能治理体系》的主旨讲话。
2026-08-21 02:00
近期,因冬季寒区试车而闻名的边疆小城——黑龙江黑河迎来了反季节试车热潮。在试运行的全球规模最大四季低温汽车试验场内,零下30摄氏度的室内一片冰天雪地,来自多个车企与零部件厂商的测试车辆正自如驰骋,借助静态低温舱、冰雪圆环、多角度对开坡道等专业场景展开性能测试。
2026-08-21 03:40
最新统计数据显示,截至2026年7月底,江苏省光伏发电累计装机容量突破1亿千瓦,占全省电力总装机的比重超38%,成为全省第一大电源。图为8月19日,在扬州市邗江区公道镇,电力运维工人在检查渔光互补发电设备运行情况。
2026-08-21 03:40
近期,南华大学核科学技术学院韦悦周教授团队从稀土矿渣中直接分离得到高纯度的阿尔法核素铅-212及其前体核素钍-228,并成功实现了单批次从公斤级稀土矿渣中分离提取158微居里的铅-212/铋-212。
2026-08-21 03:50
近日,中国科学院海洋研究所联合美国加州大学圣巴巴拉分校等机构,在南极冰盖近期质量变化的气候驱动机制研究方面取得重要进展。研究发现,2021—2023年热带暖池持续增暖激发向南极传播的罗斯贝波列,形成东南极南北向偶极环流,重组水汽输送并增强区域降雪,从而暂时减缓了南极冰盖质量损失。
2026-08-21 03:50
习近平总书记在国家科学技术奖励大会、两院院士大会、中国科协第十一次全国代表大会上的讲话中指出,我国正从全球科技参与者、贡献者向开拓者、引领者加速转变,成为创新力上升最快的国家之一。
2026-08-20 02:10
中国信息通信研究院18日发布的《具身智能训练场研究报告(2026年)》显示,随着各部门密集部署人形机器人中试基地和训练场建设,我国具身智能训练场已经成为关键基础设施,形成规模化集群化布局。
2026-08-20 02:10
19日,朱雀三号遥二运载火箭在东风商业航天创新试验区发射升空。火箭一子级按预定程序成功软着陆于甘肃省民勤县朱雀三号着陆场坪,二子级将搭载的鸿鹄03星顺利送入预定轨道,飞行试验任务取得圆满成功,为后续开展回收箭体检修维护、复用飞行和商业化应用奠定基础。本次任务是继7月10日长征十号乙运载火箭一子级海上网系成功回收后,我国首次成功实施重复使用运载火箭一子级着陆腿方式陆地可控回收,标志着我国重复使用火箭技术取得重大突破。
2026-08-20 04:00
19日从中国科学技术协会了解到,为大力弘扬科学精神,营造风清气正的学术生态,加快建设世界一流科技期刊,中国科技期刊卓越行动计划(以下简称“卓越计划”)入选期刊及集群共同倡议“恪守科研诚信和学术道德”。
2026-08-20 04:00
近几个月来,北京大模型捷报频传:Kimi K3发布当前最大开源模型,综合智能水平直逼国际两大尖端闭源模型;小米MiMo-V2.5在通用图形处理器上实现推理速度大幅突破,并登顶全球多模型聚合平台公布的大模型调用量榜首;字节跳动发布新一代视频生成模型Seedance 2.5,在生成时长、多模态理解、编辑精度等维度实现全面升级。
2026-08-20 04:00
“或为近150年最强”“或为自1951年以来最强气候事件”……最近,关于2026年形成超强厄尔尼诺的新闻很受关注。预计赤道中东太平洋海表温度将继续维持波动上升态势,于今年11月至12月前后达到本次事件峰值。
2026-08-19 09:51
宁夏平原,黄河水沿着叶脉般的渠道淌进田间。”  青铜峡灌区是全国6个特大型灌区之一,是世界灌溉工程遗产宁夏引黄古灌区的重要组成部分。”  完成全域一体的信息化建设,这是青铜峡灌区从“治水”走向“智水”的关键一步。
2026-08-19 09:46
直面现实困境,1989年青海省委作出“绿化南北两山,改善西宁生态环境”的战略决策,西宁市积极响应。18年间,他在山上劳动超3000天,带领群众栽种树木近3000万株,让3.75万亩荒山披绿,筑起守护西宁的生态屏障。
2026-08-19 09:45
主刊收到投稿400余篇,已出版60篇,其中包括多个我国科研团队的最新重要原创成果……在日前举行的Vita期刊首期发布暨生命科学开放联盟一周年交流会上,Vita(《生命》)系列期刊正式亮相。
2026-08-19 09:45
也正因如此,当科技触及意识,我们需要建立的伦理边界,可能比传统数据隐私更为严格。科技工作者的责任是将伦理融入研发全过程,他们是伦理风险的第一道防线。在研发科技产品时,科技工作者要充分考虑其伦理风险,在应用产品时,要严格遵守伦理规范与法律规定,尊重他人的意识隐私。
2026-08-19 09:43
5天赛程,51个项目,1301场比赛……日前,记者从北京市政府新闻办公室获悉,第二届世界人形机器人运动会将于8月22日在国家速滑馆“冰丝带”开幕。
2026-08-18 10:14
8月15日,承载着亿万公众对良好生态环境期盼的《中华人民共和国生态环境法典》开始施行,标志着我国生态环境保护迈入“法典化”时代。生态环境法典有哪些亮点和创新?如何做好法典的学习、宣传与实施工作?
2026-08-18 10:11
一系列政策“组合拳”为智能农机从研发到应用构筑了全链条支持体系,为现代农业注入强劲动力。
2026-08-18 10:10
今年上半年,我国新能源和可再生能源发展总体保持平稳态势,可再生能源发电装机达24.55亿千瓦,占全国电力总装机的60.7%,其中风电光伏发电装机(约19.5亿千瓦)占比接近一半,太阳能发电装机与燃煤发电装机基本持平。
2026-08-18 10:06
加载更多