点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:中国的“ChatGPT时刻”来临?
首页> 科技频道> 互联网 > 正文

中国的“ChatGPT时刻”来临?

来源:解放日报2025-01-28 11:01

  本报记者 查睿 裘雯涵

  1月26日—27日,短短两天内,国内AI创业公司DeepSeek(深度求索)遭遇两次短暂宕机,DeepSeek将其归因为新模型发布后导致访问量激增。

  新模型指的是刚发布的推理大模型DeepSeek-R1,由此带来的访问量有多大?27日,DeepSeek在苹果美区应用商店下载量力压ChatGPT,登顶免费App下载排行榜。

  2024年12月,DeepSeek发布新一代大语言模型V3,已引起行业不少讨论。1月20日发布的R1,将DeepSeek的热度推向了高潮。

  一年多时间内,DeepSeek成为大模型行业的“黑马”,是否意味着国内大模型迎来弯道超车的机会?

  硅谷都在谈论DeepSeek

  在硅谷,几乎每个人都在谈论DeepSeek。有报道称,硅谷“被吓坏了”,工程师正在疯狂分析DeepSeek。还有说法称,这是中国的“ChatGPT时刻”。

  DeepSeek究竟厉害在哪?高性能、低成本、开源是外界提到的高频词。

  舆论注意到,DeepSeek的推理计算效率极高,可以与业内一些顶尖的AI模型相媲美,与美国硅谷前沿发展保持同步。国外大模型排名榜单Arena最新测评显示,R1基准测试在全类别大模型中排名第三,其中在风格控制分类中与OpenAI o1并列第一,得分达到1357分,甚至略超OpenAI o1。这也几乎意味着,DeepSeek-R1跻身全球最强大模型之列。

  DeepSeek的官方测试也显示,R1在数学、代码、自然语言推理等任务上,性能比肩OpenAI o1正式版。在各自小参数版本的模型比拼中,R1-32B的数学推理明显优于o1-mini。

  加利福尼亚大学伯克利分校教授亚历克斯·迪马基评价,DeepSeek的技术路线揭示了达到顶尖性能未必需要天文数字投入,“这对硅谷的烧钱竞赛无异于釜底抽薪”。

  DeepSeek有多便宜?有数据显示,Deepseek V3的训练成本仅为558万美元,不足GPT-4o的二十分之一。推理模型R1的API(应用程序编程接口)服务定价为每百万tokens(词元)仅需1元(缓存命中)/4元(缓存未命中),每百万输出tokens为16元。大语言模型V3就更便宜了,每百万tokens仅需0.1元(缓存命中)/1元(缓存未命中),每百万输出tokens为2元。DeepSeek的定价约等于Llama 3-70B的七分之一,GPT-4 Turbo的七十分之一。

  开源是DeepSeek备受关注的另一个重要原因。这意味着它已经与其他企业和研究人员共享基础代码,其他人能用相同的技术构建和发布自己的产品。

  英伟达资深科学家吉姆·范称赞DeepSeek是“非美国公司践行OpenAI初心”的典范,通过开放技术细节和训练方法,为全球研究者赋能。

  出身国内算力最充足企业

  天眼查信息显示,DeepSeek背后的实控人是梁文锋,他所创立的幻方量化是国内知名的量化私募基金,这也给DeepSeek打下了良好的算力基础。

  不同于常规基金依赖基金经理,量化基金通过数量模型的计算寻找投资机会,因此对数据尤为敏感,高频交易更是离不开机器学习。为了从海量数据中挖掘投资机会,幻方量化早早开始囤积算力,先后斥资10亿元,在美国对芯片出口管制前购买了1万张英伟达A100型号GPU。机缘巧合下,幻方量化成为国内GPU算力最充足的企业之一。

  AI行业有条规模化法则,简单来说,就是算力越大、参数越多,训练出的大模型性能就越好。如果遵照这条规则,幻方量化的算力基础,成了DeepSeek最大的王牌之一。

  当然,光靠算力优势,DeepSeek显然无法与全球AI巨头抗衡。“DeepSeek爆火主要是创新的技术路线。”上海人工智能行业协会秘书长钟俊浩认为,架构机制、训练方法和管道并行算法等创新,展现了中国本土AI技术的潜力,颠覆了中国只是AI技术跟随者、应用方的传统认知。

  英国科技网站“生命科学”撰稿人本·特纳指出,美国限制向中企出口先进AI计算芯片,迫使DeepSeek-R1研发者采用更智能、更有效的算法,弥补计算能力的不足。ChatGPT据报道需要1万台英伟达的图像处理器处理训练数据,DeepSeek称仅用2000台图像处理器就取得了类似结果。

  DeepSeek公布的技术论文显示,R1在训练过程中实验了三种技术路径:直接强化学习、多阶段渐进训练和模型蒸馏,其中R1首次证明了直接强化学习的有效性。科技媒体在技术解读中打了个比方,面对同一道题目,大模型同时多次进行回答,系统将给每个答案打分,依照“高分奖励低分惩罚”的逻辑进行循环,最终得出更具优势的推理路径。

  中国“正在全力冲刺”

  “元”公司首席执行官扎克伯格日前在一档播客节目中坦言,DeepSeek技术非常先进。他表示,中国“正在全力冲刺”,担心这个开源模型会被全世界广泛使用,影响到美国科技行业的领先地位。

  一些美国专家也评论称,如果最好的开源技术来自中国,美国开发人员将在这些技术之上构建他们的系统,“从长远来看,这可能会让中国成为研发AI的中心”。

  在华盛顿州工作的技术专家阿尔文·王·格雷林认为,DeepSeek的进展显示,美国的领先优势正在缩小,各国应该采取合作方式建设先进AI,而不是在AI领域进行“军备竞赛”。

  在长文本交互和多模态的全球竞争中,国内大模型已经崭露头角,随着大模型推理能力的迭代,中国还有机会弯道超车。钟俊浩认为,高效利用计算资源、相对较低的成本,以及更高的市场活跃度,是国内训练推理大模型的优势所在。他表示,国内面临高端算力芯片紧缺的难题,但推理大模型能更集约利用有限的算力资源,同时国内算力基础设施较为完备,训练硬件成本较低。

  更重要的是,中国的人工智能市场处于开放竞争的状态,不仅有阿里、字节、商汤等大型AI厂商,还有阶跃星辰、MiniMax等高水平的AI创业企业。更多市场参与者,就有更多创新想法,意味着市场更活跃。

  此外,中国具有极强的政策引导能力。例如上海发布“模塑申城”实施方案,就进一步明确“5+6”应用场景,为人工智能企业在推理方面的应用拓宽了发展空间,加速其商业化进程。

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 第二十七届哈尔滨冰雪大世界主塔“冰灯启梦”封顶

  • 福州地铁4号线全线贯通

独家策划

推荐阅读
加快培育壮大数据产业,以区域协同数智化发展带动数据产业集群、数字产业集群做大做强。以兼顾标准互认、质量保障和安全可信的制度体系,护航数据产品服务流通交易、变现增值。数字经济具有数据资源依赖度高、技术知识人才密集、高融合渗透性及行业覆盖面广等特点。
2025-12-11 10:16
光明日报西宁12月10日电 记者万玛加、王雯静日前从国网青海省电力公司获悉,青海电力交易中心与北京电力交易中心、吉林电力交易中心“三网”联动,共同达成跨省跨区中长期外送电力交易,交易电量自12月8日起执行至31日止,累计交易电量1876万千瓦时。
2025-12-11 10:15
2020年12月,科技部在苏州高新区等13家国家高新区启动首批试点,探索实施“创新积分制”,对企业创新能力进行量化评价,引导金融机构精准支持科技创新。联动实施“创新积分制”和科技创新专项担保计划,累计向21家银行推荐超过17万家科技型中小企业,签订贷款合同超2900亿元……
2025-12-11 10:15
2025年12月10日12时03分,中科宇航力箭一号遥十一运载火箭在东风商业航天创新试验区发射,将9颗卫星精准送入预定轨道,发射任务取得圆满成功。此次发射的卫星中,阿联酋813卫星是由上海微小卫星工程中心承研的高光谱地球观测卫星,搭载高光谱相机、全色相机及大气偏振校正仪等主载荷。
2025-12-11 10:05
12月9日,记者从中国科协获悉,中国科协生命科学学会联合体(以下简称“联合体”)发布了2025年度“中国生命科学十大进展”,6个知识创新类和4个技术创新类项目成果入选。
2025-12-11 10:02
“向精准要价值”,是一场从技术导向到需求导向的深刻转型。
2025-12-10 14:00
近十几年来,罗二仓团队聚焦采用环保工质,如氦气、氩气、氮气等绿色工质的热声斯特林技术,研发具有广阔应用前景的新一代热泵技术。
2025-12-10 09:39
中国科学院生物物理研究所徐涛院士课题组与纪伟研究员课题组研制出三维干涉定位显微镜(ROSE-3D),首次在单分子定位成像领域,实现了基于相机的纳米尺度三维各向同性分辨率。
2025-12-10 09:38
“细胞壁是质膜外具有一定硬度和弹性的细胞结构,广泛存在于植物、细菌和真菌中。随着研究逐渐深入,团队发现,在植物茎顶端干细胞区域,细胞壁的主要成分果胶呈现独特的“二元分布”模式。
2025-12-10 09:37
指令长张陆时隔两年半再度漫步太空,航天员武飞成为我国目前执行出舱任务最年轻的航天员。
2025-12-10 09:35
我国首个国家级陆相页岩油示范区——新疆吉木萨尔国家级陆相页岩油示范区9日完成年度170万吨原油生产任务,这一成果标志着国家级示范工程建设任务全面完成。
2025-12-10 09:34
一些不法商家钻监管漏洞,推出所谓“智驾神器”规避车辆安全监控,不仅严重威胁道路交通安全,更触碰了法律红线,扰乱了新能源汽车产业的健康发展秩序。
2025-12-09 10:11
一项新研究揭示了这些天体表面下可能发生的活动,为了解其多样地质特征的形成机制提供了线索。相关研究成果近日发表于《自然-天文学》。
2025-12-09 10:02
实验结果显示,将化合物注射给抑郁模型小鼠后,仅1小时便可观察到显著的抗抑郁效果,且无明显副作用。
2025-12-09 10:01
北京大学生命科学学院罗述金课题组与合作团队,通过古DNA研究发现,家猫直至唐代前后才通过丝绸之路商旅传入中国。
2025-12-09 09:58
7日,中国安全生产科学研究院与国家管网集团,在新疆哈密的国家管网集团管道断裂控制试验场,成功完成了我国首次全尺寸高压纯氢管道喷射火系列试验。
2025-12-09 09:57
基于这样的研究背景,柴秀娟团队近日研发出一种数字孪生驱动的智能温室采摘系统,能有效解决现代温室番茄生产密植环境下,机器人采摘效率低、易损伤植株的问题。团队成员郎一宁介绍:“首先,机器人搭载的滑轨式深度相机会沿温室逐行扫描,采集高精度的RGB-D数据。
2025-12-08 09:54
记者从国家数据局获悉,截至9月底,我国已建成高质量数据集总量超500PB(拍字节,计算机存储容量单位);7个数据标注基地引进和培育标注企业362家,标注从业人员达8.5万人,带动数据标注相关产值163亿元。
2025-12-08 09:53
“梦想”号大洋钻探船的母港在广州海洋地质调查局科考码头,出海执行作业任务时需要通过深中大桥。多年来,我们与150余家参研参建单位团结协作、集智创新,攻克了一个个技术难题,建成了这艘具有我国完全自主知识产权、全球领先的大洋钻探船。
2025-12-08 09:52
空中的昆虫堪称地球上最灵活的生物,能精准完成急转弯、急刹车和空中翻转。美国内华达大学里诺分校的航空航天工程师Hoang-Vu Phan指出,这款新设备标志着“微型机器人性能的巨大飞跃”。
2025-12-08 09:51
加载更多