> 自媒体 > (AI)人工智能 > 中国的“ChatGPT时刻”来临?
中国的“ChatGPT时刻”来临?
来源:极目新闻
2025-02-05 15:08:31
226
管理

本报记者查睿裘雯涵

1月26日—27日,短短两天内,国内AI创业公司DeepSeek(深度求索)遭遇两次短暂宕机,DeepSeek将其归因为新模型发布后导致访问量激增。

新模型指的是刚发布的推理大模型DeepSeek-R1,由此带来的访问量有多大?27日,DeepSeek在苹果美区应用商店下载量力压ChatGPT,登顶免费App下载排行榜。

2024年12月,DeepSeek发布新一代大语言模型V3,已引起行业不少讨论。1月20日发布的R1,将DeepSeek的热度推向了高潮。

一年多时间内,DeepSeek成为大模型行业的“黑马”,是否意味着国内大模型迎来弯道超车的机会?

硅谷都在谈论DeepSeek

在硅谷,几乎每个人都在谈论DeepSeek。有报道称,硅谷“被吓坏了”,工程师正在疯狂分析DeepSeek。还有说法称,这是中国的“ChatGPT时刻”。

DeepSeek究竟厉害在哪?高性能、低成本、开源是外界提到的高频词。

舆论注意到,DeepSeek的推理计算效率极高,可以与业内一些顶尖的AI模型相媲美,与美国硅谷前沿发展保持同步。国外大模型排名榜单Arena最新测评显示,R1基准测试在全类别大模型中排名第三,其中在风格控制分类中与OpenAIo1并列第一,得分达到1357分,甚至略超OpenAIo1。这也几乎意味着,DeepSeek-R1跻身全球最强大模型之列。

DeepSeek的官方测试也显示,R1在数学、代码、自然语言推理等任务上,性能比肩OpenAIo1正式版。在各自小参数版本的模型比拼中,R1-32B的数学推理明显优于o1-mini。

加利福尼亚大学伯克利分校教授亚历克斯·迪马基评价,DeepSeek的技术路线揭示了达到顶尖性能未必需要天文数字投入,“这对硅谷的烧钱竞赛无异于釜底抽薪”。

DeepSeek有多便宜?有数据显示,DeepseekV3的训练成本仅为558万美元,不足GPT-4o的二十分之一。推理模型R1的API(应用程序编程接口)服务定价为每百万tokens(词元)仅需1元(缓存命中)/4元(缓存未命中),每百万输出tokens为16元。大语言模型V3就更便宜了,每百万tokens仅需0.1元(缓存命中)/1元(缓存未命中),每百万输出tokens为2元。DeepSeek的定价约等于Llama3-70B的七分之一,GPT-4Turbo的七十分之一。

开源是DeepSeek备受关注的另一个重要原因。这意味着它已经与其他企业和研究人员共享基础代码,其他人能用相同的技术构建和发布自己的产品。

英伟达资深科学家吉姆·范称赞DeepSeek是“非美国公司践行OpenAI初心”的典范,通过开放技术细节和训练方法,为全球研究者赋能。

出身国内算力最充足企业

天眼查信息显示,DeepSeek背后的实控人是梁文锋,他所创立的幻方量化是国内知名的量化私募基金,这也给DeepSeek打下了良好的算力基础。

不同于常规基金依赖基金经理,量化基金通过数量模型的计算寻找投资机会,因此对数据尤为敏感,高频交易更是离不开机器学习。为了从海量数据中挖掘投资机会,幻方量化早早开始囤积算力,先后斥资10亿元,在美国对芯片出口管制前购买了1万张英伟达A100型号GPU。机缘巧合下,幻方量化成为国内GPU算力最充足的企业之一。

AI行业有条规模化法则,简单来说,就是算力越大、参数越多,训练出的大模型性能就越好。如果遵照这条规则,幻方量化的算力基础,成了DeepSeek最大的王牌之一。

当然,光靠算力优势,DeepSeek显然无法与全球AI巨头抗衡。“DeepSeek爆火主要是创新的技术路线。”上海人工智能行业协会秘书长钟俊浩认为,架构机制、训练方法和管道并行算法等创新,展现了中国本土AI技术的潜力,颠覆了中国只是AI技术跟随者、应用方的传统认知。

英国科技网站“生命科学”撰稿人本·特纳指出,美国限制向中企出口先进AI计算芯片,迫使DeepSeek-R1研发者采用更智能、更有效的算法,弥补计算能力的不足。ChatGPT据报道需要1万台英伟达的图像处理器处理训练数据,DeepSeek称仅用2000台图像处理器就取得了类似结果。

DeepSeek公布的技术论文显示,R1在训练过程中实验了三种技术路径:直接强化学习、多阶段渐进训练和模型蒸馏,其中R1首次证明了直接强化学习的有效性。科技媒体在技术解读中打了个比方,面对同一道题目,大模型同时多次进行回答,系统将给每个答案打分,依照“高分奖励低分惩罚”的逻辑进行循环,最终得出更具优势的推理路径。

中国“正在全力冲刺”

“元”公司首席执行官扎克伯格日前在一档播客节目中坦言,DeepSeek技术非常先进。他表示,中国“正在全力冲刺”,担心这个开源模型会被全世界广泛使用,影响到美国科技行业的领先地位。

一些美国专家也评论称,如果最好的开源技术来自中国,美国开发人员将在这些技术之上构建他们的系统,“从长远来看,这可能会让中国成为研发AI的中心”。

在华盛顿州工作的技术专家阿尔文·王·格雷林认为,DeepSeek的进展显示,美国的领先优势正在缩小,各国应该采取合作方式建设先进AI,而不是在AI领域进行“军备竞赛”。

在长文本交互和多模态的全球竞争中,国内大模型已经崭露头角,随着大模型推理能力的迭代,中国还有机会弯道超车。钟俊浩认为,高效利用计算资源、相对较低的成本,以及更高的市场活跃度,是国内训练推理大模型的优势所在。他表示,国内面临高端算力芯片紧缺的难题,但推理大模型能更集约利用有限的算力资源,同时国内算力基础设施较为完备,训练硬件成本较低。

更重要的是,中国的人工智能市场处于开放竞争的状态,不仅有阿里、字节、商汤等大型AI厂商,还有阶跃星辰、MiniMax等高水平的AI创业企业。更多市场参与者,就有更多创新想法,意味着市场更活跃。

此外,中国具有极强的政策引导能力。例如上海发布“模塑申城”实施方案,就进一步明确“5 6”应用场景,为人工智能企业在推理方面的应用拓宽了发展空间,加速其商业化进程。

(来源:解放日报)

更多精彩资讯请在应用市场下载“极目新闻”客户端,未经授权请勿转载,欢迎提供新闻线索,一经采纳即付报酬。24小时报料热线027-86777777。

0
点赞
赏礼
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与本站无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。 凡本网注明 “来源:XXX(非本站)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。 如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。 QQ:617470285 邮箱:617470285@qq.com
相关文章
全新五菱宏光MINI EV官图发布,这次玩起了复古甜趣风
说实话,看到第五代宏光MINIEV官图的第一眼,我的第一反应是:五菱这次总..
五菱星光L最新实车组图,大六座布局,实用性强
近日,有网友在街头拍摄到了五菱星光L的最新实车的组图,新车采用的是大..
第五代五菱宏光MINIEV即将上市,外观全新设计,提供两门/四门版..
汽车走进生活,选最适合自己的车。哈喽,大家好,我是红涛说车。五菱宏光..
五菱终于想通了!新款MINIEV配四门,2190mm轴距专治后排痛点..
不废话,直奔主题,来聊聊刚刚露出真容的第五代五菱宏光MINIEV。看到这台..
五菱造中大型SUV了,气势不输揽胜,老百姓真能买得起这豪华感?..
2026年2月初,有人在街上拍到五菱的新车星光L,它没有贴伪装,这是五菱推..
五菱造中大型SUV了,网友拍到实车却不敢信,这车真能卖30万?..
2026年2月上旬,有人在街上拍到一辆没贴伪装膜的五菱新车,外形和揽胜比..
智能摄像机“小巨人”今日申购,上汽通用五菱“小伙伴”上市丨打新早知道..
2月26日,可申购北交所的觅睿科技(920036.BJ);另有一只新股上市,为北..
每周车闻:五菱五代 MINIEV 换新亮相 路虎全新车型消息曝光..
每周车闻,这一栏内容主要是我个人挑选出的本周值得关注的汽车资讯,那么..
新一代五菱宏光MINIEV实车现身,尺寸升级+四门,配悬浮大屏+怀挡..
自2020年上市以来,五菱宏光MINIEV累计销量已超190万辆!而接下来为了实..
关于作者
加勒比海盗..(普通会员)
文章
2062
关注
0
粉丝
0
点击领取今天的签到奖励!
签到排行

成员 网址收录40418 企业收录2986 印章生成263660 电子证书1157 电子名片68 自媒体112502

0
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索