虎嗅 01月26日
硅谷震惊:DeepSeek或彻底改变游戏规则
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_guoji1.html

 

中国AI初创公司深度求索在短时间内接连发布DeepSeek-V3和DeepSeek-R1两款大模型,其低成本和高性能震惊了硅谷,甚至引发Meta内部恐慌,工程师连夜尝试复制其成果。DeepSeek模型在基准测试中表现优异,成本远低于美国同行,引发了业界对AI投入巨额资金的有效性的质疑。DeepSeek的开源策略进一步挑战了美国AI公司的商业模式,引发了外媒的广泛关注和讨论,被视为中国AI技术崛起的重要标志,为硅谷敲响了警钟。

🚀 DeepSeek模型性能卓越,成本极低:DeepSeek-V3和R1两款模型性能媲美OpenAI,但训练成本仅为数百万美元,远低于美国同类产品,引发行业对高额AI投入的反思。

🔥 Meta等硅谷巨头恐慌:DeepSeek模型的出现让Meta等公司感到恐慌,工程师们正在紧急分析和尝试复制其技术,凸显了中国AI初创公司在技术上的突破。

🌍 开源策略挑战商业模式:DeepSeek开源R1模型,允许他人基于其训练其他模型,这种开放策略冲击了美国AI公司通过出售技术盈利的模式,可能改变AI行业的游戏规则。

👨‍🏫 中国AI人才优势凸显:诺奖得主辛顿认为,中国在STEM教育和人才培养方面的优势,为AI发展提供了坚实基础,这解释了中国AI公司快速崛起的原因。

📉 DeepSeek影响科技股:DeepSeek模型的发布引发了投资者对美国AI公司高额投入和硬件成本的担忧,导致英伟达等科技股股价下跌,显示出市场对AI行业未来格局的重新评估。

短短一个月内,中国AI初创公司深度求索先后发布了DeepSeek-V3和DeepSeek-R1两款大模型,成本价格低廉,性能与OpenAI相当,让硅谷震惊,甚至引发了Meta内部的恐慌,工程师们开始连夜尝试复制DeepSeek的成果。

Scale AI创始人Alexander Wang在1月24日的采访中表示,DeepSeek在他们的测试里是表现最好的,与美国最好的模型相当。

此前,Alexander Wang评价说,DeepSeek-V3是中国科技界带给美国的苦涩教训。“当美国休息时,中国在工作,以更低的成本、更快的速度和更强的实力赶上。”

此外,中国AI“刷屏”国外各大媒体,它们认为中国大模型的新进展为硅谷敲响了警钟。

在5000亿美元的“星际之门”计划公布之际,DeepSeek以极低的价格建立了一个突破性的AI模型,而且没有使用尖端芯片,这让人们质疑,AI行业数千亿美元资本的巨额投入真的是最有效的方法吗?

一、Meta进入恐慌模式,试图复制DeepSeek

1月24号,一条发布在匿名平台teamblind上的帖子疯传。一名Meta员工称,现在Meta内部因为DeepSeek的模型,已经进入恐慌模式。

这位Meta员工写道:

“一切源于DeepSeek-V3的出现,它在基准测试中已经让Llama 4相形见绌。更让人难堪的是,一家‘仅用550万美元训练预算的中国公司’就做到了这一点。

工程师们正在争分夺秒地分析DeepSeek,试图复制其中的一切可能技术。这绝非夸张。

管理层正为GenAI研发部门的巨额投入而发愁。当部门里一个高管的薪资就超过训练整个DeepSeek V3的成本,而且这样的高管还有数十位,他们该如何向高层交代?

DeepSeek-R1的出现让情况更加严峻。具体细节属于机密,不便透露,不过很快就会公开了。”

去年12月27日,DeepSeek推出开源模型DeepSeek-V3。当时,聊天机器人竞技场显示,DeepSeek-V3在所有模型中排名第七,在开源模型排第一。而且,DeepSeek-V3是全球前十中性价比最高的模型。

不到一个月之后,今年1月20日,DeepSeek正式开源R1推理模型,允许所有人在遵循MIT License的情况下,蒸馏R1训练其他模型。

1月24日,DeepSeek-R1在聊天机器人竞技场综合榜单上排名第三,与顶尖推理模型o1并列。

在高难度提示词、代码和数学等技术性极强的领域,DeepSeek-R1拔得头筹,位列第一。

在风格控制方面,DeepSeek-R1与o1并列第一,意味着模型在理解和遵循用户指令,并按照特定风格生成内容方面表现出色。

在高难度提示词与风格控制结合的测试中,DeepSeek-R1与o1也并列第一,进一步证明了其在复杂任务和精细化控制方面的强大能力。

Artificial-Analysis对DeepSeek-R1的初始基准测试结果也显示,DeepSeek-R1在AI分析质量指数中取得第二高分,价格是o1的约三十分之一。

二、AI大佬惊叹:中国AI已追上美国

去年12月DeepSeek-V3发布后,AI数据服务公司Scale AI创始人Alexander Wang就发帖称,DeepSeek-V3是中国科技界带给美国的苦涩教训。“当美国休息时,中国在工作,以更低的成本、更快的速度和更强的实力赶上。”

著名投资公司A16z的创始人马克·安德森1月24日发文称,Deepseek-R1是他见过的最令人惊叹、最令人印象深刻的突破之一,而且还是开源的,它是给世界的一份礼物。

1月24日,A16z合伙人、Mistral AI董事会成员Anjney Midha表示:“从斯坦福到麻省理工,DeepSeek-R1几乎一夜之间成为美国顶尖大学研究人员的首选模型。”

对于中国AI为何能有如此快速的进展,诺奖得主、“AI教父”杰弗里·辛顿在1月21日接受博主Curt Jaimungal专访中表示,中国的STEM教育比美国更好,拥有更多受过良好教育的人才,这将为AI的发展提供坚实的基础。尽管美国试图通过限制来减缓中国的发展,但这只会促使中国加速发展自己的技术,“他们可能会落后几年,但最终会赶上”。

三、DeepSeek或彻底改变游戏规则“大力出奇迹”还有效吗?

斯坦福大学和Epoch AI的研究人员在2024年年中发表的一项研究表明,到2027年,最大型的模型的训练成本将超过10亿美元。Gartner预测,到2028年Google、Microsoft和AWS等超大规模企业仅在AI服务器上的支出就将高达5000亿美元。

但DeepSeek完全不同,它的训练成本并不昂贵。Noah's Arc资本管理公司表示,DeepSeek-V3模型有可能彻底改变训练和推理领域的游戏规则。

特别是在5000亿美元的“星际之门”计划公布后,DeepSeek更让人怀疑,巨额投入这种“大力出奇迹”的办法真是最有效的方法吗?

美股大V“THE SHORT BEAR”1月24日在X上发文称,DeepSeek给AI巨头们带来了痛苦时刻,投资者必须对此敲响警钟。

他说:“如果击败OpenAI只需要5500万美元,那么这个行业的商业化会比很多人预想的要快很多。”

他还指出:“根据红杉,美国AI公司每年必须产生约6000亿美元收入来支付其AI硬件费用。现在看来,这种冒险行为变得越来越无利可图。”

著名财经记者Holger Zschaepitz 1月25日表示,DeepSeek以极低的价格建立了一个突破性的AI模型,而且没有使用尖端芯片,这让人们质疑该行业数千亿美元资本支出的效用。

有投资者甚至认为,美股芯片股的股价也会面临挑战。

投资者Geiger Capital表示,Deepseek和OpenAI一样好,甚至更好,而且价格只有后者的3%……而美国公司却投入了数千亿美元。那么……纳斯达克会怎样呢?

值得注意的是,DeepSeek-V3发布后,英伟达股价下跌了2%。而DeepSeek-R1引发海外大讨论后,1月24日英伟达股价又大跌了3.12%。

四、外媒集体刷屏:给硅谷敲响警钟

如果说DeepSeek-V3只是掀起了波澜,那么DeepSeek-R1则是引发了轰动。最近四天,国外媒体纷纷聚焦DeepSeek,并一致认为中国大模型的新进展为硅谷敲响了警钟。

1月22日,美国媒体Business Insider报道称,DeepSeek-R1模型秉承开放精神,完全开源,为美国AI玩家带来了麻烦。开源的先进AI可能挑战那些试图通过出售技术赚取巨额利润的公司。

1月24日,美国媒体CNBC推出了长达40分钟的节目,邀请了Perplexity CEO Aravind Srinivas来分析为何DeepSeek会引发人们对美国在AI领域的全球领先地位是否正在缩小的担忧。

英国《金融时报》1月25日报道称,中国小型AI初创公司DeepSeek震惊硅谷。报道聚焦资源更丰富的美国AI公司能否捍卫自己的技术优势。

报道援引加州大学伯克利分校AI政策研究员Ritwik Gupta称,DeepSeek最近发布的模型表明“AI能力没有护城河”。Gupta补充说,中国的系统工程师人才库比美国大得多,他们懂得如何充分利用计算资源来更便宜地训练和运行模型。

Fish AI Reader

Fish AI Reader

AI辅助创作,多种专业模板,深度分析,高质量内容生成。从观点提取到深度思考,FishAI为您提供全方位的创作支持。新版本引入自定义参数,让您的创作更加个性化和精准。

FishAI

FishAI

鱼阅,AI 时代的下一个智能信息助手,助你摆脱信息焦虑

联系邮箱 441953276@qq.com

相关标签

DeepSeek 人工智能 大模型 开源 中美AI竞争
相关文章