DeepSeek成本低廉性能佳,硅谷巨头为何恐慌?

DeepSeek的崛起与性能表现
模型的发布与排名情况
DeepSeek在短短一个月内发布了DeepSeek-V3和DeepSeek-R1两款大模型。去年12月27日推出的DeepSeek-V3,在聊天机器人竞技场中排名第七,在开源模型中排第一,且是全球前十中性价比最高的模型。今年1月20日开源的DeepSeek-R1,1月24日在聊天机器人竞技场综合榜单上排名第三,与顶尖推理模型o1并列。
在不同领域的卓越表现
在高难度提示词、代码和数学等技术性极强的领域,DeepSeek-R1拔得头筹。在风格控制方面,它与o1并列第一,这表明其在理解和遵循用户指令并按特定风格生成内容方面能力出色。在高难度提示词与风格控制结合的测试中,DeepSeek-R1也与o1并列第一,显示出其处理复杂任务和精细化控制的强大能力。Artificial-Analysis的测试显示,DeepSeek-R1在AI分析质量指数中取得第二高分,价格却仅为o1的约三十分之一。
引发的行业震动
Meta的恐慌反应
Meta内部因为DeepSeek的模型进入恐慌模式。DeepSeek-V3在基准测试中让Llama4相形见绌,而DeepSeek仅用550万美元训练预算就做到这一点。Meta的工程师们争分夺秒地分析DeepSeek,试图复制技术。管理层也在为GenAI研发部门的巨额投入发愁,毕竟一个高管的薪资就超过训练整个DeepSeekV3的成本,且这样的高管有数十位。

对AI行业投入模式的质疑
斯坦福大学和EpochAI研究人员以及Gartner的预测表明,AI行业在模型训练和服务器支出方面投入巨大。但DeepSeek训练成本并不昂贵,Noah'sArc资本管理公司认为DeepSeek-V3可能彻底改变训练和推理领域的游戏规则。特别是在“星际之门”计划公布后,DeepSeek的低价突破让人们怀疑巨额投入是否是最有效的方法。
国际上的广泛关注与影响
行业人士的惊叹
AI数据服务公司ScaleAI创始人AlexanderWang称DeepSeek-V3是美国的苦涩教训。A16z的创始人马克·安德森认为Deepseek-R1令人惊叹且开源是给世界的礼物。A16z合伙人AnjneyMidha表示DeepSeek-R1几乎一夜之间成为美国顶尖大学研究人员的首选模型。诺奖得主杰弗里·辛顿指出中国的STEM教育为AI发展提供坚实基础。
外媒的聚焦报道
如果说DeepSeek-V3只是掀起波澜,DeepSeek-R1则引发轰动。美国媒体BusinessInsider报道DeepSeek-R1开源给美国AI玩家带来麻烦。CNBC邀请嘉宾分析DeepSeek引发的对美国AI领先地位担忧。英国《金融时报》报道中国小型AI初创公司DeepSeek震惊硅谷,还援引研究员观点称中国系统工程师人才库大,懂得利用资源廉价训练和运行模型。DeepSeek的出现也让投资者对美股芯片股股价等产生担忧。

相关问答
DeepSeek-R1在哪些方面表现优于其他模型?
DeepSeek-R1在高难度提示词、代码和数学等技术性强的领域排名第一,在风格控制方面与其他顶尖模型并列第一,在AI分析质量指数中取得第二高分且价格低廉。
Meta为什么会因为DeepSeek进入恐慌模式?
因为DeepSeek-V3在基准测试中表现超过Llama4,而DeepSeek的训练预算极低,Meta投入巨大却面临被超越的可能,所以陷入恐慌。
DeepSeek的低成本会对AI行业产生什么影响?
可能改变训练和推理领域的游戏规则,让人们质疑AI行业数千亿美元资本投入的有效性,也可能影响相关股票价格。
为什么国外媒体认为DeepSeek给硅谷敲响警钟?
DeepSeek性能好且成本低,开源模型还可能挑战美国公司靠出售技术盈利的模式,也让人们怀疑美国AI公司能否捍卫技术优势。
诺奖得主杰弗里·辛顿如何看待中国AI快速发展?
他认为中国的STEM教育更好,有更多受过良好教育的人才,美国的限制只会促使中国加速发展自己的技术,最终会赶上。
DeepSeek-V3和DeepSeek-R1发布后英伟达股价为何下跌?
因为DeepSeek模型成本低性能好,让人们对AI行业高投入模式产生怀疑,而英伟达是AI硬件的重要供应商,投资者担忧其前景所以股价下跌。

