DeepSeek热度攀升,AI格局如何被重塑?

DeepSeek的基本情况与发展态势
DeepSeek的公司概况
DeepSeek全称杭州深度求索人工智能基础技术研究有限公司,于2023年7月17日成立,是一家专注于开发先进大语言模型(LLM)和相关技术的创新型科技公司。它在短时间内推出了多个有影响力的模型,如2024年12月26日推出的V3(对标GPT4o)和1月20日发布的R1(对标GPT-o1)。这些模型性能显著,使得DeepSeek的用户量迅速增长。根据相关数据,其在美国的下载排名从1月22日的201名快速上升,在1月27日登顶第一名,截至1月30日,在168个国家位居下载榜第一名。
外界对DeepSeek的高度评价
DeepSeek的成果得到了许多业内人士的高度评价。1月24日,著名投资公司A16z的创始人马克·安德森发文称,Deepseek-R1是他见过的最令人惊叹、最令人印象深刻的突破之一,而且还是开源的,是给世界的一份礼物。ScaleAI创始人亚历山大·王(AlexandrWang)也表示,过去十年来,美国可能一直在AI竞赛中领先于中国,但DeepSeek的AI大模型发布可能会“改变一切”。

DeepSeek面临的问题:商标抢注
商标抢注事件详情
据新华每日电讯援引TC报道,DeepSeek面临美国商标纠纷。一家总部位于特拉华州的DelsonGroupInc.申请了DeepSeek商标。DelsonGroup声称自2020年初以来一直在销售DeepSeek品牌的AI产品。其首席执行官兼创始人WillieLu与DeepSeek创始人梁文锋毕业于同一所大学——浙江大学。这一商标抢注事件无疑给DeepSeek带来了新的麻烦,在其迅速发展的道路上增添了障碍。
商标抢注可能的影响
商标抢注可能会对DeepSeek的国际市场拓展、品牌形象等方面产生负面影响。在国际市场上,品牌商标是企业的重要资产,若商标被他人抢注,可能导致消费者混淆,影响公司产品的推广和销售。而且在处理商标纠纷的过程中,也会耗费公司大量的时间、精力和资金。
AI巨头与DeepSeek的合作:纷纷接入
英伟达接入DeepSeek
1月31日,英伟达宣布NVIDIANIM已经可以使用DeepSeek-R1。英伟达官网指出DeepSeek-R1是具备最先进推理能力的开放模型。它会对查询进行多次推理处理,使用连锁思维、共识和搜寻方法来生成最佳答案。英伟达将其作为NVIDIANIM微服务预览版上线使用,这一举措既体现了DeepSeek-R1的价值,也反映出英伟达对其的认可。DeepSeek之前的发展还一度影响英伟达股价,也表明两者之间存在着复杂的相互影响关系。
微软接入DeepSeek
微软也将DeepSeek-R1正式纳入AzureAIFoundry。尽管微软是OpenAI的最大股东,在OpenAI对DeepSeek进行调查的仍决定将R1模型纳入其AI服务。微软强调DeepSeek-R1模型已通过“严格的红队测试与安全评估”,并经历了一系列的安全审查。这显示出DeepSeek-R1在性能和安全性方面具有一定的优势,能够满足微软这样的巨头企业的要求。
亚马逊接入DeepSeek
1月31日,亚马逊云科技宣布客户可以在AmazonBedrock和AmazonSageMakerAI中部署DeepSeek-R1模型,还可以通过AmazonEC2、AmazonSageMakerAI,使用AmazonTrainium和AmazonInferentia部署DeepSeek-R1-Distill。这表明亚马逊也看到了DeepSeek-R1在其云服务和AI业务中的潜在价值,希望通过接入DeepSeek-R1来提升自身在AI领域的竞争力。
OpenAI的应对措施:推出新模型并开放推理
o3-mini模型的特点与优势
OpenAI为应对DeepSeek的冲击,于1月31日正式上线o3-mini模型,并首次向免费用户开放推理模型。o3-mini支持开发者调整“AI推理努力程度”分为低、中、高三个级别。在不同的测试场景中,如2024年美国数学邀请赛(AIME2024)和博士级科学问题(GPQADiamond)方面,不同推理努力程度下的准确率各有不同。这种灵活性使得o3-mini可以根据不同的需求,在思考深度和响应速度之间进行平衡,具有很强的适应性。
o3-mini推出的意义
o3-mini的推出,一方面是OpenAI对DeepSeek带来竞争压力的回应,旨在保持其在AI领域的竞争力;另一方面,向免费用户开放推理模型也是一种市场策略的调整,有助于吸引更多的用户使用OpenAI的产品,扩大其用户基础,同时也能收集更多用户反馈,进一步优化模型。
DeepSeek对大模型生态的重塑
DeepSeek的开源策略优势
DeepSeek-R1以MITLicense完全开源模型权重,并允许商用模型蒸馏,为开发者提供了二次创新的自由空间。这一开源策略具有多方面的优势。从成本上看,其API价格明显低于GPT-o1,输入(缓存命中)、输出定价分别为每百万tokens1元、6元,低于GPT-o1的55元、438元,具备很高的性价比。这使得更多的开发者和企业能够使用DeepSeek-R1,降低了开发成本。
对大模型生态的影响
国泰君安指出,DeepSeek-R1的开源策略将重整通用模型竞争格局。其蒸馏模型的优异表现将支持消费电子、智能驾驶等终端AI的部署,大模型的商业化落地将在DeepSeek的低价API支持下加速,未来垂类应用也有望加速创新迭代。摩根士丹利表示,DeepSeek通过提高数据质量和改进模型架构,展示了一条不同的高效训练途径,其低成本优势突出,与国际知名大模型相比,成本大约低了一个数量级。长江证券也看好推理算力与应用侧受益,认为国产推理模型持续迭代将提升推理算力需求,利用DeepSeek-R1整理的样本微调小型模型可加速垂类模型应用落地进程。

相关问答
DeepSeek是什么类型的公司?
DeepSeek是一家于2023年7月17日成立的创新型科技公司,专注于开发先进的大语言模型(LLM)和相关技术。
DelsonGroup为什么要抢注DeepSeek商标?
DelsonGroup声称自2020年初就在销售DeepSeek品牌的AI产品,但具体抢注动机可能涉及商业利益争夺等复杂因素,目前并没有更多官方说明。
英伟达接入DeepSeek-R1有什么意义?
英伟达接入DeepSeek-R1意味着认可其先进的推理能力。这有助于英伟达为开发者提供更多样的服务,同时也反映出DeepSeek-R1在AI领域的价值。
微软将DeepSeek-R1纳入其AI服务不怕与OpenAI产生冲突吗?
微软强调DeepSeek-R1通过了严格测试和安全评估。微软可能看到了DeepSeek-R1的潜力,在商业利益考量下做出这一决策,且表示会持续评估和调整。
OpenAI的o3-mini模型免费开放推理对用户有什么好处?
用户可以根据不同场景需求,在o3-mini模型中选择不同的推理努力程度,既能在应对复杂问题时获得较好的准确率,也能在需要快速响应时优先保证速度。
DeepSeek-R1的开源策略对开发者有哪些好处?
DeepSeek-R1开源且API价格低,开发者可以在其基础上进行二次创新,降低开发成本,还能利用其整理的样本微调小型模型以提升推理能力。

