DeepSeek-R1“破圈”,互联网大厂能得到哪些好处?

DeepSeek-R1“破圈”的关键因素
卓越的性能表现
DeepSeek-R1有着业界领先的强大性能。在多个基准测试中,它的表现超越了全球AI行业领先的推理模型OpenAI-o1。这一成果得到了开发人员和使用者的高度评价,在ChatbotArena榜单中名列前茅,甚至超过了OpenAI-o1。从实际用户体验来看,在英文日常问答、物理测试等方面,它的表现不亚于o1系列。这种强大的性能是它能够“破圈”的重要基础。
算法与工程的突破
DeepSeek-R1在多项算法和工程上有实质性突破。它是首个验证后训练时使用强化学习让千亿参数的模型获得推理能力的研究,这切实解决了行业难题。经过多代模型的发展,R1在GRPO算法、MoE架构、MLA机制、FP8精度、MTP方法等多方位取得突破。这些突破让它在众多模型中脱颖而出。

开源与免费C端产品
DeepSeek-R1全面开源并推出免费C端产品。DeepSeekApp成为大部分用户首次体验的优质AI推理模型,在几乎没有广告投放的情况下,7天用户增长1亿。这种开源和免费的策略让更多的用户能够接触到它,从而扩大了它的影响力,有助于其“破圈”。
互联网大厂大模型进展
阿里巴巴的大模型进展
阿里巴巴在大模型方面取得了不少成果。其旗舰模型Qwen2.5-Max在指令模型、基座模型的指标对比中赶超业界领先模型,代码编写等能力、应用体验得到提升。它的实验性推理模型在数学和编程等领域取得进步,期待新模型能受到DeepSeek-R1技术的启示,在正式版带来突破。阿里巴巴提供全尺寸开源模型,性能和开发者参与度均领先。
腾讯的大模型进展
腾讯在架构上进行了调整,TEG聚焦技术底座,其他事业群共推产品化,这使得腾讯AI产品25年整体进展有望相较24年更积极。元宝并入CSIG可能显示出腾讯AI战略转变更加重视产品体验。在多模态方面,腾讯有较多进展,推出业界首个一站式3D内容AI创作平台,支持游戏等工作流,几何结构更精细,纹理色彩更丰富。
百度的大模型进展
百度发布了文心4.0Turbo24M6,并且期待25年新版本的推出。它有两大产品助力全栈服务解决方案,大模型精调和应用开发平台千帆,提供稳定高效算力服务的百舸。这些产品有助于百度在大模型领域保持竞争力。
快手的大模型进展
快手的文生视频生成模型可灵始终处于全球业界领先水平,在最新基座版本更新后,画面表现力显著提升,并获专家评测榜单好评。这表明快手在大模型相关的视频生成领域有着强大的技术实力。
美团的大模型进展
美团联合推出MobileVLMV2模型,有望在移动环境中占据优势。这显示出美团在大模型领域也在积极探索,试图在适合自身业务的领域发挥大模型的优势。
哔哩哔哩的大模型进展
哔哩哔哩的Index自研模型在角色扮演等能力方面表现不俗。这意味着哔哩哔哩在大模型的特定应用场景下有一定的技术能力。
DeepSeek-R1“破圈”对互联网大厂的价值
提升大模型能力
DeepSeek-R1的“破圈”为互联网大厂带来了提升大模型能力的机会。R1带来的突破有机会持续完善,推出性能更强的模型。它的模式有助于激发现有模型潜力,例如对阿里Qwen2.5等模型进行微调。DeepSeek的成功可能促使各大互联网公司加大对AI大模型的战略投入。R1多项创新性技术突破路径已开源,可被复刻至各大互联网公司旗下AI模型中,提升模型能力,加强对内赋能、对外输出能力。
扩张云服务需求
DeepSeek-R1的成功证明了海内外市场对高性能AI推理的强烈需求。已经有多家互联网大厂接入DeepSeek,并提供价格等优惠。市场有望感知到并认可头部互联网公司云服务能力和未来增长空间,从而逐步提升云业务估值水平。这有助于互联网大厂在云服务领域获得更多的商业机会。
提升AIAgent能力
OpenAI上线AIAgent,腾讯、阿里等互联网大厂也提供AIAgent服务。AIAgent仍处于早期,具备一定不可预测性,且依赖基座模型表现。DeepSeek-R1作为性能优秀的推理模型,能够直接提升AIAgent能力,从而让互联网大厂在这一新兴领域更具竞争力。
提升AI赋能广告能力
广告是互联网重要的高毛利变现板块,AI赋能空间理想。DeepSeek-R1的“破圈”有望逐步加深AI自动化广告的渗透,将大模型更深度地用于分析用户在大厂生态上的行为,精准总结画像进而优化广告定向投放,促进广告点击率等指标增长,进而提升广告业务收入和利润水平的增长率。这对互联网大厂的广告业务有着积极的推动作用。
尽管DeepSeek-R1“破圈”给互联网大厂带来了诸多机会,但也存在风险。AI技术研发和产品迭代可能不及预期,AI行业竞争可能加剧,商业化进展可能不及预期,同时还面临国内外政策风险。互联网大厂在利用DeepSeek-R1带来的机遇时,也需要谨慎应对这些风险。

相关问答
DeepSeek-R1在哪些基准测试中超越了OpenAI-o1?
文章未明确提及具体在哪些基准测试中超越,无法准确回答,但可知在多个基准测试中有超越表现。
腾讯架构调整对其AI产品化有何具体影响?
腾讯TEG聚焦技术底座,其他事业群共推产品化,元宝并入CSIG显示更重视产品体验,这会让25年AI产品整体进展比24年更积极。
百度的千帆平台有什么作用?
千帆是百度的大模型精调和应用开发平台,它能助力百度提供全栈服务解决方案,在大模型相关业务中发挥重要作用。
快手的可灵模型更新后有哪些具体的画面提升?
文中未详细提及可灵模型更新后具体哪些画面方面得到提升,只说画面表现力显著提升并获专家好评。
美团的MobileVLMV2模型在移动环境中的优势是什么?
文章未具体指出MobileVLMV2模型在移动环境中的优势,只表明有望在移动环境占优。
DeepSeek-R1的开源对互联网大厂模型能力提升有何直接作用?
其开源的多项创新性技术突破路径可被复刻到互联网大厂旗下AI模型中,有助于提升模型能力,加强对内赋能和对外输出能力。

