DeepSeek爆火,众多企业加入,AI发展将走向何方?

云平台对DeepSeek的支持
国内云平台的积极响应
国内云平台纷纷接入DeepSeek模型。京东云宣布上线DeepSeek-R1和DeepSeek-V3模型,支持多种部署模式。此前,阿里云、百度智能云、华为云等国内云巨头已接入。这些云平台的接入,使得DeepSeek能够借助云平台的算力和服务,更广泛地被用户使用。云平台也希望借此吸引更多客户,在DeepSeek的热度中分得一杯羹。
海外云巨头的支持
海外的亚马逊AWS、微软Azure等云巨头同样官宣支持DeepSeek模型。这表明DeepSeek的影响力不仅局限于国内,在国际上也受到云服务提供商的认可。这种广泛的支持有助于DeepSeek在全球范围内推广,与其他国际大模型竞争,也体现了其技术的先进性和应用潜力。
国产芯片与DeepSeek的适配
主流国产芯片的适配情况
众多国产芯片厂商积极响应DeepSeek。华为将多个DeepSeek模型上线昇腾社区,还在国产沐曦GPU首发体验DeepSeek-V3满血版。天数智芯、摩尔线程、海光信息等也宣布支持DeepSeek模型。这意味着DeepSeek能够在国产芯片的支持下,更好地在国内市场推广,也有助于国产芯片与AI大模型的协同发展。
面临的挑战与机遇
虽然主流国产芯片已基本实现对DeepSeek蒸馏版小模型的兼容支持,但满血版的V3和R1对硬件要求大幅提升,且需要额外的推理框架支持。目前只有少数国产芯片成功上线满血版。这既是挑战,也是机遇,若能克服,将能完全解锁DeepSeek的推理优势。

DeepSeek对AI应用场景的影响
降低成本与扩大应用
DeepSeek最大的影响是强化学习的蒸馏流程开源,让大模型在垂直领域的后训练和推理成本急剧下降,可用性急剧上升。这使得企业可以低成本私有化部署,提高了部署意愿。模型成本的下降有望推动AI应用的爆发,扩大AI的垂直应用场景。
对相关产业的带动
DeepSeek模型降低了AI训练成本,有望增加全球数据中心建置量,光收发模块作为数据中心互连的关键组件将受益。科创板上市公司光云科技、当虹科技等都在探索DeepSeek模型的落地应用,还有更多企业如金山办公也在对接测试,这将带动整个AI产业链的发展。
对人才培养的影响
在人才方面,大模型应用人才培养会更受重视。2022-2024年大模型应用人才培养在业界和高校都处于萎缩状态,而25年反应快的高校已计划春季大模型应用人才培养,到秋季可能会有数百所高校跟进,有望培养30-50万大模型应用开发人才。

相关问答
云平台接入DeepSeek模型有什么好处?
云平台接入DeepSeek模型可以吸引更多客户使用其算力和服务,还能在DeepSeek的火爆浪潮中受益,同时也有助于推动开源生态发展。
国产芯片适配DeepSeek模型面临哪些挑战?
满血版的DeepSeek模型对硬件要求大幅提升,并且需要额外的推理框架支持,目前只有少数国产芯片成功上线满血版,这是主要挑战。
DeepSeek如何降低大模型在垂直领域的成本?
DeepSeek通过开源强化学习的蒸馏流程,使得大模型在垂直领域的后训练和推理成本急剧下降,从而降低了成本。
哪些企业已经在探索DeepSeek模型的落地应用?
科创板上市公司光云科技、当虹科技等都在探索DeepSeek模型的落地应用,光云科技旗下的快麦小智已经在多项业务场景支持DeepSeek版本。
DeepSeek对数据中心建置量有何影响?
DeepSeek模型降低了AI训练成本,可望扩大应用场景,进而增加全球数据中心建置量,因为应用场景的扩大需要更多的数据中心来支持。
为什么2025年大模型应用人才培养会受到重视?
因为DeepSeek降低了大模型的应用成本,大模型应用有望爆发,需要更多的人才,而且2022-2024年大模型应用人才培养处于萎缩状态,所以2025年将会更受重视。

