中国大模型创业公司为何难成DeepSeek?

大模型创业的两极现象
冰火两重天的局面
在中国大模型创业圈中,呈现出两种极端的状态。一方面,算力厂商和模型服务厂商积极拥抱DeepSeek生态,开源受益者也充满热情。另一方面,大模型六小虎和投资他们的VC则处于消极状态。这种两极分化的情况,就像在同一环境下,有的事物蓬勃发展,而有的却遭受寒冬。这一现象背后,是DeepSeek低成本训练出强大模型,与其他大模型公司高投入却成果不佳的鲜明对比。
VC面临的质问
那些投资了大模型公司的VC团队正面临内部质问。比如,为什么DeepSeek能用低成本做出强大模型,而被投资的公司融资众多却不行。这反映出在大模型创业中,投资决策与实际成果之间存在巨大落差。这些质问也体现了行业对于大模型创新的深度思考,到底是什么因素在决定一个大模型公司的成功与否。

系统性错位的问题剖析
技术门槛认知偏差
在2023年之前,中国大模型公司数量较少,2023年后增加很多。这是因为当时人们认为大模型技术门槛虽高但可模仿,开源模型降低了技术难度。这种认知导致市场对技术创新的敬畏之心变弱。智谱成为资本宠儿,而面壁智能尽管有先发优势,却因为理念等问题在资本市场遇冷,像2023年提出“高效训练”融资却失败。
资本投资的错位
2023年大模型浪潮下,中国的AI科技VC没有深入研究AGI技术,而是将资金投向有成功创业经历但无大模型研发经验的团队。例如光年之外和百川智能。这种投资方式导致资源分配不合理,有技术能力的团队资金少,没有技术能力的团队却占据大量资本,不利于大模型行业发展。
AGI军团的特殊需求
商业化思维的影响
市场对技术缺乏敬畏,使得大模型创业公司将目光从AGI转向短期商业收益和产品打磨。这是由于行业误判大模型无创新空间。而DeepSeek专注AGI研究,靠自有资金无需融资。大批有创新能力的团队可能因融不到钱而失败,同时人才也流向大厂,如字节跳动吸引了DeepSeek物色的人才。
DeepSeek的成功要素
DeepSeek成功有多种因素。团队规模不大但成员多为技术高手,招聘门槛高,组织文化扁平,一号位有技术信仰且管理集权。这种团队文化有助于在技术探索时协调资源。像梁文锋这样的创始人对AGI充满好奇且刻苦,这都是DeepSeek在AGI投入方面的优势。
创新的品味与行业发展
对创新成果的高要求
DeepSeek的梁文锋对创新成果要求很高,即使取得成果仍认为只是普通成绩。这体现了高追求团队的态度。在AGI实现之前,他们始终追求更高的目标。这种态度也反映出行业内顶尖团队对于创新的执着,不满足于现有的成果,总是向着更高的目标前进。
国内的创新力量
除了DeepSeek,国内还有不少AI人才坚持创新。马毅教授研究可解释的人工智能算法,智谱团队探索多模态技术,面壁团队关注大模型架构问题等。这些都表明中国在AGI发展上有很大的潜力,只要重视创新,就能在AGI领域取得更多成果,推动行业发展。

大模型六小虎为什么没有成为DeepSeek?
大模型六小虎没有成为DeepSeek有多方面原因。一方面是市场对技术创新敬畏不足,导致资本分配不均,技术团队得不到足够支持。另一方面是在商业化思维影响下,没有像DeepSeek那样专注于AGI研究,缺乏技术理想主义。
DeepSeek风暴后中国大模型创业圈会有哪些变化?
变化可能包括资本会重新审视投资对象,更看重有技术创新能力的团队。创业公司可能会重新重视AGI研究,而不是只关注短期商业利益。同时,行业内对技术创新的敬畏之心可能会重新建立。
为什么资本会投向没有大模型研发经验的团队?
因为2023年大模型浪潮来临时,AI科技VC没有沉下心研究AGI技术,想快速参与,就把钱投向有连续成功创业经历的团队,以为这样能获利,而忽略了团队是否有大模型研发经验。
AGI研究需要哪些条件?
AGI研究需要资金、技术理想主义者和优秀的组织文化。像DeepSeek靠自有资金支持,团队成员是技术高手,组织文化扁平且一号位有技术信仰,这些都是AGI研究成功的重要条件。
国内还有哪些推动AGI发展的创新举措?
国内有马毅教授研究可解释的人工智能算法,智谱团队探索多模态技术发展中的问题,面壁团队关注大模型架构难以解决的关键问题等,这些都是推动AGI发展的创新举措。
DeepSeek的组织文化有什么特点?
DeepSeek的组织文化扁平,只有一个老板。招聘门槛高,宁缺毋滥。创始人梁文锋有极强的技术信仰,对AGI充满好奇心与求知欲,团队成员多为原幻方的技术高手。

