英伟达和中关村为何同时盯上世界模型?

英伟达和中关村同时押注世界模型
Runway的转型与英伟达的支持
Runway最初做实时图像风格转换,ChatGPT出现后,它意识到视频是理解世界的入口。2023年推出Gen-1、Gen-2,2025年发布Gen-4,引入物理规律,年底推出首个世界模型GWM-1。英伟达连续三轮加注,此次融资将用于基于NVIDIARubin加速下一代视频与世界模型训练。
国内外世界模型公司的融资热潮
国外,李飞飞创办的WorldLabs完成10亿美元融资,其学生创办的Moonlake获2800万美元投资。国内,生数科技开源统一世界模型Motus并完成6亿元A+融资,极映科技完成数千万元融资,华为哈勃投资多家世界模型初创企业。
世界模型让AI像人类一样认识世界
世界模型的界定与人类认知对比
YannLeCun对世界模型的界定是能预测物理世界自然演变,理解其运行规律、空间特征和因果关系。人类通过积累观察、实践和指令构建心智模型,世界模型则是人工智能的心智模型,让AI能在内部构建“模拟器”。

世界模型对AI的重要意义
物理世界是连续演化、受因果关系约束的系统,语言模型无法模拟其内在机理。世界模型能让AI智体通过观察映射信息,模拟推演和评估策略,提高学习效率,减少对真实世界数据的依赖和学习成本。
世界模型的三个阶段
第一阶段:交互式三维世界与空间内容生成
此阶段世界模型是面向人类的生成工具,用于游戏、影视等场景,强调生成的世界在视觉和空间结构上逼真、自洽,降低内容创作成本。如WorldLabs的Marble,用户可输入多种模态生成三维场景。
第二阶段:为物理智能体研发与训练
模型重心转向建模可被行动改变的环境,辅助物理智能体训练与验证。需生成具空间一致性和物理合理性的模拟环境,支持行动输入并更新环境状态,如Nvidia的Cosmos世界模型体系。
第三阶段:在真实物理世界中的推理与决策
世界模型直接嵌入物理智能体决策系统,实时参与现实环境中任务的决策。智能体观察环境后调用模型推演评估行动结果与风险,这是机器人、自动驾驶等实现高度自主性的关键能力基础。
世界模型的影响力正在发酵
对游戏与互动内容产业的冲击
谷歌展示ProjectGenie后,多家游戏相关公司股价波动。传统游戏开发依赖人工,周期长、成本高,而世界模型可改变“世界构建”环节,虽目前Genie场景交互有限,但揭示了潜在改变方向。
在智能体研发工具链中的影响
对于物理AI应用企业,世界模型能带来高效规模化扩展能力。进入新场景时,成本更多依赖模型和模拟体系复用扩展,有望使机器人和自动驾驶等更快落地产生价值。
对算力基础设施的扩展需求
世界模型强调长时序、多模态等环境推演,将扩展算力需求结构。芯片厂商已投资世界模型初创公司,未来GPU等基础设施使用强度和场景有望扩张。
世界模型作为人工智能领域的新兴力量,正吸引着英伟达和中关村等各方的关注与投入。其发展不仅有望改变AI与现实世界的交互方式,还将对多个产业产生深远影响,引领人工智能迈向新的高度。

相关问答
世界模型与人类认知有何关联?
人类通过积累经验构建心智模型来认识世界,世界模型则是人工智能的心智模型,目标是让AI像人类一样在内部构建“模拟器”理解外部环境。
世界模型的三个阶段是怎样的?
第一阶段是交互式三维世界与空间内容生成工具;第二阶段为物理智能体研发与训练提供模拟环境和数据;第三阶段是在真实物理世界中参与智能体决策。
世界模型对游戏产业有什么影响?
谷歌展示相关模型后,游戏公司股价波动。传统游戏开发成本高、周期长,世界模型可改变“世界构建”环节,但目前生成场景交互有限。
世界模型如何影响智能体研发?
能为机器人和自动驾驶等物理AI应用企业带来高效规模化扩展能力,进入新场景时成本更多依赖模型和模拟体系复用扩展。
世界模型对算力基础设施有何需求?
强调长时序、多模态等环境推演,将扩展算力需求结构,芯片厂商已投资相关初创公司,未来GPU等基础设施使用将更广泛。
世界模型在现阶段面临哪些挑战?
整体处于早期阶段,如游戏中世界模型生成场景的可玩性和复杂度有限,距离成熟体验有差距,在其他领域也有待进一步完善和验证。

