Embodied Intelligence Observer

李飞飞押注的空间智能:生成的世界,如何「经得起折腾」?

Industry

Source: 雷峰网Publish time unverified

AI 生成的大多数世界“中看不中用”,根本原因是 AI 少了一本“底账”:一份记住世界里有什么、每次行动改变了什么、并且能被检查和回滚的状态记录。 作者丨刘紫东 编辑丨幸丽娟 李飞飞押注的空间智能,被视为世界模型的主流路线之一。 这条路线的基本构想是,让 AI 从识别二维画面,走向理解、推理和生成可进入、可操作、可持续编辑的三维世界。 但真正的考验在于:一个“站得住”的世界,是怎样构建出来的? 要回答这个问题,不妨先回到一个更基础的追问:当 AI 的交付形态从“画面”变成“三维世界”,互动方式从“观看”变成“进入和操作”,到底意味着什么? 它意味着 AI 交付的内容开始拥有时间属性:对象需要在多轮操作中保持身份,规则要承受真实行动,局部修改也要与已经成立的关系相容;系统还得从每一次行动的后果中,修正自己对世界的理解。 李飞飞将这组能力概括为 Renderer、Simulator 与 Planner——通俗地说,一个负责把世界“画出来”,一个负责记住“世界现在是什么样、行动之后会变成什么样”,一个负责决定“下一步做什么”;三者之间的连接,尤其是模拟与规划共享的状态层——也就是那本“底账”…

李飞飞押注的空间智能:生成的世界,如何「经得起折腾」? | Embodied Intelligence Observer