KNOWLEDGE NOTE · 持续修订
可交互内容:用户的动作,必须对世界留下影响
把连续生成的画面与可持续交互的世界分开,研究状态、规则、反馈和恢复。
一段内容会回应用户,不意味着它已经是一个可玩的世界。如果用户拿走的物体下一轮重新出现,已经做过的选择无法继续,画面再流畅也难以形成可信的行动体验。
我的判断是:可交互内容的核心资产之一,是动作之后仍被承认的状态。画面负责表达状态,规则决定状态怎样变化,两者不能只靠下一轮语言描述碰巧保持一致。
需要决定哪些事不会凭空改变
角色身份、物品归属、空间关系、任务进度以及关键选择,都可能需要持久保存。并非所有细节都要模拟到物理精度,但哪些允许即兴、哪些必须稳定,应由体验目标决定。
例如,一个以探索为主的短篇体验可以允许场景细节变化,却仍需记住玩家已经打开了哪扇门。这里是设计示例,不是已经上线项目的使用数据。
区分三种责任
生成系统可以负责呈现新场景,规则系统负责判断动作是否允许,状态系统负责保存动作的后果。它们可以共享模型,也可以由模型和确定性代码组合实现。
越重要、越不可逆的状态,越不适合仅依赖模型“记住”。需要记录输入、变更、结果和版本,允许检查矛盾并恢复。做出一次响应与保证长期一致,是不同的成本。
世界模型的功能分类能帮助识别这些责任,但不能证明模型天然具备了完整游戏引擎。分类提案
传播效果与产品留存分开测
惊喜片段适合展示,却无法单独回答用户是否愿意继续。评测应包含重复进入、沿旧选择继续、尝试边缘动作,以及恢复中断任务。记录用户是在探索可能性,还是反复绕开系统失忆。
商业上还要区分创作者制作成本、单次运行成本与付费动机。模型每轮能生成新东西,并不意味着用户每轮都获得新价值。
本页是从创作与 Agent 系统研究中整理出的设计假设。没有把内部项目计划、融资叙事或尚未完成的产品能力当成公开成果。
公开来源与适用范围
- World Labs · A Functional Taxonomy of World Models
研究团队的分类提案 · 以输出功能区分 renderer、simulator、planner;不是业界统一定义,不代表能力已经融合。