真人互动影游这个品类,这几年经历了一轮明显的回潮。它最早在硬件性能有限的年代被用来"藏拙"——用真人视频代替当时做不出来的实时画面;如今开发者重新拿起摄影机,理由已经完全不同:真人表演能带来引擎渲染很难替代的情感真实度,一批作者也把这个形式打磨成了严肃的非线性叙事工具,而不只是怀旧噱头。
与此同时,AI也在从两个不同的方向靠近这个品类,值得分开讨论。
方向一:BEHIND THE CAMERA 幕后
这是目前相对成熟、也更容易控制的一类应用:辅助分镜预演、帮助整理海量素材、生成初版字幕、管理不同分支版本之间的关联,甚至参与场景概念设计。这些工作的共同点是——玩家几乎感知不到AI的存在,出了问题也主要影响制作效率,不会直接破坏玩家看到的成片。
方向二:IN THE STORY 进入剧情
更受关注、也更有风险的方向,是让AI直接变成玩家可以对话的角色。行业内已经出现了一批支持长期记忆的AI NPC系统,角色可以在多次对话中记住玩家做过的事、逐渐形成对玩家的态度倾向,这在纯预先录制的对话树里很难做到。部分方案还在探索让这类AI角色直接跑在设备本地,用较小的模型换取更低的响应延迟和更好的隐私保护,而不是每一句话都要连线云端处理。
幕后AI更容易控制,进入故事的AI可能带来三类问题
幕后AI的产出通常会经过人工审核才进入成片,出错的代价有限。进入故事的AI角色则直接面对玩家的任意提问,容易出现三类问题:角色跑偏(回答内容偏离设定的性格)、剧情泄露(说出了剧情后期才该揭晓的信息)、语气和态度前后不一致(这一点详见角色一致性文章)。这些问题在预先录制的真人对话里根本不会出现,因为每一句台词都经过编剧和演员反复打磨;一旦交给AI实时生成,就必须靠额外的边界设计来弥补。
实时生成世界是另一条完全不同的路线
需要特别说明的是,近期讨论较多的"实时AI生成互动世界"(画面随操作实时变化、无需提前拍摄)是一条和真人FMV完全不同的技术路线,两者目前更多是并行探索,而不是前者正在取代后者。真人互动影游的核心优势始终是真实拍摄带来的表演质感,这一点是实时生成技术短期内很难复制的,详见首页LIVE vs GENERATED部分的对比分析。
核心问题:越靠近剧情中心,越需要边界
AI能不能用好,不取决于它离剧情核心有多近,而取决于介入的位置有没有配套的控制手段。幕后场景天然自带审核环节;进入剧情的AI角色则需要主动设计"知道什么、能说什么"的边界,否则自由度带来的不是惊喜,而是剧情崩塌的风险,具体的边界设计方法见AI角色能自由聊天以后,为什么编剧反而要给它更多限制?。