同一个角色换一个机位就像换了一个人,是 AI 视频制作中常见的返工原因。问题可能来自参考图、提示词,也可能只在切镜时暴露。把检查拆成几个步骤,比不断增加形容词更容易定位问题。

先分清“身份不变”和“状态可以变”
身份特征包括面部结构、发型轮廓和稳定的识别细节;场景状态包括表情、光照、站位、服装和手里拿的物品。两者需要分别记录。
以一名背着肩包的信使为例:侧光可以让脸显得更暗,转头会改变轮廓,但不能无故换成另一张脸。如果剧情中把肩包放到长椅上,下一镜就应延续这个状态,而不是让肩包重新出现。
1. 先把正式角色资产检查清楚
在 World 中打开角色,检查正式设定图、名称、描述和参考。设定图应能支持你接下来需要的角度;脸部模糊、服装自相矛盾的参考,不宜直接用于连续镜头。
如果错误来自资产本身,先修正资产再生成镜头。避免在每个镜头里用一段不同的文字去补救同一张错误参考,这会让你难以判断哪套设定才是准的。
2. 为相关镜头选择同一个合适版本
在 ElserStudio 中让相关镜头引用同一组角色、场景和道具资产。需要换装或进入另一个年龄阶段时,把变化作为明确的版本选择,而不是悄悄替换已经用于成片的外观。
- 人物图负责身份,不用无关风格图重新定义人物。
- 重复出现的道具沿用同一参考,并标明由谁持有。
- 同框有两个人时,逐一说明动作归属,避免“他转身”这样的歧义。
3. 用上一条成片的实际结尾安排下一镜
看完上一镜,记下角色所在位置、面向、手部动作和道具状态。再写下一镜的开始。不要只对照脚本中的计划,因为生成结果可能没有完成预定动作。
如果认可的上一镜里,行李箱仍然关闭,下一镜就要交代开箱动作,或者用清楚的剪辑表达时间跳跃。
空间关系复杂时,可以补充更明确的站位与机位说明。构图指令解决“在哪里、从哪里看”,角色参考解决“是谁”,不要让两者互相覆盖。
4. 用三种镜头做小范围压力测试
先选一条近景、一条带动作的中景,再加一次视角切换。分别检查以下问题:
- 身份:开始、中间、结束时,脸部和身体轮廓是否仍可辨认?
- 细节:服装、手部和道具有没有在运动中改变?
- 衔接:上一镜的视线、运动方向和结尾姿态,能否接上下一镜?
- 对白:说话者、台词、声音和口型是否对应?
5. 修改一项,再比较前后结果
只重试失败的镜头,保留已经通过的片段。先判断主要问题属于参考、动作描述还是机位,再修改其中一项。更长的提示词如果同时加入新的身份信息,反而可能增加冲突。
最后把片段放回时间线观看。光照和透视造成的自然差异不必全部修掉,优先处理会让观众认错人物或看不懂动作的变化。World 能帮助复用和管理参考,但不会保证每一帧自动一致。
可以对照资产与镜头制作指南检查操作步骤,也可以从三镜头小说转视频流程开始做第一次试作。