角色不是一张参考图
一张人像只能说明某个瞬间的长相。真正可复用的角色资产还包括年龄、体态、面部特征、发型、服装层级、道具、情绪边界,以及不同景别下仍应保持的识别特征。
当这些信息只存在于创作者脑中,模型每次都在重新猜。当它们成为结构化档案,镜头生成才有稳定的起点。
视觉锚点的三个层次
一套好用的视觉锚点,至少同时回答身份、造型和世界观三个问题。
- 身份:这个人是谁,哪些五官与体态不能改变
- 造型:当前场次穿什么,服化道如何延续
- 世界观:摄影、色彩、材质与光线遵循什么规则
先确认,再批量
批量生成最容易放大一个错误的前提。先用少量角色稿和关键镜头确认视觉语言,再把被采用的版本作为后续输入,成本更低,也更符合真实制作流程。
如何写出可执行的角色档案
角色档案不需要文学化。优先记录能被画面验证、能影响生成选择的属性,例如年龄区间、身高体态、脸型轮廓、发型结构、常驻服装层级、关键道具和动作习惯。
情绪与性格也应该落到可见行为:与其写“冷静克制”,不如补充“说话时很少直视对方,转身前会有短暂停顿”。后者更容易进入镜头脚本和表演描述。
什么时候应该生成新版本
文字档案变化不一定需要立刻替换已采用的定妆图。只有当年龄、发型、核心服装、体态或辨识特征发生会影响后续镜头的变化时,才值得生成新的视觉版本。
保留旧版本并明确采用关系,比覆盖文件更重要。它让已经完成的镜头继续引用旧形象,也让新场次能够有意识地切换造型。