角色一致性通常会在视频模型开始移动之前中断。模糊的身份、弱的参考图像或隐藏脸部的镜头都会给模型带来太多的想象空间。修复是一个分阶段的工作流程:定义人物一次,批准每个镜头的静态图像,一次为一个镜头制作动画,并在编辑序列之前对漂移进行评分。
从工作路线开始
按照指南操作时,请使用这些路径:
- 打开C舞 AI 在一个工作区中的图像和视频作品之间移动。
- 使用 GPT Image 2 构建身份框架 当面部、服装或构图需要受控编辑时。
- 静态图像通过审核后使用 Seedance 2.5 对批准的框架进行动画处理。
- 在 Seedance 2.5 模型页面查看当前生成器入口。
模型参数很重要。通用工作区链接让读者可以重建设置,而这些链接则打开过程中该点使用的模式。
简短的回答:将身份与运动分开
单个提示不应同时发明角色、服装、地点、表演、摄像机移动和编辑。将这些工作分开。
- 写一份简洁的身份简介。
- 建立一个小字符参考表。
- 决定整个序列中哪些内容保持固定。
- 为每个镜头生成一个静止锚点。
- 通过受限运动为每个锚点设置动画。
- 对五种可见的漂移进行评分。
- 修复第一个损坏的镜头,而不是重新开始一切。
此过程在图像生成和视频生成之间添加了一个批准点。这一额外步骤的成本低于重复生成面无法切割在一起的剪辑的成本。
为什么角色在 AI 视频镜头之间漂移
视频模型必须同时解决身份和运动问题。他们看到的是像素和提示说明,而不是一本自动跟随角色从一代传到下一代的制作圣经。每一个新的角度都会产生缺失的信息。
正面肖像并不能完全说明轮廓。腰部以上的图像不定义角色的身高或鞋子。黑暗场景可以隐藏眼睛颜色和发际线,从而使第一张图像易于识别。当模型填补这些空白时,结果可能看起来仍然合理,但它看起来不再像同一个人。
漂移也会出现在剪辑内。快速的头部转动、表情的大幅变化、运动模糊、部分遮挡和激进的镜头移动都会削弱固定面部的可见证据。然后模型逐帧重建细节。
将一致性视为信息问题。对于镜头可能暴露的每个细节,给模特一个明确的答案。
第 1 步:写一份可以重复的身份简介
从观众用来识别角色的特征开始。保持块足够短,以便粘贴到每个图像提示中而无需重写它。
性格:玛拉,三十岁出头,瓜子脸,高颧骨,直下巴的黑色波波头,钝刘海,深棕色杏仁形眼睛,左耳上有小银箍。
衣柜:芥末田野夹克搭配木炭色圆领衬衫、深色直筒裤、破旧的黑色皮靴。
比例:中等身高,窄肩,紧凑的运动型身材。
标志性细节:穿过右眉毛的细对角疤痕和斜挎的红色织物相机带。
具体的特征比“美丽”、“英雄”或“电影”等标签更有效。这些词可能会影响风格,但它们不会告诉模型如何从另一个角度重建脸部。
将永久细节与镜头细节分开。头发长度和眉毛疤痕属于身份块。雨、惊讶的表情、低镜头都属于拍摄提示。混合使用它们会让人更难看出是哪条指令引起了变化。
第 2 步:构建紧凑的角色参考表
最小的有用包通常包括中性正视图、四分之三视图、侧面图、全身视图以及标志性物品的细节。保持照明简单。戏剧性的阴影和彩色凝胶可能看起来不错,但它们隐藏了后续镜头所需的信息。
上图是原始规划插图,而不是对特定模型输出的声明。它显示了参考表所需的覆盖范围:可重复的面部标志、稳定的衣柜颜色、全身比例以及标志性肩带和疤痕的近距离视图。
您可以在 GPT Image 2 图像编辑器 中构建工作表,或使用 纳米香蕉专业版 进行参考引导的编辑。在询问更多角度之前先批准一种身份。如果第一张肖像在两次尝试之间仍然发生变化,则较大的纸张会增加不匹配的程度。
使用经批准的肖像作为身份参考。在中性灰色工作室背景上创建一个干净的字符表。
显示五个单独的面板:正面肖像、左侧四分之三肖像、左侧侧面、全身站立姿势以及右侧眉毛疤痕和红色相机带的细节。
保持面部比例、长下巴的黑色鲍勃、钝刘海、眼睛形状、肤色、芥末夹克、炭灰色衬衫、身体比例和配饰不变。使用均匀的中性照明。没有戏剧性的姿势,没有添加珠宝,没有文字标签。
在继续之前检查工作表。侧面图仍应具有相同的鼻子、下巴、头发长度和耳朵位置。全身面板应与肖像所暗示的体型相匹配。删除冲突的面板而不是保留它作为另一个参考。
第三步:在镜头列表之前写一个连续性分类帐
连续性分类账是一个小表,它将允许的更改与受保护的细节分开。它可以防止位置或衣柜变化在没有决定的情况下溜进提示。
| 射击 | 允许更改 | 必须保持固定 |
|---|---|---|
| 1.档案入口 | 位置、宽幅取景、行走姿势 | 脸型、鲍勃长度、夹克、红色肩带、身材比例 |
| 2、地图巡查 | 表情、手部位置、中框 | 疤痕侧面、眼睛形状、夹克颜色、表带方向 |
| 3.报警反应 | 照明强度、头部转动、近距离取景 | 发际线、鼻子和下巴、左耳环、眉毛疤痕 |
| 4.退出 | 摄像机位置、跑步动作、室外雨 | 全套服装、身高、体型、肩带、靴子形状 |
仅针对该镜头中可见的细节写“必须保持固定”。引导约束会为紧致的面部特写添加噪点。相反,特写镜头需要更强的面部约束。
如果序列有多次有意剪切,请在 Seedance 2.0 多重镜头故事板指南 中规划它们的时间安排。连续性账本会回答谁留在屏幕上。故事板回答了观众在每次剪辑后学到的内容。
步骤 4:为每个镜头创建一个经批准的锚框
锚框将抽象的镜头描述变成可见的证据。在视频模型推断运动之前,它会修复角色、姿势、服装、摄像机角度和环境。
不要在每次拍摄时重复使用相同的正面肖像。侧面照片需要侧面锚点。跑动的广角镜头需要全身锚定。从相同的身份包创建每个锚点,然后将其与批准的工作表进行比较。
使用经批准的 Mara 角色表作为身份参考。
创建电影档案场景的开场帧。玛拉从左侧进入一间高大的档案室,以中宽四分之三视图显示。她穿着同样的芥末夹克、炭灰色衬衫、深色裤子、黑色靴子、银色左耳箍和红色斜挎相机带。保留右眉毛疤痕、下巴长的黑色鲍勃、脸型和身体比例。
头顶上凉爽实用的灯光、落满灰尘的架子、内敛的蓝灰色色调。相机位于胸部高度,视野为 35 毫米。玛拉走到中间,看着远处桌子上的纸质地图。没有其他人。没有文字。衣柜没有变化。
以相同的缩放比例并排查看锚点。查看眼睛之间的距离、下巴宽度、鼻子长度、刘海形状、疤痕位置、肩宽和肩带方向。静止图像中的小错误在运动过程中通常会变得更大。
对于必须落在特定姿势或构图上的过渡,请阅读 第一帧和最后一帧提示指南。当最终帧具有编辑价值,但两个端点仍需要通过身份检查时,端点控制非常有用。
第 5 步:使用一项动作作业为锚点设置动画
打开 图像转视频模式下的 Seedance 2.5 并上传批准的锚点。给人物一项主要动作,给相机一项主要指令。简短的测试可以更快地暴露漂移,并且修复成本更低。
从输入帧中保留女性的身份、面部比例、下巴长度的黑色鲍勃、右眉毛疤痕、芥末夹克、红色相机带和身体比例。
她向地图桌迈出了两步,然后停了下来。她的左手伸向纸质地图的边缘。摄像机缓慢、稳定地向前推动,同时保持在胸部高度。自然的布料动作和微妙的呼吸。保持凉爽的档案照明和货架几何形状稳定。
没有剪辑,没有轨道,没有变焦跳跃,没有新人物,没有衣柜改变,没有发型改变,没有脸变形。
负面约束应该针对可能的失败。每一个可以想象到的缺陷的一长串清单削弱了有用的说明。对于这张照片来说,身份、摄像机连续性和空房间都很重要。口型同步、爆炸和空中动作则不然。
下面的规划视频演示了如何将特定于镜头的锚点切入序列中。这是一个拥有的故事板演示,而不是生成的角色持久性证明。
步骤 6:在五个可见轴上得分漂移
“看起来像同一个人”对于审查来说太宽松了。分别对功能进行评分,以便修复提示有目标。
| 轴 | 通过条件 | 常见故障 |
|---|---|---|
| 脸 | 眼距、鼻子、下巴、嘴巴和疤痕仍然可辨认脸变窄、年龄变化、疤痕互换 | |
| 头发 | 长度、边缘、部分和颜色保持稳定 | 鲍勃长过下巴或刘海张开 |
| 衣柜 | 服装类型、颜色和主要接缝匹配 | 夹克改变颜色或增加衣领 |
| 比例 | 身高、肩宽、四肢长度和体型仍然合理 | 广角镜头产生更高、更宽的身体 |
| 签名详情 | 耳环、带子、疤痕或道具保持在正确的一侧 | 表带方向相反或配件消失 |
查看第一帧、最大运动点和最后一帧。剪辑可以正确开始并在转弯过程中漂移。如果您只检查缩略图,您将错过使编辑感觉错误的帧。
在生成之前设置实用的验收规则。对于社交剪辑,如果脸部保持不变,则夹克纹理的微小变化可能是可以接受的。对于叙事特写来说,即使其他一切看起来都很光鲜亮丽,疤痕位置的改变也可能会破坏连续性。
步骤 7:修复身份中断的第一帧
找到最早的坏帧。原因通常出现在它之前:头部旋转、遮挡、光线变化、极端表情或剪切到指定角度以下。
按此顺序修复:
1.缩短或简化主体动作。 2. 删除竞争的摄像机移动。 3. 加强漂移开始角度的锚固。 4. 如果脸部太小而无法保留,请剪得更近。 5. 仅重新生成该镜头并将其与相同的记分卡进行比较。
每次尝试更改一个变量。如果您更换锚点、重写动作、更换摄像机并同时更改照明,则更好的结果不会告诉您哪种修复有效。
修复目标:在头部转动过程中保留认可的面部。
使用修改后的四分之三锚点作为第一帧。女子只将头转向警报灯 25 度,然后保持不动。她闭着嘴,表情紧张但克制。相机保持锁定状态。保留眼间距、鼻子长度、下巴形状、右眉毛疤痕、刘海线、左耳箍和肤色。
没有完整的轮廓,没有相机轨道,脸上没有运动模糊,没有灯光颜色变化,没有新配件。
如果面仍然以相同的角度变化,请根据已显示该角度的参考重建锚点。提示重复无法提供参考从未定义的几何图形。
三个困难镜头的提示模板
这些模板假设您已经拥有经批准的锚点。替换括号内的细节,然后删除框架不需要的任何约束。
###对话特写
保留输入帧中角色的脸部、发际线、[标志性细节]、衣柜领口和肤色。
该角色用克制的嘴巴动作和自然的眨眼说出了一个简短的句子。表情仍然是[平静/关心/有趣]。锁定特写镜头,没有相机移动。柔和的光线固定在脸上。
头部转动不得超过10度,不得夸张微笑,不得牙齿扭曲,不得改变发型,不得更换配饰。
对话很困难,因为嘴和脸颊不断变化。在第一次测试期间,保持线短且头部几乎固定。身份通过后添加更多性能。
###行走全身照
从输入框中保留角色的身高、体型、脸部、发型、全套服装、鞋子和[签名道具]。
角色沿着[地点]稳步行走四步。自然的手臂摆动和布料运动。侧向跟踪摄像机以匹配的速度、恒定的距离、镜头或高度不变。保持背景方向和灯光稳定。
没有切口,没有轨道,没有冲刺,没有体形变化,没有鞋类变化,没有重复的肢体。
全身运动暴露比例和服装结构。使用清晰显示鞋子和轮廓的锚。裁剪后的肖像无法可靠地定义它们。
转头反应镜头
保留输入框中批准的面部结构、眼睛形状、鼻子、下巴、头发长度、[疤痕或标记]和[耳环侧]。
角色听到声音并向镜头右侧转动 20 度,然后握住。眉毛微微上扬,嘴巴保持闭合状态。锁定中景特写。背景和灯光保持不变。
没有完整的轮廓,没有快速快照,没有相机移动,没有面部变形,没有交换配件。
头部转动揭示了正面图像隐藏的几何形状。使用四分之三参考值并限制第一次测试。仅在较小的转弯保持后才增加角度。
实用的逐次拍摄生产订单
首先生成最简单的身份镜头,而不是按时间顺序排列的开头。稳定的中特写给你后期修复提供有用的参考。然后制作侧面或全身照片,其中信息缺失会带来更多风险。
对于四镜头场景,工作顺序可能是中锚、近锚、宽锚,然后是轮廓锚。编辑顺序可以保持宽、中、近、轮廓。生产顺序和故事顺序不需要匹配。
将文件名与镜头和版本相关联:
01-archive-wide-anchor-v03.png
01-存档范围-运动-v02.mp4
02-地图-中-锚-v04.png
02-地图-中-运动-v01.mp4
03-alarm-close-anchor-v02.png
03-警报关闭-运动-v03.mp4
这种命名使得被拒绝的锚更难意外地重新引入。将提示保存在接受的文件旁边,并记录用于运行的确切模型路线。
常见故障和最短有用的修复
角色看起来相关,但不完全相同
身份块可能过于笼统,或者锚点的批准过于宽松。比较面部标志而不是整体情绪。使用批准的肖像重建锚点,并命名更改的两个或三个特征。
脸型不变,但头发和衣着却变了
将头发和衣服移入重复的身份块中。注明确切的长度、部位、服装类型和颜色。当镜头暴露的范围超过脸部时,请使用全身或四分之三锚点。
第一帧匹配,最后一帧不匹配
降低运动和相机的复杂性。检查中点以找到证据消失的位置。锁定的相机和较小的头部转动通常可以揭示运动是否导致了漂移。
不同的镜头在脸上有不同的光照
使用具有共享照明规则的特定于镜头的锚点。不要指望一张明亮的工作室肖像能够在每个黑暗或彩色环境中定义一个角色。保留面部几何形状,同时使锚点适应场景的实际光线。
提示不断变长,但结果却没有改善
将身份、镜头、运动和排除分割成单独的块。删除不适用于镜头的约束。如果参考文献中缺少角度,请创建该参考文献而不是添加更多散文。
糟糕的镜头迫使整个剪辑发生变化
锁定接受的剪辑。仅修复第一个失败的段并保持相同的进入和退出帧。当替换件必须连接到两个经批准的相邻镜头时,第一帧和最后一帧指南 可以提供帮助。
您应该计划的限制
没有任何提示可以保证独立代之间的像素相同。遮挡、极端姿势、风格化灯光、快速运动和长剪辑增加了不确定性。当服装质地或小配饰发生变化时,角色也可能保持可识别性。
仅靠引用计数并不能解决这个问题。相互冲突的图像可能会降低身份的稳定性,因为它们为同一特征提供了多种答案。使用更少的具有明确角色的参考资料,并删除任何不同意已批准身份的小组。
工作流程还需要人工审核。自动相似度评分可以帮助对结果进行排序,但制作决策取决于哪些细节对故事很重要。在广角镜头中,丢失的耳环可能无害。在特写镜头中,疤痕移动到另一只眉毛可能是不可接受的。
在 C Dance AI 中运行工作流程
首先在 GPT 图像 2 编辑器 中构建或修复身份。如果您更喜欢以参考为主导的图像工作流程,请打开 纳米香蕉专业版。每个镜头批准一个锚点,然后将每个接受的帧移至 Seedance 2.5 图像转视频 中。
将身份包、连续性账本、锚定框架、提示和漂移分数放在一起。该记录将模糊的“重试”循环转变为生产过程,其中每个失败的镜头都有特定的修复。

