深度视频,改变了哪一部分参考?
普通视频把动作、镜头、人物和场景放在同一个画面里。深度视频用像素值表示估计的远近关系,减少原始颜色和纹理信息,为新的生成提供运动与空间线索。
它不只是把视频调成黑白,也不会自动删除所有人物轮廓。人数、站位、遮挡和镜头经过的空间,仍可能影响结果。
从一段参考,延伸到自己的创作
01
换角色,沿用动作
借用舞蹈、转身、起跳或打斗的动作顺序,重新设计人物外观。
02
借运镜,重新设计画面
参考环绕、推进与跟拍,让目标场景为原有运动留出空间。
03
同一动作,多种视觉版本
保留一份运动参考,分别连接不同的人物与风格方案。
先减少外观干扰
再让自己的角色进入画面
当原视频的衣服、人物轮廓或实拍质感混进结果,可以尝试先提取深度参考。两组使用相同目标人物和生成设置,对比变化具体出现在哪里。
直接参考已经达到目标,就不必额外处理。判断收益时,动作准确度和外观一致性要分开看。


直接参考
深度参考
直接参考 / 深度参考 · 拖动查看图片位置
保留动作顺序
也看清人物的前后关系
深度画面提供的不只是抬手和转身。两个人之间的距离、遮挡顺序与镜头推进,也会参与后续生成。
选取完整动作后先检查中间结果:人物有没有混在一起,手臂是否仍可辨,镜头运动时空间是否突然跳变。


原片画面
深度画面
原片画面 / 深度画面 · 拖动查看图片位置
同一段运动
尝试不同的视觉方向
在画布里保留满意的运动参考,让不同的人物、材质或画风各自连接生成结果。版本与素材放在一起,更方便比较和继续修改。
角色比例和场景布局变化后,仍需检查脚步、接触和遮挡。每个视觉版本都要单独验收。


视觉方案 A
视觉方案 B
视觉方案 A / 视觉方案 B · 拖动查看图片位置
先分清参考用途,再写提示词
做单人舞蹈,可以先用一段动作参考和一套人物外观。确实需要换环境时,再加入场景素材。
运动参考
动作、走位与镜头
保留完整动作,检查前后层次、遮挡和帧间连续性。原片的空间关系仍会影响结果。
人物参考
脸、服装与体型
关键部位清楚;多张人物图的外观一致。双人镜头写清起始位置与角色对应。
场景与风格
环境、材质与视觉方向
先确定一套视觉方向,让环境布局容得下参考动作和镜头移动。
文字说明
明确引用关系与局部要求
先指定每份素材负责什么,再补服装、道具等镜头要求,避免与原运动相反。
把素材关系写进提示词
下面是一份可按素材调整的写法。把素材名称换成实际入口中的引用方式,再补当前镜头的具体要求。
使用“运动参考”提供人物动作、运动方向和镜头变化;使用“目标人物”确定角色外观。场景采用“目标场景”的环境与视觉风格,并保持人物运动所需的空间。保留动作先后顺序,多人交错后保持身份对应。
双人镜头可补充:开场左侧对应人物A,右侧对应人物B,交错后保持身份与服装。需要道具时,再说明道具形状和接触要求。
不要同时要求沿用环绕镜头,又让镜头始终固定。先解决要求之间的冲突,再增加描述。
从参考片段,到画布里的生成结果
先把一段短镜头做清楚,再增加人物、场景与动作的复杂度。
01
截取一个完整动作
第一次可选转身后抬手、起跳后落地这类短镜头。先保留动作起点、主要变化和结束,避开频繁切镜、长时间遮挡和多人混战。
不要只截最精彩的半个动作。起始姿态缺失,或落地前就结束,都会让生成和对照更难判断。
02
转换后,先看中间结果
用视频深度估计工具处理片段,拿到结果后与原片同步播放。检查手臂有没有和身体合并,两个人交错后是否还能分清,镜头移动时空间是否突然跳变。
中间参考已经丢掉关键轮廓时,先换更清楚的片段或调整提取方式。继续增加人物图和文字,不能直接补回已经缺失的运动线索。
03
在画布里指定参考关系
给素材命名为“运动参考”“目标人物”“目标场景”,与对应的生成节点放在一起。选择支持视频参考的生成入口,再按实际引用方式指定每份素材。
文字先说明各份参考负责什么,再补服装、道具和场景材质。模型、参考数量、时长及文件限制按实际界面确认,不把其他产品的参数照搬过来。
04
保留结果,再决定改哪一项
先对齐动作起点、变化最大处与结束位置,再看角色身份、服装、脚底接触、道具与遮挡。发现问题后,回到对应素材或要求做一次局部调整。
把生成结果留在对应参考旁边,并记录改动。后续换人物、调风格时,能够找回上一版的素材和设置,不必重新辨认整张画布。

画布操作图位置:完整显示素材、引用关系与对应生成结果。
怎样判断深度参考有没有帮上忙?
同一段动作可以保留两路结果:一路直接参考原视频,另一路参考深度视频。目标人物、提示内容与生成设置尽量保持一致,先比较真正发生变化的地方。
看运动
动作是否沿着原来的顺序发生
对齐起点、转折和结束,分别检查抬手、转身、落地与镜头变化。不要因为某个姿态相似,就判断整段运动都跟上了。
看外观
原片信息是否仍然混进来
除了脸、服装和体型,还要看整体材质与画风。如果动作已经准确,区别可能更多出现在视觉质感,而不是动作本身。
看接触
人物关系与场景是否成立
多人镜头看交错前后是否换了身份;再检查脚底、武器和障碍物的接触。人物体型与场景布局变化越大,越需要注意这些位置。
两路都符合目标,就选择更省事的一路。比较成本与重试次数时,分别记录两路实际尝试,不用精选结果估算成功率。
哪里不对,就从哪里开始调整
先看问题出现在中间参考,还是最终生成。下面五类现象对应不同的检查位置。
结果带着黑白灰或剪影感
先检查:目标外观信息不足,可能只提供了运动参考。
怎样调整:补充明确的人物、颜色、材质或风格信息,再对照结果。
衣摆、手臂或两个人混在一起
先检查:深度中间态可能已经合并轮廓。
怎样调整:先换遮挡较少的片段;多人镜头再检查角色对应。
人物与背景忽远忽近
先检查:深度序列可能出现帧间跳变。
怎样调整:先查看提取结果,尝试更连续的片段或适合视频的提取方式。
动作跟上了,画风仍不统一
先检查:人物、场景或风格参考可能互相冲突。
怎样调整:保留一套清楚的视觉方向,分别检查人物和背景的质感。
手脚、武器或物体接触不自然
先检查:目标体型和场景布局可能不适合原动作。
怎样调整:先缩小体型与空间的变化,检查具体接触时点,再逐步增加改动。
这些素材,先检查再使用
逆光、雾、暗场、宽大衣摆与长时间遮挡,可能让关键轮廓和空间层次难以辨认。先看转换后的画面是否保留了需要的线索,不能只凭原片好看来选。
提高分辨率不等于补回被遮挡的动作。提取后已经丢失的信息,应先从参考素材和提取方式处理。
轮廓已经混在一起
先回到参考素材处理
观察同一动作位置,确认手臂、衣摆或人物交错处是否仍可辨。换素材或调整提取方式后,再比较中间结果,不要直接跳到最终生成。
对比图位置:左侧放实际失败画面,右侧放调整后的对应画面;这组图片用于说明具体改动。


调整前
调整后
调整前 / 调整后 · 拖动查看图片位置
关于深度视频的常见问题
把视频调成黑白,就是深度视频吗?
不是。黑白处理改变颜色显示;深度估计处理画面中的远近关系。它们都可能呈现灰色,但提供的信息不同。
多人打斗一定比直接参考更好吗?
不能保证。尤其要检查交错前后、武器接触和动作最快的位置。用同一素材与相同设置对照,判断这一步是否解决了实际问题。
深度视频、三维白模和骨骼动捕是一回事吗?
不是。深度视频提供随时间变化的深度图;三维预演可以包含可编辑场景和相机;骨骼动捕描述关节运动。选择时先看现有素材和目标工具接收的输入。
视频时长、分辨率和费用怎么选?
按实际使用的提取工具和生成模型确认。先用一个完整短动作检查参考关系;提取与生成是不同环节,不把某一步免费当成整个制作免费。




