第 5 步 · 分段生成:提示词、模型参数、音色跟随原片与一致性自检
每一段一张卡:反推提示词怎么改、@ 引用参考图、重新反推;放行的视频模型与默认参数;「音色跟随原片」把原片音轨作参考音频让口播音色一致;「一致性自检」1 积分给出分数、六维度、差异清单与建议提示词,一键应用后重新生成;全部段完成进入成片。
更新时间:2026-09-03
第 5 步是真正花积分的地方:每一段一张卡,看提示词、选模型、点生成、看结果。做法是先把第一段调对,再批量生成其余段;不确定像不像就花 1 积分自检,按它给的建议改提示词。
分几段
≤30 秒的片子只有一张卡,一段生成到底;超过 30 秒按镜头切点切成若干段(每段 ≤30 秒),页头显示"N 段 · 总秒数"。卡头标着这一段在原片中的起止、复刻方式、有没有口播,以及已生成 / 生成失败 / 已手改等状态。
提示词
反推出来的提示词按固定结构写:一致性锁定(人物 / 服饰 / 道具必须保持项)→ 逐镜 [起–止] 主体 / 动作 / 运镜 / 景别 / 光影 → 口播时间表(逐句起止,"保持原片台词与时机")或环境音 → 禁止项。画面文字不再让视频模型画(中文渲染不稳),改由第 6 步按时间叠回去。
- 可以直接改,改完点「保存」。输入
@引用参考图,编号与下方"本段参考图"里的 @图片N 一致。 - 「重新反推」(1 积分):写一句意见("口播换成介绍我们的新款,语气更轻松"),AI 按意见重写这一段。
- 视频参考模式的提示词更短:镜头语言由参考视频承担,只写"跟随参考视频 + 替换要求 + 口播时间表"。精准编辑模式的提示词写"母版 = @视频1 / 替换什么 / 保留什么"。
右侧原片切片下方列出这一段的镜头表(起止、画面描述、口播逐句),改提示词时对照着看。
本段参考图
全局参考里归属本段实体的图、关键帧模式下的原片关键帧(≤6 张)、加上你专门给这一段传的图。「从画布选择」和「上传」只对这一段生效;下方"本段补充说明"会附在提示词末尾。精准编辑模式不接参考图。
模型与参数
分段生成只放行效果稳定的视频模型:Seedance 2.5、Seedance 2.0、Wan 3、Wan 3 Prime、可灵 3.0 Omni(目录里没上架的自动隐藏)。默认 Wan 3、720p;带参考视频默认 Seedance 2.5;精准编辑只能 Seedance 2.5。渠道、分辨率、时长、比例、音频开关在同一行,时长默认取盖住这一段的最小整秒档,模型盖不住时会提示。按钮上是这一段的积分,点「生成这一段」;生成过的变「重新生成」。
音色跟随原片
原片有口播时参数条多一个「音色跟随原片」开关,默认开:把这一段的原片音轨作为参考音频一起送进模型,人物的声音、语速和每一句的时机以它为准,口型同步,几段拼起来也是同一个声音。关掉则由模型自行配音,每次音色可能不同。
开关置灰时旁边写原因:音频被关掉;这一段没有任何参考图或参考视频(纯文字生成不能只带音频);所选模型参考音频上限盖不住本段(Wan 3 15 秒,Seedance 2.5 30 秒)。
一致性自检
生成完一段后,结果下方多出「检查与原片的一致性」(1 积分)。系统把原片切片和生成结果一起交给拆解模型逐维度比对(渠道不收视频时退到关键帧 + 抽帧比对),半分钟左右给出:
- 总分(0–100):≥85 几乎一致,70–84 个别镜头偏差,≤50 主体或镜头结构明显跑偏;
- 六个维度:镜头结构与时序、主体外观、运镜与构图、动作与节奏、光影与风格、文字与水印;
- 差异清单:逐条可行动,按影响从大到小;
- 建议提示词:在原提示词上只改需要改的地方。点「应用建议提示词」直接替换本段提示词,然后「重新生成」,再检查一次看分数是否上去。
被替换说明点名要换掉的人物 / 产品不算差异;原片有字幕而生成结果没有也不扣分(字幕在第 6 步叠回)。这一段重新生成后旧分数会标"已重新生成",需要重查。自检失败不扣积分。
实际操作的几个习惯
- 先只生成第一段。同一套参考图和提示词写法,第一段对了后面大多也对。
- 生成是后台任务,切走再回来进度还在;失败的段不扣积分,看卡上的错误说明改参数再点。
- 全部段有结果后,底部「进入成片」亮起,进入第 6 步。
常见问题
生成的段和原片差太多。 先看复刻方式:反推提示词模式本来不注入原片画面,想更像切到关键帧、视频参考或精准编辑。再做一次自检,按差异清单改提示词比反复重新反推更可控。
两段的人长得不一样。 参考图步给人物一张清晰正脸并锁定;≤30 秒尽量一段到底不切段;口播类开着「音色跟随原片」至少保证声音一致。
为什么我的模型下拉里没有某个模型? 段长超过它的时长上限、它不支持参考视频 / 参考音频、或后台已下架,都会被过滤掉。