---
title: 第 5 步 · 分段生成：提示词、模型参数、音色跟随原片与一致性自检
section: 爆款复刻
source: https://waytometa.cn/docs/viral/step-segments
summary: 每一段一张卡：反推提示词怎么改、@ 引用参考图、重新反推；放行的视频模型与默认参数；「音色跟随原片」把原片音轨作参考音频让口播音色一致；「一致性自检」1 积分给出分数、六维度、差异清单与建议提示词，一键应用后重新生成；全部段完成进入成片。
updated: 2026-09-03
---
第 5 步是真正花积分的地方：每一段一张卡，看提示词、选模型、点生成、看结果。做法是先把第一段调对，再批量生成其余段；不确定像不像就花 1 积分自检，按它给的建议改提示词。

## 分几段

≤30 秒的片子只有一张卡，一段生成到底；超过 30 秒按镜头切点切成若干段（每段 ≤30 秒），页头显示"N 段 · 总秒数"。卡头标着这一段在原片中的起止、复刻方式、有没有口播，以及已生成 / 生成失败 / 已手改等状态。

## 提示词

反推出来的提示词按固定结构写：一致性锁定（人物 / 服饰 / 道具必须保持项）→ 逐镜 [起–止] 主体 / 动作 / 运镜 / 景别 / 光影 → 口播时间表（逐句起止，"保持原片台词与时机"）或环境音 → 禁止项。画面文字不再让视频模型画（中文渲染不稳），改由第 6 步按时间叠回去。

- 可以直接改，改完点「保存」。输入 `@` 引用参考图，编号与下方"本段参考图"里的 @图片N 一致。
- 「重新反推」（1 积分）：写一句意见（"口播换成介绍我们的新款，语气更轻松"），AI 按意见重写这一段。
- 视频参考模式的提示词更短：镜头语言由参考视频承担，只写"跟随参考视频 + 替换要求 + 口播时间表"。精准编辑模式的提示词写"母版 = @视频1 / 替换什么 / 保留什么"。

右侧原片切片下方列出这一段的镜头表（起止、画面描述、口播逐句），改提示词时对照着看。

## 本段参考图

全局参考里归属本段实体的图、关键帧模式下的原片关键帧（≤6 张）、加上你专门给这一段传的图。「从画布选择」和「上传」只对这一段生效；下方"本段补充说明"会附在提示词末尾。精准编辑模式不接参考图。

## 模型与参数

分段生成只放行效果稳定的视频模型：**Seedance 2.5、Seedance 2.0、Wan 3、Wan 3 Prime、可灵 3.0 Omni**（目录里没上架的自动隐藏）。默认 Wan 3、720p；带参考视频默认 Seedance 2.5；精准编辑只能 Seedance 2.5。渠道、分辨率、时长、比例、音频开关在同一行，时长默认取盖住这一段的最小整秒档，模型盖不住时会提示。按钮上是这一段的积分，点「生成这一段」；生成过的变「重新生成」。

## 音色跟随原片

原片有口播时参数条多一个「音色跟随原片」开关，默认开：把这一段的原片音轨作为参考音频一起送进模型，人物的声音、语速和每一句的时机以它为准，口型同步，几段拼起来也是同一个声音。关掉则由模型自行配音，每次音色可能不同。

开关置灰时旁边写原因：音频被关掉；这一段没有任何参考图或参考视频（纯文字生成不能只带音频）；所选模型参考音频上限盖不住本段（Wan 3 15 秒，Seedance 2.5 30 秒）。

## 一致性自检

生成完一段后，结果下方多出「检查与原片的一致性」（**1 积分**）。系统把原片切片和生成结果一起交给拆解模型逐维度比对（渠道不收视频时退到关键帧 + 抽帧比对），半分钟左右给出：

- **总分**（0–100）：≥85 几乎一致，70–84 个别镜头偏差，≤50 主体或镜头结构明显跑偏；
- **六个维度**：镜头结构与时序、主体外观、运镜与构图、动作与节奏、光影与风格、文字与水印；
- **差异清单**：逐条可行动，按影响从大到小；
- **建议提示词**：在原提示词上只改需要改的地方。点「应用建议提示词」直接替换本段提示词，然后「重新生成」，再检查一次看分数是否上去。

被替换说明点名要换掉的人物 / 产品不算差异；原片有字幕而生成结果没有也不扣分（字幕在第 6 步叠回）。这一段重新生成后旧分数会标"已重新生成"，需要重查。自检失败不扣积分。

## 实际操作的几个习惯

- 先只生成第一段。同一套参考图和提示词写法，第一段对了后面大多也对。
- 生成是后台任务，切走再回来进度还在；失败的段不扣积分，看卡上的错误说明改参数再点。
- 全部段有结果后，底部「进入成片」亮起，进入第 6 步。

## 常见问题

**生成的段和原片差太多。** 先看复刻方式：反推提示词模式本来不注入原片画面，想更像切到关键帧、视频参考或精准编辑。再做一次自检，按差异清单改提示词比反复重新反推更可控。

**两段的人长得不一样。** 参考图步给人物一张清晰正脸并锁定；≤30 秒尽量一段到底不切段；口播类开着「音色跟随原片」至少保证声音一致。

**为什么我的模型下拉里没有某个模型？** 段长超过它的时长上限、它不支持参考视频 / 参考音频、或后台已下架，都会被过滤掉。

## 相关

- [第 6 步 · 成片](/docs/viral/step-final)
- [第 3 步 · 配方卡：四种复刻方式](/docs/viral/step-recipe)
- [计费与常见问题](/docs/viral/credits-faq)
