---
title: 第 2 步 · 拉片报告：口播文案、画面总结、脚本总结、分镜表与复刻方式
section: 爆款复刻
source: https://waytometa.cn/docs/viral/step-report
summary: 拉片在服务端做的几件事与进度句；报告怎么读：题材卡（7 领域 24 种套路、置信度、判定依据）、原片面板（口播文案 / 画面总结）、脚本总结（结构公式、钩子形式、按题材的行 + 分镜引用）、钩子 / 节奏 / 内容精髓三张卡、分镜分析矩阵与画面逐帧；题材改判、四种复刻方式（反推提示词、关键帧、视频参考、精准编辑）怎么选；确认或要求重拆。
updated: 2026-09-19
---
第 2 步回答"这条视频是怎么拍的、为什么会爆、准备怎么复刻"。拉片跑完自动显示报告，看懂它，改判题材（如有必要），选定一种复刻方式，点「确认报告，开始复刻」；判得不对就要求重拆。

## 拉片在做什么

提交后这一屏会一句句显示进度：

1. 读取原片，按框选切出要分析的片段（之后所有时间都相对这一段从 0 起算）。
2. ffmpeg 场景检测测出镜头切点（双阈值，快切也能测），并判定切点可靠性；抽关键帧（切点优先 + 每镜首尾各一帧 + 均匀补足，最多 48 张）。
3. OCR 逐帧读画面文字；抽音轨做口播转写（句级时间戳）。
4. 把 480p 低清代理视频、关键帧、切点、OCR、转写一起交给分析模型，输出结构化报告：题材、视频概述、脚本总结、每一镜的画面描述 / 表达方式 / 场景 / 结构段落 / 运镜 / 景别 / 光影 / 叠字，以及钩子、节奏、内容精髓与一致性规则。渠道不收视频时自动只用关键帧重试。
5. 逐秒抽一排小图（供「画面逐帧」平铺）、裁每一镜的低清预览切片（分镜表悬停播放用），落库、结算积分，同步到画布。

通常几十秒到几分钟。**拉片失败不扣积分**，可直接「重新拉片」或换个模型再试；OCR、转写、切点、分镜切片任一环节失败只会在报告顶部标"有步骤失败"，不阻塞出报告。

## 报告怎么读

**题材卡。** 平台把爆款归成 **7 个领域 × 24 种套路**（电商营销、剧情叙事、知识科普、生活记录、音乐演出、游戏内容、娱乐搞笑）。卡上是「领域 · 套路」或「未能判定」、一段视频概述、置信度；点「判定依据」看模型的理由与它还考虑过哪些。

**原片面板。** 左边播放器；右边「视频时长 / 分镜数 / 抽帧数 / 节奏」，节奏标"不可信"时把鼠标放上去能看原因。下面两栏：

- **口播文案**：带时间码逐句，右上可整段复制。没有人声会写"这条视频没有检测到口播"。
- **画面总结**：出镜人物 / 关键道具 / 主要场景三组，每组带原片缩略图（人物是圆头像），点开看每个的描述和出现在哪几镜。原片只有纯色背景时不会有场景组。

**脚本总结。** 结构公式（如"视觉铺垫-节奏突变"）、钩子形式（悬念提问 / 反差视觉冲击 / 痛点直击…），以及按题材变化的几行：搞笑类是笑点结构 / 反差设置 / 节奏铺垫 / 记忆点，电商类是痛点与卖点 / 信任背书 / 转化钩子 / 记忆点，知识类是问题设置 / 论证结构 / 例证 / 总结金句……每一条后面的小圆标是它对应的分镜，点了直接跳到分镜表那一列并高亮。

**三张卡。**

- **钩子技法**：开头怎么抓人、语气、目标人群、原片行动号召；前 3 秒逐秒拆解。
- **节奏**：切点来源、镜头数、每分钟切点、平均 / 最短 / 最长镜头。"原片实测"可信；"画面变化太密 / 未测出按固定时长均分"时数字只作参考，卡上会挂"这栏数字不可信"。
- **内容精髓**：必须复刻的要素、需要你提供素材的部分（它在告诉你下一步得准备什么）、可以差异化的地方、全片必须保持不变的项与禁止项。

**分镜分析。** 一张横向分镜表，每一镜一列（表头与行头吸附，横向滑动）：

| 行 | 内容 |
| --- | --- |
| 画面分析 | 该镜缩略图，鼠标放上去播放这一镜的切片；右下角是镜长；下方起止时间 |
| 结构段落 | 一条按段落着色的色带，连续几镜同属一段会合成一格（如"视觉铺垫 / 节奏突变"） |
| 分镜概述 | 一句「景别，机位，运镜，画面内容」 |
| 画面描述 | 写给没看过片子的人：画面里有什么、在做什么、背景与氛围 |
| 脚本 | 这一镜对应的口播（按时间对齐） |
| 表达方式 | 口播讲解 / 字幕叙事 / 演示操作 / 肢体表演 / 卡点剪辑… |
| 场景 | 空间 / 环境 / 背景 |
| 镜头 | 拍摄角度 / 景别 / 运镜，下面小字是画面类型（实拍 / 3D 动画 / CG…）与画面文字 |

右上「复制分镜表」把整张表复制成文本。旁边「画面逐帧」Tab 是逐秒抽出的画面（≤60 秒每秒一帧，更长按每 N 秒一帧放稀并注明），点开看大图带「第 N 帧 · 时间码」。

某张卡标"未解读出内容"，或顶部提示"拉片过程中有步骤失败"，建议要求重拆一次——报告不完整会一路影响到成片。

## 题材判定

报告下方先是题材判定：先点领域，再点该领域下的套路。模型判出来了会写"判得不对？重选一个"；没判出来会标"模型没能判定，挑一个"，不挑不能往下走。改判只换标签，不重新跑拉片；要重算脚本总结请「要求重拆」。

## 复刻方式（对所有分段生效）

| 方式 | 向原片靠的方式 | 适合 | 限制 |
| --- | --- | --- | --- |
| 反推提示词复刻 | 只按反推提示词 + 你的参考图生成，不注入原片画面 | 口播为主、画面不重要；想离原片远一点 | — |
| 关键帧复刻 | 每段把该段原片关键帧追加为参考图（≤6 张），构图、机位、景别、色彩贴近原片 | 镜头稳、切点少，想"长得像" | 模型参考图数量要够 |
| 视频参考复刻 | 每段把原片切片作为参考视频，切换节奏与运镜贴近原片；提示词只写替换要求与口播 | ≤30 秒、靠运镜和节奏取胜 | 需支持视频输入的模型（Seedance 2.5 ≤30s，Wan 3 ≤15s） |
| **精准编辑复刻** | 以原片切片为唯一母版做视频局部编辑：只替换人物 / 产品 / 场景，镜头结构、运镜、时长、比例原样保留 | 保真要求最高的场景 | 仅 Seedance 2.5 稳定渠道，段长 4–30 秒；替换主体靠文字描述，不接参考图与参考音频 |

拉片完成后系统按片子特点**预设一种**并写明理由：≤30 秒一律预设视频参考；更长的按镜头多寡在反推提示词与关键帧之间推荐。你可以改，改过后显示"你已改过，原本预设 X"。个别段条件不满足时（如切片缺失、时长超模型上限）分段反推会自动降一档并在段卡上标出。

不管选哪种，原片素材都只用来定镜头语言——人物、产品、场景在下一步换成你的。

## 确认或重拆

- **确认报告，开始复刻**：进入第 3 步参考图。确认本身不收费。
- **要求重拆**：写清哪里判错（"钩子不是反差开场，是第一秒的价格数字"），这句话会带给分析模型；沿用上次的拆解模型，再收一次拉片费。

## 常见问题

**四种方式能按段混用吗？** 不能手选混用，但系统会按段自动降级：例如视频参考模式下某段超过所选模型的带视频时长上限，这一段会退回反推提示词模式，段卡上有标。

**精准编辑和视频参考有什么区别？** 视频参考是"看着原片重新生成一条"，人物长相靠参考图；精准编辑是"在原片上直接改"，除了被替换的主体一切照旧，因此最像原片，但只能用文字描述要换成什么。

**为什么节奏标"不可信"？** 画面变化太密（每镜不到 0.35 秒）或没测出切点时，节奏的数字只作参考，分段仍按实测边界走。

**确认之后还能回来改吗？** 第 2 步回看只读。报告一旦确认，下游参考图和分段都按它生成，要改请另开一次复刻。

## 相关

- [第 1 步 · 源视频](/docs/viral/step-source)
- [第 3 步 · 参考图](/docs/viral/step-references)
- [第 4 步 · 分段生成](/docs/viral/step-segments)
- [计费与常见问题](/docs/viral/credits-faq)
