MetaDig

第 2 步 · 拉片报告:口播文案、画面总结、脚本总结、分镜表与复刻方式

拉片在服务端做的几件事与进度句;报告怎么读:题材卡(7 领域 24 种套路、置信度、判定依据)、原片面板(口播文案 / 画面总结)、脚本总结(结构公式、钩子形式、按题材的行 + 分镜引用)、钩子 / 节奏 / 内容精髓三张卡、分镜分析矩阵与画面逐帧;题材改判、四种复刻方式(反推提示词、关键帧、视频参考、精准编辑)怎么选;确认或要求重拆。

更新时间:2026-09-19

第 2 步回答"这条视频是怎么拍的、为什么会爆、准备怎么复刻"。拉片跑完自动显示报告,看懂它,改判题材(如有必要),选定一种复刻方式,点「确认报告,开始复刻」;判得不对就要求重拆。

拉片在做什么

提交后这一屏会一句句显示进度:

  1. 读取原片,按框选切出要分析的片段(之后所有时间都相对这一段从 0 起算)。
  2. ffmpeg 场景检测测出镜头切点(双阈值,快切也能测),并判定切点可靠性;抽关键帧(切点优先 + 每镜首尾各一帧 + 均匀补足,最多 48 张)。
  3. OCR 逐帧读画面文字;抽音轨做口播转写(句级时间戳)。
  4. 把 480p 低清代理视频、关键帧、切点、OCR、转写一起交给分析模型,输出结构化报告:题材、视频概述、脚本总结、每一镜的画面描述 / 表达方式 / 场景 / 结构段落 / 运镜 / 景别 / 光影 / 叠字,以及钩子、节奏、内容精髓与一致性规则。渠道不收视频时自动只用关键帧重试。
  5. 逐秒抽一排小图(供「画面逐帧」平铺)、裁每一镜的低清预览切片(分镜表悬停播放用),落库、结算积分,同步到画布。

通常几十秒到几分钟。拉片失败不扣积分,可直接「重新拉片」或换个模型再试;OCR、转写、切点、分镜切片任一环节失败只会在报告顶部标"有步骤失败",不阻塞出报告。

报告怎么读

题材卡。 平台把爆款归成 7 个领域 × 24 种套路(电商营销、剧情叙事、知识科普、生活记录、音乐演出、游戏内容、娱乐搞笑)。卡上是「领域 · 套路」或「未能判定」、一段视频概述、置信度;点「判定依据」看模型的理由与它还考虑过哪些。

原片面板。 左边播放器;右边「视频时长 / 分镜数 / 抽帧数 / 节奏」,节奏标"不可信"时把鼠标放上去能看原因。下面两栏:

脚本总结。 结构公式(如"视觉铺垫-节奏突变")、钩子形式(悬念提问 / 反差视觉冲击 / 痛点直击…),以及按题材变化的几行:搞笑类是笑点结构 / 反差设置 / 节奏铺垫 / 记忆点,电商类是痛点与卖点 / 信任背书 / 转化钩子 / 记忆点,知识类是问题设置 / 论证结构 / 例证 / 总结金句……每一条后面的小圆标是它对应的分镜,点了直接跳到分镜表那一列并高亮。

三张卡。

分镜分析。 一张横向分镜表,每一镜一列(表头与行头吸附,横向滑动):

内容
画面分析 该镜缩略图,鼠标放上去播放这一镜的切片;右下角是镜长;下方起止时间
结构段落 一条按段落着色的色带,连续几镜同属一段会合成一格(如"视觉铺垫 / 节奏突变")
分镜概述 一句「景别,机位,运镜,画面内容」
画面描述 写给没看过片子的人:画面里有什么、在做什么、背景与氛围
脚本 这一镜对应的口播(按时间对齐)
表达方式 口播讲解 / 字幕叙事 / 演示操作 / 肢体表演 / 卡点剪辑…
场景 空间 / 环境 / 背景
镜头 拍摄角度 / 景别 / 运镜,下面小字是画面类型(实拍 / 3D 动画 / CG…)与画面文字

右上「复制分镜表」把整张表复制成文本。旁边「画面逐帧」Tab 是逐秒抽出的画面(≤60 秒每秒一帧,更长按每 N 秒一帧放稀并注明),点开看大图带「第 N 帧 · 时间码」。

某张卡标"未解读出内容",或顶部提示"拉片过程中有步骤失败",建议要求重拆一次——报告不完整会一路影响到成片。

题材判定

报告下方先是题材判定:先点领域,再点该领域下的套路。模型判出来了会写"判得不对?重选一个";没判出来会标"模型没能判定,挑一个",不挑不能往下走。改判只换标签,不重新跑拉片;要重算脚本总结请「要求重拆」。

复刻方式(对所有分段生效)

方式 向原片靠的方式 适合 限制
反推提示词复刻 只按反推提示词 + 你的参考图生成,不注入原片画面 口播为主、画面不重要;想离原片远一点
关键帧复刻 每段把该段原片关键帧追加为参考图(≤6 张),构图、机位、景别、色彩贴近原片 镜头稳、切点少,想"长得像" 模型参考图数量要够
视频参考复刻 每段把原片切片作为参考视频,切换节奏与运镜贴近原片;提示词只写替换要求与口播 ≤30 秒、靠运镜和节奏取胜 需支持视频输入的模型(Seedance 2.5 ≤30s,Wan 3 ≤15s)
精准编辑复刻 以原片切片为唯一母版做视频局部编辑:只替换人物 / 产品 / 场景,镜头结构、运镜、时长、比例原样保留 保真要求最高的场景 仅 Seedance 2.5 稳定渠道,段长 4–30 秒;替换主体靠文字描述,不接参考图与参考音频

拉片完成后系统按片子特点预设一种并写明理由:≤30 秒一律预设视频参考;更长的按镜头多寡在反推提示词与关键帧之间推荐。你可以改,改过后显示"你已改过,原本预设 X"。个别段条件不满足时(如切片缺失、时长超模型上限)分段反推会自动降一档并在段卡上标出。

不管选哪种,原片素材都只用来定镜头语言——人物、产品、场景在下一步换成你的。

确认或重拆

常见问题

四种方式能按段混用吗? 不能手选混用,但系统会按段自动降级:例如视频参考模式下某段超过所选模型的带视频时长上限,这一段会退回反推提示词模式,段卡上有标。

精准编辑和视频参考有什么区别? 视频参考是"看着原片重新生成一条",人物长相靠参考图;精准编辑是"在原片上直接改",除了被替换的主体一切照旧,因此最像原片,但只能用文字描述要换成什么。

为什么节奏标"不可信"? 画面变化太密(每镜不到 0.35 秒)或没测出切点时,节奏的数字只作参考,分段仍按实测边界走。

确认之后还能回来改吗? 第 2 步回看只读。报告一旦确认,下游参考图和分段都按它生成,要改请另开一次复刻。

相关

Markdown 原文