MetaDig

2026-09-03 更新:爆款复刻 30 秒以内一段生成到底,口播时机对齐原片

框选片段不超过 30 秒时分段生成一律只出一段、没有接缝;口播视频逐句保留原片说话时机;视频参考模式的提示词只写替换需求,镜头语言交给参考视频。

更新时间:2026-09-03

30 秒以内一律一段

此前一条 19 秒的换装视频可能被切成 3 段分别生成,段与段之间人物长相、服装、色调各自「重新掷骰子」,接缝处的动作断裂最先被看见,而且每段都单独计费。现在分段只由总时长决定:

「分段生成」步骤的标题下会直接写出本次的规则与「N 段 · X 秒」。已经切成多段的老项目不会自动改变,在参考图步重新点一次「确认参考」(1 积分)即按新规则重新反推。

口播视频:逐句保留说话时机

口播视频在提示词里此前只有一行「口播:整段台词」,12 秒 8 句话没有任何时机信息,视频模型只能均匀铺开。现在拆解时保留每句台词的起止时间,分段提示词里会渲染成逐句时间表(0.0s ~ 1.7s:「……」),生成的说话节奏与原片的口型、停顿对得上;歌词同理。

视频参考模式:提示词只写替换需求

选择「视频参考复刻」时,原片切片本身就是参考视频,镜头切换节奏、运镜、构图与转场时机都以它为准。提示词不再重复描述镜头,只写:被替换的人物 / 产品 / 场景以对应参考图为准、整体风格、口播时间表与画面文字。分段卡片里原片切片下方新增了镜头列表(每镜起止、口播标记、画面描述),提示词不描述镜头时也有对照。

Markdown 原文