# MetaDig 文档全文合集 > MetaDig(元界深掘)是一站式AI视频专业创作平台:在无限画布上完成文生视频、图生视频、数字人、AI配音配乐与剪辑合成,海量模板一键复用,支持团队实时协作,高效产出商用级AI视频。 > 站点说明见 https://waytometa.cn/llms.txt ;每篇文档另有单独的 Markdown 地址(页面地址 + .md)。 --- # 爆款复刻完全指南:六步把一条爆款拆开,换上你的产品重拍一条 - 栏目:爆款复刻 - 地址:https://waytometa.cn/docs/viral/guide - Markdown:https://waytometa.cn/docs/viral/guide.md - 摘要:从准备视频到拿到成片的每一步都讲清楚:框选片段、看懂配方卡、三种复刻方式怎么选、人物产品场景怎么替换、分段生成怎么调、每一步花多少积分,以及开源和复刻同款。 - 更新:2026-09-03 刷到一条爆款,你能感觉到它"对"——开头三秒抓人、节奏舒服、镜头会讲话——但要自己照着做一条,往往卡在"它到底做对了什么"。爆款复刻做的就是这件事:把一条视频拆成可以读懂的配方(钩子技法、节奏、分镜语言、内容精髓),再按这份配方,换上你自己的人物、产品和场景,逐段重新生成一条成片。 它不是把原片抠下来换个脸。原片只用来定"怎么拍":镜头怎么切、节奏怎么走、钩子怎么埋。画面里出现的东西全是你的。整个过程里产生的每一样东西——源片、框选片段、关键帧、参考图、每一段的提示词和成片——都会归档到一张关联画布里,随时可以进去精修。 ## 开始之前 **视频本身。** 支持 mp4 / mov / m4v / webm,单个文件不超过 50MB,总时长不超过 10 分钟。单次能分析的是 60 秒以内的一段,视频更长的话下一步要框出你想复刻的那一段,最终成片也只复刻框出的部分。 **从哪来。** 两种给法:上传文件,或者粘贴指向视频文件本体的直链(形如 `https://…/xxx.mp4`)。抖音、小红书、B 站、YouTube 这类平台的页面地址是不行的——它们给的是网页不是视频文件。先用平台自己的下载功能把视频存到本地,再上传。 **积分预算。** 各环节分开计费,后面每一步都会标出来,这里先给个整体概念:拆解一次 5 到 30 积分看你选的分析模型(默认 10),分段反推 1 积分,参考图按生图模型单价,每一段视频按视频模型单价,最后拼接成片免费。失败的任务不扣积分。把预算大头记住就行:视频段。 **关联画布。** 每次复刻都绑一张画布。默认新建一张,也可以在开始前选一张已有的——比如你想把几次复刻的素材放一起。选团队空间里的画布时,这次复刻消耗的积分从空间所有者的账户扣。 ## 第 1 步:给它一条视频 左侧栏进「爆款复刻」,首屏就是入口。粘贴直链,或者点「选择文件」/把视频直接拖进来。选好后文件卡上会显示大小、时长和分辨率;超过 60 秒会提前提醒你下一步要框选。 右下角可以先选关联画布,然后点「开始复刻」。按钮会依次变成"上传中 xx%"和"解析中"——解析这一步在读视频的真实时长、宽高,并把源片放进画布。几秒钟后进入工作台,左边是六步导航,右上角常驻「在画布中打开」和「设为开源」。 > [!TIP] 一张画布可以复刻多次 > 选一张已经绑过复刻的画布时,会提示"该画布上已有 N 次复刻"。新的产物会归到同一张画布里,各自分目录,不会覆盖之前的。 ## 第 2 步:框出要复刻的那一段 这一步是一条带两个把手的时间轴。不动把手就是分析全片(前提是全片不超过 60 秒);拖动把手框出一段,之后的拆解、分段和成片就只针对这一段。 几个细节: - 点一下把手选中它,再用 ← → 键微调,按住 Shift 步子更大。Esc 取消选中。 - 「播放选段」只播你框出的区间,方便反复确认起止点。 - 框选后下面会告诉你这一段会怎么生成:不超过 30 秒的话"一段生成到底、没有接缝";超过 30 秒会按镜头切点切成几段分别生成,段与段之间会有接缝。**能框 30 秒以内就尽量框 30 秒以内**,成片会干净很多。 右下角选拆解用的分析模型。不同模型的拆解价不一样(下拉里直接标着积分),默认是 Gemini 3.1 Pro,10 积分,配方质量和价格比较平衡;便宜的 5 积分,贵的 25 到 30 积分。带皇冠的模型是会员专属。选好点「开始拆解」。 拆解会做几件事:按镜头切点抽关键帧(最多 48 张,切点处优先、每镜首尾各一帧)、OCR 读画面文字、转写口播(句级时间戳)、实测每个镜头的起止时间,然后把这些连同一份 480p 的低清代理视频一起交给分析模型"看片"。通常 15 到 60 秒。拆解失败不扣积分,可以直接点「重新拆解」。 ## 第 3 步:看懂配方卡 标题就是这一步的问题:这条视频为什么会爆。页面分几块。 **识别到的套路。** 平台把常见的爆款归成 6 个领域、21 种套路(电商营销、剧情叙事、知识科普、生活记录、音乐演出、游戏内容各自下面几种),模型会判定这条属于哪一种,给出理由、置信度和次选。判得不对可以直接改:右侧先点领域,再点该领域下的套路。模型拿不准时会明确标出来让你手动指定,不指定不能往下走。 **四张配方卡。** - 钩子技法:开头是怎么抓人的,语气、目标人群,原片的行动号召是什么。 - 节奏:镜头数、每分钟切点、平均/最短/最长镜头时长。注意看"切点来源"——"原片实测"是 ffmpeg 真测出来的;"画面变化太密"或"按固定时长均分"说明这条片子切得太碎或测不准,数字参考价值打折,卡上也会挂"这栏数字不可信"。 - 分镜语言:每一镜的时间段、运镜方式,以及一句话的"景别,机位,运镜,画面内容"。这是后面每段提示词的骨架。 - 内容精髓:必须复刻的要素、需要你提供素材的部分、可以差异化的地方。第二条尤其要看,它在告诉你下一步得准备什么。 某张卡标"未解读出内容",或者底部提示"拆解过程中有步骤失败",建议打回重拆一次,配方不完整会一路影响到成片。 **复刻方式。** 这是第 3 步最重要的一个选择,对所有分段生效: | 方式 | 生成时怎么向原片靠 | 适合什么 | | --- | --- | --- | | 反推提示词复刻 | 只按反推出的提示词和你的参考图生成,不注入原片画面 | 口播为主、画面本身不重要的片子;想离原片远一点 | | 关键帧复刻 | 每段把该段的原片关键帧追加为参考图,构图、机位、景别、色彩贴近原片 | 镜头稳、切点少的片子,想"长得像" | | 视频参考复刻 | 每段把该段原片切片当参考视频,镜头切换节奏和运镜贴近原片;提示词只写替换要求与口播 | 30 秒以内、靠运镜和节奏取胜的片子;只有支持视频输入的模型能用 | | 精准编辑复刻 | 以原片切片为唯一母版做视频局部编辑:只替换人物 / 产品 / 场景,镜头结构、运镜、时长、比例原样保留 | 保真要求最高;仅 Seedance 2.5、段长 4–30 秒,替换主体靠文字描述、不接参考图 | 拆解完成后系统会按这条片子的特点预设一种,并写明理由(30 秒以内一律预设视频参考)。你可以改,改过后会显示"你已改过,原本预设 X"。个别段条件不满足时(切片缺失、时长超模型上限)分段反推会自动降一档并在段卡上标出。不管选哪种,原片素材都只用来定镜头语言——人物、产品和场景照样可以在下一步换成你的。 看完没问题,点「确认配方,准备参考图」。有问题点「要求重拆」,写清哪里判错了("钩子不是反差开场,是第一秒的价格数字"这种),重拆时这句话会带给分析器。重拆会再收一次拆解费。 ## 第 4 步:确定人物、产品与场景 拆解时模型会从原片里认出人物(最多 6 个)、产品(最多 3 个)、场景(最多 2 个),每个一张卡。这一步决定的是"画面里出现的是谁、是什么、在哪",也是把原片换成你自己东西的地方。 先看顶部的**整体画风**。它会写进下面每一张参考图的生成指令。原片是动画或 3D 的话这一栏别空着——留空时生图模型默认按照片写实来画,人物参考图会变成真人。写一句"美式 3D 动画,硬边高光,撞色高饱和"就够了。 每张实体卡有名字、描述和"看得最清楚的那张原片关键帧",下面三个页签: - **按原片生成**:以关键帧为底,人物生成三视图加脸部特写(纯白底、锁定长相),产品生成正面、45°、侧面的白底商品图(包装标签按原片保留),场景生成无人空景图。关键帧看不清的话可以再补几张照片。 - **独立生成**:不看原片,按你写的描述生成。上传你的照片可以锁定长相或包装。 - **独立上传**:从画布里挑一张或直接上传,不生成、不花积分。**要换成自己的产品,这一条最省事**——传一张你的产品图就完了。 生成参考图默认用 GPT Image 2、2K,比例会自动匹配源片,卡上可以换模型和参数,按钮上标着积分。认多了删掉(纯色背景那种没信息的场景可以直接删,省一次生图),认少了用下面的「添加人物 / 产品 / 场景」补一张卡。 再往下是**补充参考图**:Logo、字体样张、风格参考这类上面卡片覆盖不到的东西放这里,每一段都会送进去。旁边还有一个"替换要求"输入框,比如"产品必须始终以正面出现"。 如果这次拆解没识别出结构化的实体,页面会改成让你直接从关键帧里挑几张、或上传图片作为全局参考。都不想弄,也可以跳过。 定好后点「确认参考,开始分段」。系统会按配方和参考反推每一段的提示词,1 积分,一两分钟,完成后自动进入下一步。 ## 第 5 步:分段生成 按镜头切点切成的每一段是一张卡(整条不超过 30 秒就只有一张)。卡头标着这一段的时间范围、复刻方式、有没有口播,以及"已生成 / 生成失败 / 已手改"这些状态。 每张卡从上到下: **提示词。** 反推出来的,按固定结构写:一致性锁定 → 逐镜主体 / 动作 / 运镜 / 景别 / 光影 → 口播逐句时间表或环境音 → 禁止项;画面文字不让视频模型画,留到第 6 步按时机叠回。可以直接改,改完点「保存」。输入 `@` 可以引用参考图,编号和下面"本段参考图"里的 @图片N 一致。想让 AI 按你的意见重写,点「重新反推」,写一句"口播换成介绍我们的新款,语气更轻松",1 积分。右侧原片切片下方列着这一段的镜头表与口播逐句,改提示词时对照着看。 **本段参考图。** 全局参考、原片关键帧(关键帧模式下)、加上你专门给这一段的图。「从画布选择」和「上传」都只对这一段生效。底下还有一个"本段补充说明",会附在提示词末尾。 **模型和参数。** 分段生成只放行几款效果稳定的视频模型(当前是 Seedance 2.5、Seedance 2.0、Wan 3、Wan 3 Prime、可灵 3.0 Omni,目录里没上架的自动隐藏),默认 Wan 3、720p;视频参考模式默认 Seedance 2.5,因为它吃参考视频;精准编辑只能 Seedance 2.5。渠道、分辨率、时长、比例、音频开关都在这一行,时长默认贴着这一段的原片长度。按钮上是这一段的积分,点「生成这一段」;生成过的变成「重新生成」。 **音色跟随原片。** 原片有口播时,这一行还会多一个「音色跟随原片」开关,默认打开:把这一段的原片音轨作为参考音频一起送进模型,人物说话的声音、语速和每一句的时机都以它为准,口型跟着对上,几段拼起来也是同一个声音。关掉就由模型自己配音,每次生成的音色可能不一样。开关置灰时旁边会写原因——音频被关掉了、这一段没有任何参考图或参考视频(纯文字生成不能只带音频),或者所选模型的参考音频最长只有 15 秒、盖不住这一段(换 Seedance 2.5 可到 30 秒)。 **原片这一段 vs 生成结果。** 卡片右侧并排,边看边调。 **一致性自检。** 生成完一段后,结果下方多出「检查与原片的一致性」(1 积分):把原片切片和生成结果一起交给拆解模型逐维度比对,半分钟左右给出 0–100 的总分(≥85 几乎一致,70–84 个别偏差,≤50 明显跑偏)、六个维度(镜头结构与时序、主体外观、运镜与构图、动作与节奏、光影与风格、文字与水印)、逐条可行动的差异清单,以及一份改好的提示词。点「应用建议提示词」直接替换本段提示词,重新生成后再查一次。被替换说明点名要换掉的人物 / 产品不算差异;这一段重新生成后旧分数会标"已重新生成"。自检失败不扣积分。 页面顶部还有一块**全局参考**和"替换说明",是第 4 步内容的延伸,这里改了所有段都吃。 几个实际操作里的经验:先生成一段看效果,再批量点其它段——同一套参考图和提示词写法,第一段对了后面大多也对。生成是后台任务,切到别的页面再回来,进度还在。某段失败了不扣积分,看一眼卡上的错误说明,通常是参数或参考图的问题,改了再点。 全部段都有结果后,底部「进入成片」亮起。 ## 第 6 步:成片 全部段生成后进入的轻量编辑器,改什么都免费、导出免费、可以反复导: - **段顺序与裁剪**:每段可上移 / 下移,首尾各裁几秒(每段至少留 0.5 秒);某段不满意「回分段重生成」只重做那一段。 - **音轨四选一**:模型直出音频(各段自带声音按段拼接)/ 沿用原片音轨(各段按原片时间对齐,调过顺序也不错位)/ 上传配乐(静音各段铺一条音乐,可调音量)/ 静音。 - **画面文字还原**:原片的字幕、标题、价格标、贴纸按原片镜头时机叠回成片,位置与字号按原片类型;总开关 + 逐条开关,旧配方未区分的项默认关。服务器需要中文字体(部署镜像已内置),缺字体时导出跳过叠字并提示。 - **导出**:服务端 ffmpeg 合成,几十秒到一两分钟,进度实时。完成后原片与成片并排对照,「下载成片」拿文件,「设为开源」公开,「再复刻一条」回到入口。 想精修的话点头部「在画布中打开」。源片、框选片段、关键帧、全局参考、每一段的原片切片和生成结果、成片,全部已经按组摆在画布上——可以给某一段重新生成、换模型、加转场,或者把段拖进时间线重新剪。复刻只负责把你送到"有一条可用的成片"这一步,之后就是普通的画布创作。 ## 随时回看、随时改 左侧六步导航里,走过的步骤都能点回去看。第 4 步(参考图)和第 5 步(分段)回看时仍然可以改:换参考图、改提示词、重新生成某一段,保存后在重新反推或重新生成时生效。第 2、3 步回看是只读的——配方一旦确认,下游的参考图和分段都是按它生成的,改它等于全部重来,所以想换视频或者重拆,请另开一次复刻。 左侧栏的历史列表能看到每条复刻走到了第几步,悬停可以改名、删除。删除只是从列表移除,那次运行的画布和文件都还在「我的作品」里。 ## 开源与复刻同款 点头部「设为开源」,这条复刻的成片、提示词和参考图会公开,出现在复刻首页的「开源复刻」墙和你的个人主页上,随时可以取消。 墙上任何一条,点开看详情,「复刻同款」会复用它的源片、配方和每一段的提示词,给你新建一张画布,直接从第 4 步(参考图)开始——**不收拆解费**。你只需要把人物、产品、场景换成自己的,然后生成。这是上手最快的一条路:先找一条套路对的开源复刻,同款一下,比从零拆更省。 ## 每一步花多少积分 | 环节 | 积分 | 说明 | | --- | --- | --- | | 拆解 | 5 – 30 | 按所选分析模型,默认 Gemini 3.1 Pro 10 积分;失败不扣;「要求重拆」再收一次 | | 分段反推 | 1 | 确认参考后自动进行 | | 单段重新反推 | 1 | 每次点「重新反推」 | | 参考图生成 | 按生图模型 | 默认 GPT Image 2 · 2K;上传或从画布选择免费 | | 分段视频 | 按视频模型 | 按钮上实时显示;带参考视频 / 精准编辑的单价可能更高 | | 一致性自检 | 1 | 每段每次;失败不扣 | | 成片导出 | 免费 | 可反复导 | | 复刻同款 | 不收拆解费 | 之后的参考图与分段照常计费 | ## 常见问题 **抖音 / 小红书的链接贴进去报错。** 平台页面地址不是视频文件。用平台的保存功能下载到本地再上传。 **视频有两分钟,能整条复刻吗?** 单次只分析 60 秒以内。在第 2 步框出最想复刻的那一段——一般是开头钩子最强的部分。要复刻多段就多开几次复刻,绑同一张画布。 **原片是动画,参考图却生成了真人。** 第 4 步顶部的「整体画风」没填。填一句风格描述再重新生成参考图。 **生成的段和原片差太多。** 先看复刻方式:反推提示词模式本来就不注入原片画面,想更像就切到关键帧、视频参考(框选段在 30 秒内且模型支持视频输入)或精准编辑。再花 1 积分做一次一致性自检,按差异清单改提示词,比反复重新反推更可控。 **段与段之间有明显接缝。** 框选超过 30 秒就会切段,接缝无法完全避免。要么框 30 秒以内,要么在成片步把接缝处首尾各裁几帧,再进画布用时间线加转场。 **两段人物音色不一样。** 第 5 步开着「音色跟随原片」生成,或者成片步音轨选「沿用原片音轨」。 **配方判的套路不对。** 第 3 步右侧直接改判,或者写意见「要求重拆」。 **能在手机上用吗?** 可以,六步都做了手机端适配:历史面板是抽屉,主按钮固定在底部,片段范围有 ±0.1s 微调按钮。改长提示词建议在电脑上。 --- # 五分钟上手爆款复刻:从一条视频到一条成片 - 栏目:爆款复刻 - 地址:https://waytometa.cn/docs/viral/quick-start - Markdown:https://waytometa.cn/docs/viral/quick-start.md - 摘要:最短路径走一遍六步:上传或贴直链、框 30 秒以内、确认配方与复刻方式、把人物产品换成自己的、逐段生成并自检、在成片步调音轨与叠字后导出。每一步该点什么、花多少积分,一页说清。 - 更新:2026-09-03 爆款复刻把一条视频拆成"配方"(钩子、节奏、分镜、精髓),再按配方换上你的人物、产品和场景重新生成一条成片。完整走一遍是六步,熟练后一条 30 秒的片子从上传到成片大约十分钟,积分大头在分段视频生成。 ## 六步一览 | 步 | 你要做的 | 系统做的 | 积分 | | --- | --- | --- | --- | | 1 源视频 | 上传 mp4 / mov / webm,或贴视频文件直链;选关联画布 | 探测时长与宽高,源片进画布 | 0 | | 2 片段范围 | 框出要复刻的一段(尽量 ≤30 秒),选拆解模型 | 切片、切点检测、抽 48 张关键帧、OCR、口播转写,视频交给分析模型 | 5–30(默认 10) | | 3 配方卡 | 看套路与四张卡,确认复刻方式 | 判定套路、写四张卡、预设复刻方式 | 0 | | 4 参考图 | 决定人物 / 产品 / 场景用谁的图;上传最省 | 按原片关键帧生成三视图 / 商品图 / 空景 | 按生图模型;上传免费 | | 5 分段生成 | 逐段看提示词、选模型、点生成;可自检 | 反推每段提示词;生成视频;比对一致性 | 反推 1 + 每段视频按模型 + 自检 1 | | 6 成片 | 调顺序、裁首尾、选音轨、还原画面文字,导出 | ffmpeg 合成 | 0 | ## 最快的一条路 1. **左侧栏进「爆款复刻」**,粘贴视频直链或拖入文件,点「开始复刻」。 2. **框选**:视频超过 30 秒时把两个把手拖到最想复刻的 30 秒内(一般是开头钩子最强的部分),点「开始拆解」。等 15–60 秒。 3. **配方卡**:套路判得不对就右侧改判;复刻方式先用系统预设的那一种。点「确认配方,准备参考图」。 4. **参考图**:要换成自己的产品,在产品卡选「独立上传」传一张图;人物同理。其它卡不需要的直接删。点「确认参考,开始分段」,等一两分钟反推提示词。 5. **分段生成**:先只生成第一段。看结果不满意,点卡片右下「检查与原片的一致性」拿分数和差异清单,一键「应用建议提示词」后重新生成;满意了再点其余段。 6. **成片**:全部段有结果后自动进入。口播类内容选「沿用原片音轨」或保持「模型直出」,勾上要还原的画面文字,点「导出成片」。导出免费,几十秒。 ## 几个能省积分的习惯 - 拆解前先想清楚框哪 30 秒。超过 30 秒会切成多段,每段单独收费还有接缝。 - 参考图能上传就上传,生图才花积分。 - 第一段先用便宜档位试提示词,对了再批量生成其余段。 - 一致性自检 1 积分,比盲目重新生成一段(几十积分)划算。 - 开源墙上找一条套路对的,「复刻同款」不收拆解费,直接从参考图步开始。 ## 常见问题 **必须走完六步吗?** 参考图步可以跳过(不换人物产品时);成片步的编辑都可以不动直接导出。其它步骤是链路必经。 **中途关了页面进度会丢吗?** 不会。所有任务都在服务端,左侧历史列表里点回来接着做。 **手机能用吗?** 可以。六步都做了手机适配:历史面板是抽屉,主按钮固定在底部,片段范围有 ±0.1s 微调按钮。改长提示词仍建议在电脑上。 ## 相关 - [爆款复刻完全指南](/docs/viral/guide):每一步的所有细节 - [第 5 步:分段生成](/docs/viral/step-segments):四种复刻方式、音色跟随原片、一致性自检 - [计费与常见问题](/docs/viral/credits-faq) --- # 第 1 步 · 源视频:支持什么格式、从哪来、绑哪张画布 - 栏目:爆款复刻 - 地址:https://waytometa.cn/docs/viral/step-source - Markdown:https://waytometa.cn/docs/viral/step-source.md - 摘要:爆款复刻的入口:上传 mp4 / mov / m4v / webm(≤50MB、≤10 分钟)或粘贴视频文件直链;抖音 / 小红书 / B 站页面链接为什么不行、怎么处理;关联画布怎么选、团队空间扣谁的积分。 - 更新:2026-09-03 第 1 步只回答一个问题:拿哪条视频来拆。给它一个视频文件(上传或直链),选好这次复刻归到哪张画布,点「开始复刻」就进工作台。 ## 支持的视频 | 项 | 限制 | | --- | --- | | 格式 | mp4 / mov / m4v / webm(也接受 mkv / avi 扩展名,转存后按实际编码探测) | | 大小 | 单个文件 ≤ 50MB | | 总时长 | ≤ 10 分钟;单次只分析其中 ≤60 秒的一段,更长的视频下一步框选 | | 分辩率 | 无硬性要求;成片比例默认跟源片 | ## 两种给法 **上传文件。** 点「选择文件」或把视频拖进输入卡。上传进度显示在按钮上("上传中 xx%"),走的是画布的上传管道,文件落在关联画布的目录下。 **粘贴直链。** 直链指的是指向视频文件本体的地址,形如 `https://…/xxx.mp4`。系统会先校验后缀与响应类型,再转存一份到自己的存储(同样受 50MB 限制),之后所有处理都用这份副本,原地址失效不影响。 > [!WARNING] 平台页面链接不是直链 > 抖音、小红书、B 站、YouTube、快手、微博、Instagram 等 22 个社媒域名的地址会被直接拒绝——它们返回的是网页,不是视频文件。先用平台自带的"保存到本地"下载,再上传。错误提示里有一键「换成上传文件」。 ## 关联画布 每次复刻绑一张画布,源片、框选片段、关键帧、参考图、每一段的提示词与生成结果、成片,全部按组落到这张画布上,随时进去精修。 - 默认新建一张,标题按时间自动起(工作台头部可改名,改的是画布标题)。 - 也可以在下拉里搜一张已有画布:想把几次复刻的素材放一起就选同一张。已绑过复刻的画布会提示"已关联 N 次",新产物各自分目录、不覆盖。 - 选团队空间里的画布时,这次复刻消耗的积分从**空间所有者**账户扣,团队配额规则照常生效。 ## 解析在做什么 点「开始复刻」后按钮依次显示"上传中 → 解析中"。解析用 ffprobe 读出真实时长、宽高,把源片放进画布,并判断是否超过 60 秒——超过的话第 2 步会强制框选。几秒钟完成,进入工作台后左侧是六步导航,右上常驻「在画布中打开」。 ## 常见问题 **上传到一半失败了。** 多半是网络或文件超 50MB。压一下码率再传;超过 10 分钟的先剪出想复刻的部分。 **直链能用但视频是竖屏黑边的。** 转存不改画面。成片比例在第 6 步默认跟源片,黑边会一起保留;想去掉进画布裁切。 **能同时拆几条吗?** 可以,每条一次复刻。左侧历史列表里各自独立。 ## 相关 - [第 2 步 · 片段范围](/docs/viral/step-segment) - [五分钟上手](/docs/viral/quick-start) --- # 第 2 步 · 片段范围:为什么要框 30 秒以内,拆解模型怎么选 - 栏目:爆款复刻 - 地址:https://waytometa.cn/docs/viral/step-segment - Markdown:https://waytometa.cn/docs/viral/step-segment.md - 摘要:用时间轴两个把手框出要复刻的一段(≤60 秒可拆解,≤30 秒一段生成到底没有接缝);键盘与 ±0.1s 微调;拆解模型按积分分档(5 到 30,默认 Gemini 3.1 Pro 10 积分);拆解会做的六件事与耗时。 - 更新:2026-09-03 第 2 步决定"拆哪一段、用哪个模型拆"。规则只有两条:单次最多分析 60 秒;框出的一段不超过 30 秒时整条一次生成到底、没有接缝。 ## 框选 时间轴上两个把手。不动它就是分析全片(前提全片 ≤60 秒);拖动框出一段后,之后的拆解、分段、成片都只针对这一段,成片也只复刻这一段。 - 点把手选中,← → 键微调,Shift 加大步子,Esc 取消;手机上用把手旁的「−0.1s / +0.1s」按钮。 - 「播放选段」只播框出的区间,反复确认起止点。 - 框选后下方会预告生成方式:≤30 秒"一段生成到底、没有接缝";>30 秒"按镜头切点切成 N 段分别生成,段与段之间会有接缝"。 > [!TIP] 30 秒是分水岭 > 视频模型单次生成窗口是 30 秒。一次生成盖得住时,分段只有代价没有收益:每道接缝都是人物长相、服装、色调重新掷一次骰子,接缝处的动作断裂最先被看见,而且每段单独计费。即使片子中途换了人物和场景也不会为此拆段。能框 30 秒以内就框 30 秒以内。 ## 拆解模型 右下角下拉选分析模型,价格直接标在选项上: | 档 | 模型举例 | 积分/次 | | --- | --- | --- | | 经济 | Gemini 3.1 Flash Lite、Qwen 3.6 Flash、Claude Haiku 4.5 | 5 | | 均衡 | Qwen 3.6 Plus、Qwen 3.7 Flash | 8 | | 默认 | **Gemini 3.1 Pro**、Qwen 3.7 Plus | 10 | | 高配 | Claude Sonnet 4.6 | 12 | | 旗舰 | GPT 5.5 / 5.6 Sol | 20 | | 旗舰 | Claude Opus 4.6 / 4.7 / 4.8 | 25–30 | 默认 Gemini 3.1 Pro:配方质量与价格最平衡。带皇冠的是会员专属。价格可在后台改,以下拉里显示的为准。 ## 点「开始拆解」后发生什么 1. 按框选切出片段,之后所有时间都相对这一段从 0 起算。 2. ffmpeg 场景检测测出镜头切点(双阈值,快切也能测),并判定切点可靠性。 3. 抽关键帧:切点优先 + 每个镜头首尾各一帧 + 均匀补足,最多 48 张。 4. OCR 逐帧读画面文字;抽音轨做口播转写(句级时间戳)。 5. 把 480p 的低清代理视频、关键帧、切点、OCR、转写一起交给分析模型,输出结构化配方(每镜的主体动作、运镜、景别、光影、叠字、转场,以及全局的一致性规则)。渠道不收视频时自动只用关键帧重试。 6. 落库、结算积分,同步到画布。 通常 15 到 60 秒。**拆解失败不扣积分**,可直接重拆;OCR、转写、切点任一环节失败只会在配方卡上标"有步骤失败",不阻塞出配方。 ## 常见问题 **视频 2 分钟,能整条复刻吗?** 不能一次完成。框出最想复刻的 60 秒以内(推荐 30 秒以内),要复刻多段就多开几次复刻绑同一张画布,最后在画布时间线拼。 **框好了还能改吗?** 拆解开始前随时改;拆解完成后再改片段等于重拆(配方是按这段算的),系统会拦下并提示另开一次复刻。 **为什么切点数字标"不可信"?** 画面变化太密(每镜不到 0.35 秒)或没测出切点时,节奏卡的数字只作参考,分段仍按实测边界走。 ## 相关 - [第 3 步 · 配方卡](/docs/viral/step-recipe) - [计费与常见问题](/docs/viral/credits-faq) --- # 第 3 步 · 配方卡:套路判定、四张卡与四种复刻方式怎么选 - 栏目:爆款复刻 - 地址:https://waytometa.cn/docs/viral/step-recipe - Markdown:https://waytometa.cn/docs/viral/step-recipe.md - 摘要:拆解结果长什么样:6 领域 21 种套路的判定与改判、钩子 / 节奏 / 分镜语言 / 内容精髓四张卡、每镜的结构化分镜字段;四种复刻方式(反推提示词、关键帧、视频参考、精准编辑)各自向原片靠的方式与适用场景;确认或打回重拆。 - 更新:2026-09-03 第 3 步回答"这条视频为什么会爆、准备怎么复刻"。看懂配方卡,选定一种复刻方式,点确认;判得不对就改判或打回重拆。 ## 识别到的套路 平台把爆款归成 **6 个领域 × 21 种套路**(电商营销、剧情叙事、知识科普、生活记录、音乐演出、游戏内容)。模型判定这条属于哪一种,给出理由、置信度和次选。右侧先点领域再点套路即可改判;模型拿不准时会明确要求你手动指定,不指定不能往下走。 ## 四张配方卡 - **钩子技法**:开头怎么抓人、语气、目标人群、行动号召;前 3 秒逐秒拆解。 - **节奏**:镜头数、每分钟切点、平均 / 最短 / 最长镜头。看"切点来源"——"原片实测"可信,"画面变化太密 / 按固定时长均分"时数字只作参考。 - **分镜语言**:每一镜的时间段与结构化字段——主体动作、运镜(中英双写)、景别、机位角度、入场转场、光影、色调、画面文字与叠字、节拍。这是每段提示词的骨架。 - **内容精髓**:必须复刻的要素、需要你提供素材的部分、可差异化的地方、全局一致性规则(人物 / 服饰 / 道具必须保持项)与禁止项。 某张卡标"未解读出内容"或底部提示"有步骤失败",建议打回重拆——配方不完整会一路影响到成片。 ## 复刻方式(对所有分段生效) | 方式 | 向原片靠的方式 | 适合 | 限制 | | --- | --- | --- | --- | | 反推提示词复刻 | 只按反推提示词 + 你的参考图生成,不注入原片画面 | 口播为主、画面不重要;想离原片远一点 | — | | 关键帧复刻 | 每段把该段原片关键帧追加为参考图(≤6 张),构图、机位、景别、色彩贴近原片 | 镜头稳、切点少,想"长得像" | 模型参考图数量要够 | | 视频参考复刻 | 每段把原片切片作为参考视频,切换节奏与运镜贴近原片;提示词只写替换要求与口播 | ≤30 秒、靠运镜和节奏取胜 | 需支持视频输入的模型(Seedance 2.5 ≤30s,Wan 3 ≤15s) | | **精准编辑复刻** | 以原片切片为唯一母版做视频局部编辑:只替换人物 / 产品 / 场景,镜头结构、运镜、时长、比例原样保留 | 保真要求最高的场景 | 仅 Seedance 2.5 稳定渠道,段长 4–30 秒;替换主体靠文字描述,不接参考图与参考音频 | 拆解完成后系统按片子特点**预设一种**并写明理由:≤30 秒一律预设视频参考;更长的按镜头多寡在反推提示词与关键帧之间推荐。你可以改,改过后显示"你已改过,原本预设 X"。个别段条件不满足时(如切片缺失、时长超模型上限)分段反推会自动降一档并在段卡上标出。 不管选哪种,原片素材都只用来定镜头语言——人物、产品、场景在下一步换成你的。 ## 确认或打回 - **确认配方,准备参考图**:进入第 4 步。 - **要求重拆**:写清哪里判错("钩子不是反差开场,是第一秒的价格数字"),这句话会带给分析模型;沿用上次的拆解模型,再收一次拆解费。 ## 常见问题 **四种方式能按段混用吗?** 不能手选混用,但系统会按段自动降级:例如视频参考模式下某段超过所选模型的带视频时长上限,这一段会退回反推提示词模式,段卡上有标。 **精准编辑和视频参考有什么区别?** 视频参考是"看着原片重新生成一条",人物长相靠参考图;精准编辑是"在原片上直接改",除了被替换的主体一切照旧,因此最像原片,但只能用文字描述要换成什么。 **确认之后还能回来改吗?** 第 3 步回看只读。配方一旦确认,下游参考图和分段都按它生成,要改请另开一次复刻。 ## 相关 - [第 4 步 · 参考图](/docs/viral/step-references) - [第 5 步 · 分段生成](/docs/viral/step-segments) --- # 第 4 步 · 参考图:把原片的人物、产品、场景换成你的 - 栏目:爆款复刻 - 地址:https://waytometa.cn/docs/viral/step-references - Markdown:https://waytometa.cn/docs/viral/step-references.md - 摘要:拆解识别出的实体卡(人物 ≤6、产品 ≤3、场景 ≤2)三种给图方式——按原片生成三视图 / 商品图 / 空景、独立生成、独立上传(免费且最省);整体画风为什么必须填;补充参考图与替换说明;确认后 1 积分反推每段提示词。 - 更新:2026-09-03 第 4 步决定"画面里出现的是谁、是什么、在哪"。每个被识别出的实体一张卡,给它一张图,后面每一段生成都会用这张图锁定外观。要换成自己的产品,传一张图就完了。 ## 实体卡 拆解时模型从原片认出**人物(最多 6 个)、产品(最多 3 个)、场景(最多 2 个)**,每个带名字、描述和看得最清楚的几张原片关键帧(最多 3 张)。卡上三个页签: | 页签 | 做什么 | 积分 | | --- | --- | --- | | 按原片生成 | 以关键帧为底:人物生成三视图 + 脸部特写(白底、锁长相);产品生成正面 / 45° / 侧面白底商品图(包装标签保留);场景生成无人空景 | 按生图模型 | | 独立生成 | 不看原片,按你写的描述生成;可上传照片锁定长相或包装 | 按生图模型 | | 独立上传 | 从画布选一张或直接上传,不生成 | **免费** | 生图默认 GPT Image 2、2K,比例自动匹配源片,卡上可换模型与参数,按钮标着积分。不需要的卡直接删(纯色背景那种没信息的场景删掉能省一次生图);认少了用「添加人物 / 产品 / 场景」补卡。 ## 整体画风 顶部的**整体画风**会写进每一张参考图的生成指令,也会进每段提示词。原片是动画或 3D 时这一栏别空着——留空时生图默认照片写实,人物参考图会变成真人。写一句"美式 3D 动画,硬边高光,撞色高饱和"就够。 ## 补充参考图与替换说明 再往下是**补充参考图**:Logo、字体样张、风格参考等实体卡覆盖不到的东西,每一段都会送进去。旁边的**替换说明**会按实体自动生成("把原片中的「模特」替换为参考图里的同名人物;把「牛仔裤」替换为同名产品,保留包装与标签……"),你可以在末尾追加要求,比如"产品必须始终正面出现"。 这段说明在视频参考模式下会原样进提示词的「替换要求」,在精准编辑模式下是替换主体的唯一依据(该模式不接参考图)。 ## 没识别出实体怎么办 页面会改成让你直接从关键帧里挑几张、或上传图片作为全局参考。都不想弄也可以跳过——此时生成只按提示词走。 ## 确认 点「确认参考,开始分段」。系统按配方和参考反推每一段的提示词(**1 积分**,一两分钟):先决定分几段(≤30 秒一律一段),再为每镜写主体 / 动作 / 运镜 / 景别 / 光影,锁定跨段一致性,完成后自动进入第 5 步。反推失败会释放这 1 积分并回到本步,直接再点一次即可。 ## 常见问题 **参考图生成的人和原片不像。** 关键帧看不清时在「按原片生成」里补几张更清楚的照片;或者直接「独立上传」一张正脸照。 **同一个人认成了两张卡。** 删掉一张,另一张的名字改成通用叫法,替换说明会跟着变。 **能给某一段单独的参考图吗?** 可以,在第 5 步每张段卡下方有"本段参考图",只对那一段生效。 ## 相关 - [第 5 步 · 分段生成](/docs/viral/step-segments) - [第 3 步 · 配方卡](/docs/viral/step-recipe) --- # 第 5 步 · 分段生成:提示词、模型参数、音色跟随原片与一致性自检 - 栏目:爆款复刻 - 地址:https://waytometa.cn/docs/viral/step-segments - Markdown:https://waytometa.cn/docs/viral/step-segments.md - 摘要:每一段一张卡:反推提示词怎么改、@ 引用参考图、重新反推;放行的视频模型与默认参数;「音色跟随原片」把原片音轨作参考音频让口播音色一致;「一致性自检」1 积分给出分数、六维度、差异清单与建议提示词,一键应用后重新生成;全部段完成进入成片。 - 更新:2026-09-03 第 5 步是真正花积分的地方:每一段一张卡,看提示词、选模型、点生成、看结果。做法是先把第一段调对,再批量生成其余段;不确定像不像就花 1 积分自检,按它给的建议改提示词。 ## 分几段 ≤30 秒的片子只有一张卡,一段生成到底;超过 30 秒按镜头切点切成若干段(每段 ≤30 秒),页头显示"N 段 · 总秒数"。卡头标着这一段在原片中的起止、复刻方式、有没有口播,以及已生成 / 生成失败 / 已手改等状态。 ## 提示词 反推出来的提示词按固定结构写:一致性锁定(人物 / 服饰 / 道具必须保持项)→ 逐镜 [起–止] 主体 / 动作 / 运镜 / 景别 / 光影 → 口播时间表(逐句起止,"保持原片台词与时机")或环境音 → 禁止项。画面文字不再让视频模型画(中文渲染不稳),改由第 6 步按时间叠回去。 - 可以直接改,改完点「保存」。输入 `@` 引用参考图,编号与下方"本段参考图"里的 @图片N 一致。 - 「重新反推」(1 积分):写一句意见("口播换成介绍我们的新款,语气更轻松"),AI 按意见重写这一段。 - 视频参考模式的提示词更短:镜头语言由参考视频承担,只写"跟随参考视频 + 替换要求 + 口播时间表"。精准编辑模式的提示词写"母版 = @视频1 / 替换什么 / 保留什么"。 右侧原片切片下方列出这一段的镜头表(起止、画面描述、口播逐句),改提示词时对照着看。 ## 本段参考图 全局参考里归属本段实体的图、关键帧模式下的原片关键帧(≤6 张)、加上你专门给这一段传的图。「从画布选择」和「上传」只对这一段生效;下方"本段补充说明"会附在提示词末尾。精准编辑模式不接参考图。 ## 模型与参数 分段生成只放行效果稳定的视频模型:**Seedance 2.5、Seedance 2.0、Wan 3、Wan 3 Prime、可灵 3.0 Omni**(目录里没上架的自动隐藏)。默认 Wan 3、720p;带参考视频默认 Seedance 2.5;精准编辑只能 Seedance 2.5。渠道、分辨率、时长、比例、音频开关在同一行,时长默认取盖住这一段的最小整秒档,模型盖不住时会提示。按钮上是这一段的积分,点「生成这一段」;生成过的变「重新生成」。 ## 音色跟随原片 原片有口播时参数条多一个「音色跟随原片」开关,默认开:把这一段的原片音轨作为参考音频一起送进模型,人物的声音、语速和每一句的时机以它为准,口型同步,几段拼起来也是同一个声音。关掉则由模型自行配音,每次音色可能不同。 开关置灰时旁边写原因:音频被关掉;这一段没有任何参考图或参考视频(纯文字生成不能只带音频);所选模型参考音频上限盖不住本段(Wan 3 15 秒,Seedance 2.5 30 秒)。 ## 一致性自检 生成完一段后,结果下方多出「检查与原片的一致性」(**1 积分**)。系统把原片切片和生成结果一起交给拆解模型逐维度比对(渠道不收视频时退到关键帧 + 抽帧比对),半分钟左右给出: - **总分**(0–100):≥85 几乎一致,70–84 个别镜头偏差,≤50 主体或镜头结构明显跑偏; - **六个维度**:镜头结构与时序、主体外观、运镜与构图、动作与节奏、光影与风格、文字与水印; - **差异清单**:逐条可行动,按影响从大到小; - **建议提示词**:在原提示词上只改需要改的地方。点「应用建议提示词」直接替换本段提示词,然后「重新生成」,再检查一次看分数是否上去。 被替换说明点名要换掉的人物 / 产品不算差异;原片有字幕而生成结果没有也不扣分(字幕在第 6 步叠回)。这一段重新生成后旧分数会标"已重新生成",需要重查。自检失败不扣积分。 ## 实际操作的几个习惯 - 先只生成第一段。同一套参考图和提示词写法,第一段对了后面大多也对。 - 生成是后台任务,切走再回来进度还在;失败的段不扣积分,看卡上的错误说明改参数再点。 - 全部段有结果后,底部「进入成片」亮起,进入第 6 步。 ## 常见问题 **生成的段和原片差太多。** 先看复刻方式:反推提示词模式本来不注入原片画面,想更像切到关键帧、视频参考或精准编辑。再做一次自检,按差异清单改提示词比反复重新反推更可控。 **两段的人长得不一样。** 参考图步给人物一张清晰正脸并锁定;≤30 秒尽量一段到底不切段;口播类开着「音色跟随原片」至少保证声音一致。 **为什么我的模型下拉里没有某个模型?** 段长超过它的时长上限、它不支持参考视频 / 参考音频、或后台已下架,都会被过滤掉。 ## 相关 - [第 6 步 · 成片](/docs/viral/step-final) - [第 3 步 · 配方卡:四种复刻方式](/docs/viral/step-recipe) - [计费与常见问题](/docs/viral/credits-faq) --- # 第 6 步 · 成片:调顺序、裁首尾、选音轨、还原画面文字,免费导出 - 栏目:爆款复刻 - 地址:https://waytometa.cn/docs/viral/step-final - Markdown:https://waytometa.cn/docs/viral/step-final.md - 摘要:全部段生成后进入成片步的轻量编辑器:段顺序上下移、每段首尾裁剪、音轨四选一(模型直出 / 沿用原片音轨按段对齐 / 上传配乐 / 静音)、按原片时机叠回画面文字(可逐条开关)、导出在服务端 ffmpeg 合成不花积分;原片与成片并排对照、下载、设为开源、在画布中精修。 - 更新:2026-09-03 第 6 步把各段拼成一条成片。全部段都有生成结果后自动进入;这里的编辑都是可逆的、导出不花积分,可以反复改反复导。 ## 页面结构 页头显示"N 段 · 总秒数"和"与原片 ±x 秒"的时长差;有成片后顶部是**原片 vs 成片**并排对照,下面依次是段列表、音轨、画面文字、导出。设置随改随存(半秒防抖),刷新页面不丢。 ## 段顺序与裁剪 每一段一行:原片起止、时长、缩略播放。 - **上移 / 下移**调整拼接顺序。 - **首尾裁剪**:拖两端各裁掉几秒(0.1 秒步进),每段至少留 0.5 秒。生成的段通常比原镜头略长,默认已按原片这一段的时长裁回,这里只处理"开头多了半秒黑场"这类情况。 - 某一段不满意,「回分段重生成」跳回第 5 步只重做那一段,回来时其它设置保持。 ## 音轨方案 | 方案 | 效果 | 适合 | | --- | --- | --- | | 模型直出音频 | 各段生成时自带的声音按段拼接 | 开着「音色跟随原片」生成的口播片 | | 沿用原片音轨 | 成片画面配原片这一段的声音;**各段按原片时间对齐**,调过顺序或裁过头也不会错位 | 口播 / 节拍要和原片完全一致 | | 上传配乐 | 静音各段,铺一条你上传的音乐,可调音量 | 纯画面类、要换 BGM | | 静音 | 只要画面 | 后期另配 | 原片没有可用音轨时"沿用原片音轨"不可选;选了它但音轨缺失,导出会按静音完成并在结果里说明。 ## 画面文字还原 视频模型不画中文(渲染不稳、破坏画面),原片里的字幕、标题、价格标、贴纸由拆解识别出来后,在这里按原片的镜头时机叠回成片:白字黑边加半透明底,位置按原片(顶 / 中 / 底 / 四角),字号按类型(标题最大、贴纸次之、字幕最小)。 - 总开关 + 逐条开关。拆解 v2 识别出的叠字默认开;老配方只有"画面文字"没区分是否叠加的项标为"旧配方",默认关(可能是印在实物上的字)。 - 被裁掉的时间段里的字自动不叠。 - 服务器需要中文字体(部署镜像已内置 Noto CJK)。缺字体时页面会提示,导出跳过叠字并在结果里说明。 ## 导出与之后 点「导出成片」:先把当前设置落盘,再在服务端用 ffmpeg 两遍法合成(逐段归一化 → 拼接 → 混音 → 叠字),几十秒到一两分钟,进度条实时。完成后: - **下载成片**拿文件;成片也自动进关联画布的媒体库。 - **设为开源**:成片、提示词、参考图公开到开源墙,可随时取消。 - **在画布中打开**:源片、关键帧、参考图、各段切片与结果、成片全部按组摆好,可以给某段换模型、加转场、拖进时间线重剪。 - **再复刻一条**回到入口。 导出失败不影响任何数据,会回到第 5 / 6 步提示原因,改完再导。 ## 常见问题 **成片比原片长 / 短了几秒。** 页头的时长差就是提示。多出来的是模型生成的段比原镜头长——用首尾裁剪裁掉;短了通常是某段选了更短的时长档,回第 5 步用更大的档重生成。 **叠上去的字位置不对。** 位置来自拆解识别的原片位置,只有七个锚点。想精确排版进画布用时间线的字幕轨。 **能加转场吗?** 成片步只做首尾相接(这样接缝最少)。转场进画布时间线加。 ## 相关 - [第 5 步 · 分段生成](/docs/viral/step-segments) - [五分钟上手](/docs/viral/quick-start) --- # 爆款复刻计费与常见问题 - 栏目:爆款复刻 - 地址:https://waytometa.cn/docs/viral/credits-faq - Markdown:https://waytometa.cn/docs/viral/credits-faq.md - 摘要:每一步花多少积分(拆解 5–30、分段反推 1、单段重新反推 1、一致性自检 1、参考图按生图模型、分段视频按视频模型、成片导出免费、复刻同款不收拆解费)、失败退不退、怎么省;以及链接报错、时长限制、画风跑偏、接缝、音色不一致、叠字缺字体等常见问题。 - 更新:2026-09-03 爆款复刻按环节分开计费,失败的任务一律不扣。预算大头是第 5 步的分段视频;其余环节都是几积分的固定价或免费。 ## 每一步花多少积分 | 环节 | 积分 | 说明 | | --- | --- | --- | | 拆解 | 5 – 30 | 按所选分析模型,默认 Gemini 3.1 Pro 10 积分;失败不扣;「要求重拆」再收一次 | | 分段反推 | 1 | 确认参考后自动进行;失败释放并回参考图步 | | 单段重新反推 | 1 | 每次点「重新反推」 | | 参考图生成 | 按生图模型 | 默认 GPT Image 2 · 2K;「独立上传」/ 从画布选择免费 | | 分段视频 | 按视频模型 | 按钮上实时显示;带参考视频 / 精准编辑的单价可能更高;时长按整秒档向上取 | | 一致性自检 | 1 | 每段每次;失败不扣 | | 成片导出 | 免费 | 可反复导 | | 复刻同款 | 不收拆解费 | 从参考图步开始,之后的参考图与分段照常计费 | 价格可能随后台调整,以页面按钮上显示的为准。团队空间画布里的消耗从空间所有者账户扣。 ## 怎么省 - 框 30 秒以内:一段生成到底,只付一段的钱,也没有接缝。 - 参考图能上传就上传,只有生成才花积分。 - 第一段先试,对了再批量生成其余段。 - 生成前不确定像不像,先花 1 积分自检,按建议改提示词再生成,比盲目重生成一段(几十积分)划算。 - 开源墙上找套路对的「复刻同款」,直接省掉拆解费。 ## 常见问题 **抖音 / 小红书 / B 站的链接贴进去报错。** 平台页面地址不是视频文件,先用平台的保存功能下载再上传。 **视频有两分钟,能整条复刻吗?** 单次只分析 60 秒以内。第 2 步框出最想复刻的一段(推荐 30 秒以内);多段就多开几次复刻绑同一张画布。 **原片是动画,参考图却生成了真人。** 第 4 步顶部「整体画风」没填。写一句风格描述再重新生成参考图。 **生成的段和原片差太多。** 先看复刻方式(反推提示词模式本来就不注入原片画面,想更像切关键帧 / 视频参考 / 精准编辑),再做一次一致性自检,按差异清单改提示词。 **段与段之间有明显接缝。** 框选超过 30 秒就会切段。要么框 30 秒以内,要么在成片步把接缝处首尾各裁几帧,再进画布用时间线加转场。 **两段人物音色不一样。** 第 5 步开着「音色跟随原片」生成,或者成片步音轨选「沿用原片音轨」。 **画面文字没叠上去。** 三种可能:成片步总开关关了或该条被单独关了;这条是"旧配方"项默认关,需要手动勾;服务器缺中文字体(页面会提示,联系管理员在镜像里装 Noto CJK)。 **配方判的套路不对。** 第 3 步右侧直接改判,或写意见「要求重拆」。 **自检说"拿不到 B 的视频只有帧"。** 当前渠道不收视频附件,系统退到了"原片关键帧 + 生成结果抽帧"比对,运镜与节奏按帧序推断,分数依然可用。 **能在手机上用吗?** 可以,六步都做了手机端适配(历史抽屉、底部操作栏、片段范围微调按钮)。改长提示词建议在电脑上。 ## 相关 - [爆款复刻完全指南](/docs/viral/guide) - [五分钟上手](/docs/viral/quick-start) --- # Skill 完全指南:把你的创作套路交给 Agent - 栏目:MetaDig Skills - 地址:https://waytometa.cn/docs/skills/guide - Markdown:https://waytometa.cn/docs/skills/guide.md - 摘要:Skill 是一份写给画布 Agent 看的指令文档。这篇讲清楚它是什么、去哪找、怎么用、怎么写一份真正好用的,以及发布到广场要注意什么。 - 更新:2026-09-03 如果你在画布里用过 Agent 模式,大概经历过这种事:同一套要求——"竖屏、韩漫风、主角穿红色卫衣、每镜 5 秒、拿不准就问我"——每开一个新项目都得重新交代一遍,稍微漏一句,出来的东西就跑偏。 Skill 就是为这个存在的。把你反复交代的那套话写成一份文档,以后开新项目只要选中它,再说一句"做一条关于秋天的",Agent 就会照着文档里的流程、风格和产出要求一步步做。它不是模型,也不是带节点的模板,就是一份说明书——但 Agent 会把它当作最高优先级的执行手册。 ## Skill 到底是什么 一个 Skill 由三部分组成: - **SKILL.md**:主文档,Markdown 写的,最多 2 万字。这是核心。 - **附加文件**(可选):最多 20 个文本文件,每个不超过 2 万字,支持多层目录,比如 `references/style.md`、`shots/opening.md`。只收 `.md / .txt / .json / .yaml / .csv` 这类纯文本,因为它们会和主文档一起喂给模型。 - **元信息**:名称(50 字内)、一句话介绍(200 字内)、产出类型(图片 / 视频 / 音频 / 文本)、封面、一段效果视频、分类。 你在画布里启用某个 Skill 之后,Agent 每一轮思考时都会带着这份文档。文档里写了"先出分镜再出图",它就先出分镜;写了"拿不准风格时停下来问我",它就会在那个环节停下来问你,而不是自己猜。 优先级的规矩很简单:**你当前这条消息 > Skill 文档 > Agent 默认行为**。所以不用担心选了 Skill 就被绑死,你在消息里临时改要求,以改的为准。 > [!NOTE] 关于内容保密 > 别人只能看到你 Skill 的名称、介绍、效果视频和精选案例,看不到 SKILL.md 正文和附加文件。你自己和平台管理员才能看全文。这是刻意设计的:好用的提示词是作者的积累,广场展示的是效果,不是配方。 ## 去哪找 Skill 有三个入口,看你当时在哪: 1. 左侧栏的 **MetaDig Agent** 页面,往下滚就是 Skill 库;`/skills` 是它的独立落地页,顶部还有几个分类快捷标签。 2. 画布左侧工具条里的 **Skill 库** 按钮,会弹出一个大窗口,广场 / 我的 / 收藏三个页签都在。 3. 画布对话框里的 **+** 菜单有「启用 Skill」,适合已经在聊了、临时想换个套路的时候。 广场可以按产出类型筛(图片 / 视频 / 音频 / 文本),也可以按分类筛:短漫剧、电影、商业广告、创意玩法、音乐MV、通用。每张卡片上有作者、使用次数和评分,官方出的会标"官方"。不登录也能逛广场、看详情,收藏、评分和使用需要登录。 ## 怎么用 **从广场用**:点开一个 Skill,看介绍和效果视频,觉得合适就点「去画布使用」。系统会新建一个项目、进入画布,对话框上已经挂着一个 `Skill · 名称` 的小胶囊。这时候什么都还没发生,你输入需求、回车,Agent 才开始按 Skill 干活。 **在画布里用**:从 Skill 库或 + 菜单选中一个,胶囊出现,正常发消息就行。 有一个行为要说明一下:**Skill 是跟着消息走的**。你发出那条消息后,胶囊会自动消失;但这一次 Agent 任务的每一轮(它自己拆的所有步骤)都会一直带着这份 Skill,直到任务结束。下一条消息如果还想用,得重新选一次。这么做是为了避免你忘了胶囊还挂着,后面随口问一句"这张图能不能亮一点"也被整套流程套住。点「重新生成」的时候会沿用原消息的 Skill,不用重选。 对话面板有三个模式:对话、Plan、Agent。三个模式都能带 Skill,但 Skill 的价值主要体现在 **Agent 模式**(默认就是它)——只有 Agent 会真的去建节点、出图、出片。Plan 模式只做规划不执行,对话模式只给建议。 **费用**:Skill 本身不收费,用别人的也不收费。要花积分的是 Agent 跑的对话(按 token)和它提交的生成任务(按模型单价),和你手动操作画布一个价。有一点值得知道:SKILL.md 越长,每一轮对话消耗的 token 越多。这也是为什么后面要劝你把文档写精炼。 ## 三种创建方式 右上角「创建 Skill」是个下拉,三个选项对应三种路子。 **和 Agent 对话创建**。左边聊天,右边是 SKILL.md 草稿的实时预览。你用大白话描述想让它干什么,助手会追问几个关键点,然后把草稿写出来;不满意就继续说,它会增量修改。满意了点「保存并进编辑器」。这个过程会按 token 扣一点积分,和画布对话一个口径。适合第一次写、不知道从哪下手的人。 **用编辑器创建**。全页编辑器,左边是文件树(SKILL.md 固定在最上面,可以新建文件和文件夹),右边编辑区可以切"编辑 / 预览 / 改动"三个视图——"改动"会把这次和上次保存版本的差异逐行标出来。上方填名称、介绍、类型,传封面和效果视频(mp4 / webm / mov,50MB 内)。两个按钮值得记一下:「AI 优化」会把当前 SKILL.md 重写得更规范,出来的是 diff 预览,你确认了才应用;「检测」会扫一遍名称、介绍和正文有没有敏感词,省得提交审核时被打回。 **导入已有 Skill**。如果你手上已经有 Claude、Cursor 之类工具用的 skill 文件夹,直接上传 `.md` 或整个文件夹,内容会读进编辑器预填好,你再补元信息就行。 还有第四条路,不在这个下拉里:**沉淀为 Skill**。在画布里跑完一次满意的 Agent 任务后,鼠标悬停在助手的回复上,操作区有一个魔杖按钮;或者框选画布上一组节点,多选工具栏也有「沉淀为 Skill」。它会把这次对话或这组节点总结成一份 SKILL.md 草稿,自动存进「我的」,附一个「去编辑器完善」的入口。很多好用的 Skill 都是这么来的——先做出来一次,再把过程固化。 ## 怎么写一份真正好用的 SKILL.md 新建时编辑器会预填一个五段模板,这五段就是最实用的骨架: ```markdown ## 做什么 (一句话说明用途)例:把一句话故事想法做成一条短漫剧成片 ## 需要什么输入 (最少提供什么)例:一句话想法,可选画风、时长、主角设定 ## 怎么做 (写你在意的环节和要求,不用写全)例:先出分镜脚本,再逐镜生成画面,画风固定成韩漫,最后串成视频 ## 产出什么 (最终交付什么)例:成片,附脚本和分镜图 ## 什么时候问你 (什么情况下停下来问你)例:拿不准题材或风格时问一次,其余自己定 ``` 写的时候,脑子里要有 Agent 能做的事的清单。它能:生成图片(文生图或参考已有图改图,可指定比例和张数)、生成视频(文生 / 首帧 / 首尾帧 / 参考生视频,5 秒或 10 秒)、生成音频(配音或音乐)、建文本节点放脚本和分镜表(免费)、连线和编组整理节点(免费)、向你提问(给 2 到 4 个候选让你选)。"怎么做"那一段就按这些动作来编排,别写它做不到的事,比如"导出到抖音"。 几条从实际使用里总结出来的经验: **只写你在意的环节。** 写"每个镜头的提示词里都要重复主角的发型、服装、颜色"比写一大段画面美学理论管用得多。Agent 缺的不是审美,是你的具体要求。 **风格锚点要具体到能复制。** "韩漫风格"太抽象,"韩漫风格,粗黑描边,高饱和平涂,人物眼睛占脸部三分之一"才是可以每镜复用的锚点。 **把比例、时长、张数写死。** 竖屏就写 9:16,每镜 5 秒就写 5 秒。这些参数不写,Agent 会用默认值,默认值不一定是你想的。 **长参考放附加文件。** 风格词表、镜头库、角色设定卡,动辄几百行,别塞进 SKILL.md。放到 `references/` 目录下,正文里写一句"镜头运动参考 `references/shots.md`",Agent 会去读。主文档保持在一两屏,跑起来也省 token。 **少问,但该问的一定问。** "什么时候问你"这一段不要写"每一步都确认",那 Agent 会烦死你。写清楚只有哪一两个决策需要你拍板(题材、风格),其余让它自己定并在最后告诉你。 **尽量描述效果而不是绑死模型。** 模型会上新、会下架,写"用画质最好的图片模型出 2K"比写某个具体模型 ID 更耐用。真要指定模型也可以,但记得过段时间回来看看它还在不在。 草稿不需要发布就能自己用:在画布 Skill 库的「我的」页签里,草稿也能直接启用。先在自己项目里跑两三次,改顺了再考虑发布。 ## 发布到广场 在「我的」里找到 Skill,点「发布」。弹窗里要做三件事:选一个分类(必选)、放最多 6 个精选案例(图片,可以附作品链接)、勾同意协议。提交后进入「审核中」,通过就出现在广场,没通过会告诉你原因,改完再提。 几个规则提前说: - 已发布的 Skill 再做修改,会回到「审核中」重新过审,期间广场上暂时看不到。 - 创建、编辑、发布三个环节都有敏感词前置检查,命中会直接拒绝并告诉你是哪几个词。 - 每个账号最多 100 个 Skill。 - 广场的排序是:官方排序权重 → 评分 → 使用次数 → 发布时间。也就是说,案例放得好、效果视频清楚,别人用了愿意打分,你的 Skill 自然往前走。 发布之后,详情弹窗里有「分享」,会复制一个 `/s/你的SkillID` 链接,没登录的人也能打开看介绍和效果视频。别人用过之后可以打 1 到 5 星,一人一票,可以改分。 ## 常见问题 **启用了 Skill,Agent 好像没照着做。** 先看是不是 Agent 模式,对话和 Plan 模式不会真的执行。然后看你那条消息有没有和 Skill 冲突——消息优先。最后看 SKILL.md 本身是不是太长、太含糊,模型对模糊的长文档执行力会明显下降。 **提示「所选 Skill 暂不可用」。** 这个 Skill 被作者删了,或者被下线、驳回了。换一个,或者联系作者。 **为什么我看不到别人的 SKILL.md?** 见上面"关于内容保密"。想学写法,可以去看官方 Skill 的介绍和效果,再用「和 Agent 对话创建」让助手帮你起草。 **用别人的 Skill 要付费吗?** Skill 免费。你付的只是 Agent 对话和生成任务的积分,跟你不用 Skill 手动操作是一样的价。 **Skill 能调用 CLI 或者外部工具吗?** 不能。Skill 的作用范围就是画布里的 Agent,它能用的动作就是上面那份清单。想在终端里跑批量任务,去看命令行栏目的文档。 **这个 Skill 和「MetaDig Skill」是一回事吗?** 不是。本文的 Skill 是你写给画布 Agent 的创作套路,只在网页画布里生效;「MetaDig Skill」是官方给 Cursor、Claude Code 这类站外 Agent 用的操作手册,让它们学会用 `metadig` 命令行帮你出图出片。后者见同栏目的《MetaDig Skill 使用指南》(`/docs/skills/agent-skill`)。 --- # MetaDig Skill 使用指南:让 Cursor、Claude Code 这类 Agent 直接帮你出图出片 - 栏目:MetaDig Skills - 地址:https://waytometa.cn/docs/skills/agent-skill - Markdown:https://waytometa.cn/docs/skills/agent-skill.md - 摘要:MetaDig Skill 是给 AI Agent 用的能力包:装好它,Agent 就知道怎么用 metadig 命令行查模型、报价、生成图片视频配音并把产物落到你的画布。这篇讲它是什么、去哪拿、装到哪、怎么用,以及它和「命令行」栏目、和画布「Skill 广场」的区别。 - 更新:2026-09-03 MetaDig Skill 是一份**写给 AI Agent 看的操作手册**。它告诉 Agent 怎么通过 `metadig` 命令行调用 MetaDig 的图片、视频、语音和音乐生成能力,什么时候该先查模型、什么时候该先向你报价、失败了该不该重试,并约束 Agent 只走稳定的命令行入口,不去拼接网页内部接口。 如果你在用 Cursor、Claude Code、Codex、OpenClaw、Kimi、Trae 这类支持 Agent Skill 的工具,可以把它理解成「给 Agent 装一个 MetaDig 插件」:装好 Skill、登录一次,之后直接对 Agent 说"帮我出三张 16:9 的秋天海报"或"给这篇文章配一条 5 秒的片头",它自己去跑命令,产物出现在你的网页画布上。 > [!NOTE] 先分清两个「Skill」 > 本站有两套叫 Skill 的东西。**画布 Skill 广场**(`/skills`)里的 Skill 是你写给画布内 Agent 的创作套路文档,只在网页画布里生效;**本文说的 MetaDig Skill** 是给 Cursor、Claude Code 这类站外 Agent 用的,让它们学会用命令行调用 MetaDig。两者互不依赖。画布 Skill 的用法见同栏目的《Skill 完全指南》。 ## 相关地址 - GitHub 仓库:[github.com/pythonthink/metadig-skills](https://github.com/pythonthink/metadig-skills)(`git clone` 后把 `metadig/` 放进 Skills 目录即可) - Skill 包下载:`https://waytometa.cn/cli-dist/latest/metadig-cli-skill.zip`(解压得到 `metadig/` 目录,与仓库同内容) - 在线阅读 Skill 正文:`https://waytometa.cn/cli-dist/latest/skill/metadig/SKILL.md` - CLI 落地页(含一键复制的安装提示词):[/cli](/cli) - CLI 安装脚本:`https://waytometa.cn/cli/install.sh`(macOS / Linux)、`https://waytometa.cn/cli/install.ps1`(Windows) - Skill 格式遵循开放规范 [Agent Skills](https://agentskills.io),所以任何支持该规范的 Agent 都能直接读取。 ## 你可以用它做什么 - 用一句话让 Agent 生成单张或多张图片,指定比例、分辨率、张数,或带参考图改图。 - 文生视频、首帧生视频、首尾帧、参考生视频四种方式出片,Agent 按你给的素材自动选方式。 - 文字转语音(多种音色)和 AI 音乐(带歌词或纯音乐)。 - 查询当前可用的模型、积分价格和参数档位——Agent 生成前会先查一遍,不会凭记忆写过时的模型 ID。 - 批量生成前先报方案和预计积分,你点头它才跑;任务失败不扣积分,它也不会原样重提。 - 产物自动落到你的网页画布项目(提交即出现「生成中」节点,完成自动回填),也可以顺手下载到本地目录。 - 在 Agent 工作流里统一用 `metadig` 命令和 `--json` 输出,稳定、可脚本化。 ## 五步开始 1. 准备一个支持 Agent Skill 的工具(Cursor、Claude Code、Codex、OpenClaw 等)。 2. 拿到 Skill:`git clone https://github.com/pythonthink/metadig-skills.git`,或下载上面的 zip 并解压,都会得到 `metadig/` 目录。 3. 把 `metadig/` 放进你的 Skills 目录(见下一节),重开一次 Agent 会话让它发现新 Skill。 4. 让 Agent 安装 CLI 并登录:`metadig login` 会打开浏览器,你在网页上点一下「授权登录」就行。CLI 登录和网页登录并存,不会互相顶掉。 5. 直接对 Agent 说需求,例如「用 metadig 给 ./photos 里的 6 张产品图各出一张 16:9 的白底电商主图,先告诉我大概要多少积分」。 **更省事的做法**:打开 [/cli](/cli),复制「发给 AI 助手的提示词」发给 Agent,它会自己下载、解压、放进 Skills 目录并完成安装登录——上面五步它一次做完。 ## 装到哪个目录 Skill 就是一个包含 `SKILL.md` 的文件夹,放进 Agent 会扫描的目录即可。常见位置: | 工具 | 项目级(只对当前仓库生效) | 用户级(本机所有项目) | | --- | --- | --- | | 通用约定(多数 Agent 都认) | `.agents/skills/metadig/` | `~/.agents/skills/metadig/` | | Cursor | `.cursor/skills/metadig/` | `~/.cursor/skills/metadig/` | | Claude Code | `.claude/skills/metadig/` | `~/.claude/skills/metadig/` | | Codex | `.codex/skills/metadig/` | `~/.codex/skills/metadig/` | | OpenClaw 等其他工具 | 按其文档的 skills 目录放置 | — | 放好后在对话里输入 `/metadig`(Cursor / Claude Code 支持斜杠直接调用)或直接描述需求,Agent 会按 Skill 的 `description` 自动判断何时启用。 > [!TIP] 不想装 Skill 也能用 > 直接把 `SKILL.md` 的内容或链接丢给 Agent 读一遍,效果一样,只是下次新会话要再给一次。装进 Skills 目录的好处是一次安装、以后每个会话自动可用。 ## Skill 文件在哪里、长什么样 Skill 目录结构: ```text metadig/ ├── SKILL.md # 主文档:安装登录、命令速查、关键工作流、重要规则 └── references/ ├── cli-command-guide.md # 每个命令的完整参数、环境变量、配置文件、JSON 输出字段 ├── generation-guide.md # 选模型、估积分、视频方式与参数约束、音色清单、产物落画布 └── common-pitfalls.md # 报错对照表:登录 / 超时 / 积分 / 模型不可用 / 上传下载 ``` `SKILL.md` 顶部是一段 YAML 元信息(`name: metadig` 和一段说明「做什么、什么时候用」),Agent 启动时只加载这几十个字来判断相关性;真正用到时才读正文;`references/` 里的细节只在需要时按需读取。这就是规范里说的「渐进式加载」——装十几个 Skill 也不会把 Agent 的上下文撑爆。 主文档明确要求 Agent 优先使用这些公开命令: ```bash metadig models # 查模型与价格(生成前必查) metadig gen image # 图片 metadig gen video # 视频 metadig gen speech # 语音 metadig gen music # 音乐 metadig status # 查任务 / 等待 / 下载 metadig history # 任务记录 ``` ## 和 Agent 怎么说话 装好之后像跟同事交代一样说就行: > 用 metadig 出一张竖屏 9:16 的秋日海报,2K,写实风格,出好后下载到 ./exports。 > 先查一下现在哪个视频模型支持首帧生视频、10 秒多少积分,报个价给我;我点头后用 ./cover.png 做首帧出一条。 > 把 ./script.txt 里的旁白用成熟女声配音,落到「秋日短片」这个项目里。 Agent 会先跑 `metadig models` 查最新目录和价格,再决定用哪个模型、要不要先向你确认,然后提交、等待、把链接和落画布的节点整理给你。 ## 积分与安全 - Skill 本身免费。花积分的只有 Agent 提交的生成任务,价格与网页端同价同折扣;任务失败、取消、超时都不扣。 - Skill 里写死了几条保护你的规则:视频和批量任务先报价再跑、积分不足就停下来提醒、提交超时先查状态不重复提交、失败不原样重试。 - 登录走浏览器授权,终端和 Agent 都不经手你的密码。凭证存在本机 `~/.metadig/credentials.json`,约 30 天有效。 - 只在自己的设备上点授权链接;别人发来的授权链接一律别点——点了就等于把账号交给对方的终端。 ## 和「命令行」栏目的区别 「命令行」栏目面向**人**,逐条解释 `metadig` 的每个命令和参数,适合你自己在终端里敲。「MetaDig Skill」面向 **Agent**,重点是安装位置、授权方式、推荐工作流和禁止事项,让 Agent 替你敲命令。两边描述的是同一个工具,命令行栏目的内容也是 Skill 里 `references/cli-command-guide.md` 的人类可读版。 ## 和画布「Skill 广场」的区别 | | 画布 Skill 广场 | MetaDig Skill(本文) | | --- | --- | --- | | 谁读 | 网页画布里的 Agent | Cursor / Claude Code 等站外 Agent | | 内容 | 你写的创作套路(风格、分镜流程、产出要求) | 官方维护的 `metadig` 命令行操作手册 | | 在哪用 | 网页画布对话框里启用 | 你自己的编辑器 / 终端 / Agent 工具里 | | 谁来写 | 你或社区作者,可发布到广场 | MetaDig 官方,随 CLI 一起更新 | | 怎么拿 | 广场里点「使用」 | 下载 zip 放进 Skills 目录 | 两者可以一起用:先在画布里用 Skill 广场的套路把风格跑顺,再让站外 Agent 用命令行批量产出同一画布里的素材。 ## 常见问题 **Agent 说找不到 metadig 命令。** CLI 还没装或刚装完 PATH 没刷新。让 Agent 重跑安装脚本,然后重开一个终端;`~/.metadig/metadig --version` 能跑说明装好了。 **Agent 装了 Skill 但没有自动用。** 确认目录名是 `metadig`、里面有 `SKILL.md`,并且重开过一次会话;也可以在对话里直接 `/metadig` 手动调用。还不行就把 `SKILL.md` 内容贴给它。 **能不能不装 CLI,让 Agent 直接调 MetaDig 的接口?** 不建议,Skill 里也明确禁止。命令行是稳定的公开入口,内部接口随时会变;命令行缺功能时升级 CLI 即可。 **Skill 会自动更新吗?** 不会。Skill 随 CLI 版本一起发布,重新下载 zip 覆盖 `metadig/` 目录即可;`SKILL.md` 与 CLI 命令一一对应,旧 Skill 配新 CLI 一般也能用。 **在服务器或没有浏览器的环境怎么登录?** `metadig login --no-open` 只打印授权链接,你在任何已登录网页的设备上打开它授权即可;再不行就设置 `METADIG_TOKEN` 环境变量。细节见 Skill 的 `references/common-pitfalls.md` 或命令行栏目。 --- # MetaDig CLI 完全指南:在终端和 AI 助手里出图出片 - 栏目:命令行 - 地址:https://waytometa.cn/docs/cli/guide - Markdown:https://waytometa.cn/docs/cli/guide.md - 摘要:一行命令安装 metadig,浏览器授权登录,然后就能在终端、脚本或 Cursor / Claude Code 这类 AI 助手里生成图片、视频、配音和音乐,结果自动落到网页画布。 - 更新:2026-09-03 网页画布适合一张图一张图地磨;但有些活儿更适合命令行——比如给 50 个产品各出一张主图,或者让 Cursor 里的 AI 助手边写文案边配图。`metadig` 就是干这个的:一个单文件的命令行工具,登录一次,之后在终端里敲一行就能提交生成任务,结果直接落到你网页上的画布项目里,随时回去继续编辑。 计费、模型、折扣、会员门禁和网页端完全是一套东西。网页上能用的模型,命令行里就能用;后台下架了某个模型,命令行里也会同步消失,不需要更新工具。 ## 安装 ### 方式一:交给 AI 助手(推荐) 如果你在用 Cursor、Claude Code、Codex、Kimi、Trae 这类带 Agent 能力的工具,把下面这段话原样发给它: ```text 请帮我安装 MetaDig Skill:克隆 https://github.com/pythonthink/metadig-skills(或下载 https://waytometa.cn/cli-dist/latest/metadig-cli-skill.zip 并解压), 把其中的 metadig/ 目录放进你的 Skills 目录(Cursor 用 .cursor/skills/,Claude Code 用 ~/.claude/skills/,其他工具用 ~/.agents/skills/), 然后按 metadig/SKILL.md 完成 CLI 安装与登录。之后你就可以用 metadig 命令帮我生成图片、视频、配音和音乐了。 ``` 仓库和 zip 是同一份内容:一个标准的 Agent Skill 目录(`metadig/SKILL.md` + `references/`),助手会照着它装好工具、引导你登录,并且学会怎么查模型、怎么报价、失败了该不该重试。放进 Skills 目录后以后每个新会话都自动可用,装完就可以直接对助手说"帮我出三张 16:9 的秋天海报",它自己去跑命令。Skill 的详细说明(装到哪个目录、和画布 Skill 广场的区别、常见问题)见 Skills 栏目的《MetaDig Skill 使用指南》(`/docs/skills/agent-skill`)。 ### 方式二:手动装 macOS / Linux: ```bash curl -fsSL https://waytometa.cn/cli/install.sh | bash ``` Windows PowerShell: ```powershell iwr https://waytometa.cn/cli/install.ps1 -useb | iex ``` 工具会装到 `~/.metadig` 并写进 PATH。装完**重新开一个终端**(PATH 要刷新),然后验证: ```bash metadig --version ``` ## 登录 ```bash metadig login ``` 它会打印一个授权链接并尝试打开浏览器。你在网页上(已登录的账号)点一下「授权登录」,终端这边两秒内会显示"登录成功"。链接 10 分钟内有效,过了重新执行一次就行。 几件关于登录的事: - 凭证存在本机 `~/.metadig/credentials.json`,权限只有你自己可读,大约 30 天有效。过期后任何命令都会提示重新 `metadig login`。 - **命令行登录和网页登录互不影响。** 套餐对"同时在线设备数"有限制,但 CLI 的登录不占这个名额,不会把你手机或另一台电脑上的网页登录顶掉。 - 服务器环境没有浏览器?`metadig login --no-open` 只打印链接,你复制到任何一台能登录的设备上打开授权即可。还是不行就用令牌兜底:`metadig login --token <你的令牌>`,或者设环境变量 `METADIG_TOKEN`(它的优先级最高,设了以后本地保存的凭证会被忽略)。 - 只在自己的设备上授权,别人发来的授权链接一律别点——点了就等于把你的账号交给对方的终端。 登录后随时可以用 `metadig whoami` 看当前账号和积分余额,`metadig logout` 退出。 ## 先看模型,再生成 模型、价格和参数档位是会变的,所以生成前先查一眼: ```bash metadig models # 全部类型:图片 / 视频 / 语音 / 音乐,带积分价格 metadig models --type video # 只看视频模型 metadig models seedance-2 # 某个模型的详情:支持的比例、分辨率、时长、渠道、参考素材上限 metadig models --json # 给程序或 AI 助手解析用 ``` 列表里的标签能看出模型状态:`会员` 表示免费档用不了,`停用` 表示维护中,`新` 是新上架,`8折` 这种是正在进行的价格活动(表里显示的已经是折后价)。 ## 生成 四类任务,四个子命令。所有子命令都支持 `-m` 指定模型(不指定用该类目录里第一个可用的)、`-p` 指定项目、`-o 目录` 完成后自动下载、`--no-wait` 提交后立刻返回、`--json` 机器可读输出。 ### 图片 ```bash # 文生图 metadig gen image "一只橘猫在窗台晒太阳,午后暖光,写实" --ratio 16:9 # 图生图:带 -r 参考图就自动走图生图;本地文件会先上传,多张就多写几个 -r metadig gen image "改成水彩风格" -r ./photo.png -m nano-banana-pro # 一次出 4 张 2K metadig gen image "极简风格的产品海报" -n 4 --resolution 2K ``` 可用参数:`--ratio` 比例(1:1 / 16:9 / 9:16 等)、`--resolution` 分辨率(1K / 2K / 4K)、`-n` 张数、`--channel` 渠道、`--quality` 质量档、`--format` 输出格式。不传的参数按模型目录取默认,图片默认 1:1、1K。 ### 视频 生成方式由你给的素材决定,不用单独指定: ```bash # 什么素材都不给 → 文生视频 metadig gen video "清晨海边,低机位沿沙滩平稳前移,电影感" -m seedance-2 --resolution 720p -d 5 # --first 首帧图 → 首帧生视频 metadig gen video "镜头缓慢推进,人物微笑" --first ./cover.png -d 5 -o ./exports # --first + --last → 首尾帧生视频 metadig gen video "从白天过渡到夜晚" --first a.png --last b.png # -r / --ref-video / --ref-audio → 参考生视频 metadig gen video "保持人物外观一致" -r role.png --ref-video demo.mp4 ``` 其它参数:`-d` 时长(秒)、`--ratio`、`--resolution`(480p / 720p / 1080p)、`--audio` 让支持的模型带环境音或对白。视频默认 16:9、720p、5 秒。 两个规则:`--last` 必须和 `--first` 一起用;`--first` 和 `--ref` 系列不能混用——首帧模式只认首尾帧图,参考模式用 `-r / --ref-video / --ref-audio`。 > [!WARNING] 视频比图片贵不少 > 一条视频通常几十积分起,高分辨率、长时长、带参考视频都会加价。批量跑之前先用 `metadig models <模型ID>` 看一眼分档价,`--no-wait` 提交一条试试效果再放开跑。 ### 语音和音乐 ```bash metadig gen speech "欢迎来到元界深掘" --voice male-qn-qingse metadig gen music "轻快的夏日流行" --lyrics "夏天的风……" -d 40 metadig gen music "适合 vlog 的轻电子" --instrumental ``` `--voice` 是音色 ID,默认 `male-qn-qingse`,完整音色列表在网页画布的语音节点里试听后照抄 ID 即可。音乐按 5 秒计价的模型默认 40 秒,`-d` 可以改,超出模型范围会自动钳进去;按首计价的模型不支持自定义时长,传了会被忽略并提示。 ### 参数不在档位内会怎样 命令行只做提示,不做拦截:你传了一个模型不支持的比例,终端会打一行警告,任务照常提交,最终以服务端校验为准。所以拿不准的时候看 `metadig models <模型ID>` 的详情最稳。 ## 结果去了哪 **默认落到网页画布。** 提交成功那一刻,对应画布项目里就会出现一个"生成中"的节点;任务完成后节点自动变成成品。如果你此时正开着那个画布,它是实时出现的;没开的话下次打开就在。这样命令行出的东西和你手动做的在同一张画布上,可以接着连线、改图、进时间线剪辑。 不想弄乱画布?加 `--no-canvas`,产物只进项目的「历史文件」,需要时再从那里拖回来。 **项目归属。** 每个任务都归属某个画布项目。第一次生成时工具会自动建一个叫「CLI 项目」的项目并记为默认,之后都往里放,一般不用管。想分开管理时: ```bash metadig project list # 我的项目 metadig project create "产品广告A" # 建一个新项目 metadig project use <项目ID> # 绑定到当前目录 metadig project current # 看当前生效的是哪个 ``` `project use` 会在当前目录写一个 `.metadig/project.json`,这个目录和它的子目录里跑的所有生成都归到该项目。一个片子一个文件夹,各归各的,很顺手。单次任务也可以用 `-p <项目ID>` 临时指定。 **下载到本地。** 生成命令加 `-o ./exports` 会在完成后自动把产物存进去;已经完成的任务用 `metadig download <任务ID> -o ./exports`。 ## 任务管理 ```bash metadig status <任务ID> # 查状态和产物链接 metadig status <任务ID> --wait -o ./exports # 等它完成,完成后顺手下载 metadig history # 近 7 天的任务记录(最多 50 条) ``` `history` 只列记录不带链接,拿链接用 `status`。等待有上限:一条任务最多等 2 小时,超过会自动放弃等待(任务本身不受影响)。 ## 遇到问题 - **提交请求超时。** 这不等于失败。网络抖一下,任务可能已经被受理并预扣了积分。终端会给出 `metadig status <任务ID>` 的提示,先查再决定要不要重提,别看到超时就重复提交。 - **任务失败。** 失败和取消都不扣积分,可以改参数重试。原样重提大概率还是失败,先看 `status` 里的说明。 - **积分不足。** 去网页充值或订阅,命令行里没法充。 - **提示模型维护中、会员专属。** 换 `metadig models` 里其它可用的模型;会员专属的模型需要订阅。 - **401 或"尚未登录"。** 凭证过期了,`metadig login` 一次。 - **想连测试环境。** 全局参数 `--api-base http://localhost:6603`,或者环境变量 `METADIG_API_BASE`。 ## 让 AI 助手替你跑 这是 CLI 最省心的用法。装好 Skill 之后(见上面"方式一",或直接在对话里输入 `/metadig` 调用),助手已经知道这些规矩:生成前先 `metadig models` 查最新目录,不凭记忆写模型 ID;批量或高价任务先向你报方案和预计积分;用 `--json` 解析结果;失败不原样重提。你只需要像跟同事说话一样: > 用 metadig 给 ./photos 里的 6 张产品图各出一张 16:9 的电商主图,白底,参考原图,2K,先告诉我大概要多少积分。 它会先跑 `models` 查价、报数给你,你点头后逐张 `gen image -r ... --ratio 16:9 --resolution 2K`,最后把链接和落画布的节点 ID 整理给你。 写脚本也一样简单,`--json` 的输出只在标准输出里,进度提示都在标准错误里,管道很干净: ```bash TASK=$(metadig gen video "海浪拍岸" --no-wait --json | jq -r .taskId) metadig status "$TASK" --wait -o ./exports --json ``` ## 一个完整的例子 从零开始做一条带配音的短片素材: ```bash mkdir autumn && cd autumn metadig project create "秋日短片" metadig project use <上一步输出的项目ID> # 出一张封面 metadig gen image "秋天的银杏大道,午后逆光,电影感,16:9" --ratio 16:9 --resolution 2K -o ./exports # 用封面做首帧,出 5 秒视频 metadig gen video "镜头缓慢向前推进,落叶飘下" --first ./exports/<刚下载的图片> -d 5 -o ./exports # 配一段旁白 metadig gen speech "秋天来了,银杏叶把整条街染成了金色。" -o ./exports ``` 跑完打开网页,「秋日短片」这个画布上已经躺着一张图、一条视频、一段音频,接下来拖进时间线剪一剪就是成片。 --- # 2026-09-03 更新:模型目录页、文档 Markdown 直出与常见问题 - 栏目:产品更新 - 地址:https://waytometa.cn/docs/changelog/2026-09-03-models-docs-faq - Markdown:https://waytometa.cn/docs/changelog/2026-09-03-models-docs-faq.md - 摘要:新增公开的「模型目录」页,所有模型的分辨率、时长档位与积分价格一目了然;文档支持 Markdown 原文直读,首页与定价页补了常见问题,搜索结果里的站点名与图标也修好了。 - 更新:2026-09-03 这次更新主要面向「想先了解再上手」的你,以及在 AI 助手里查 MetaDig 资料的人。 ## 新增:模型目录页 访问 [模型目录](/models) 可以不登录就看到站内全部可用模型:视频(文生视频 / 首帧 / 首尾帧 / 参考生视频)、图片与全景、数字人、配音、音乐、对话模型,每个模型的厂商、时长档位、分辨率、计费方式、单次积分区间与是否会员专属都在一张表里。数据与画布里的模型下拉、命令行 `metadig models` 是同一份,后台上下架、改价、折扣活动实时同步。 ## 文档中心 - 每篇文档都有 Markdown 原文地址:在文章地址后加 `.md`(例如 `/docs/skills/agent-skill.md`),Cursor、Claude Code 这类工具直接读原文比读网页干净得多。 - 新增 [llms.txt](/llms.txt)(站点说明 + 全部文档索引)与 [llms-full.txt](/llms-full.txt)(全文合集),给 AI 引擎和 Agent 一次读完。 - 新增「产品更新」栏目,就是你现在看到的这里。 ## 首页与定价页 - 首页底部新增「常见问题」:MetaDig 是什么、免费吗、支持哪些模型、无限画布是什么、爆款复刻怎么用、能否在终端和 AI 助手里用、团队怎么一起用。 - 定价页的套餐、价格与权益对照对搜索引擎完整可见,不再只有一句概述。 ## 搜索结果里的站点名与图标 此前在 Google 等搜索结果里,MetaDig 显示的是域名和默认地球图标。这次补齐了图标规格与站点名声明,搜索引擎重新抓取首页后会显示「MetaDig」与 M 形 logo;各栏目页对搜索引擎全部可索引。 ## 顺带修复 - 画布小地图节点数多时看不清:节点改为亮灰、编组框改为半透明描边、选中态用品牌青,描边固定 1 像素不随缩放消失。 - 画布里程序新建的节点(重新生成、右键引用生成、工具栏结果、宫格拆分等)会自动找空位,不再层层叠在一起;组内节点的产物也会留在组里。 --- # 2026-09-03 更新:爆款复刻 30 秒以内一段生成到底,口播时机对齐原片 - 栏目:产品更新 - 地址:https://waytometa.cn/docs/changelog/2026-09-03-viral-single-segment - Markdown:https://waytometa.cn/docs/changelog/2026-09-03-viral-single-segment.md - 摘要:框选片段不超过 30 秒时分段生成一律只出一段、没有接缝;口播视频逐句保留原片说话时机;视频参考模式的提示词只写替换需求,镜头语言交给参考视频。 - 更新:2026-09-03 ## 30 秒以内一律一段 此前一条 19 秒的换装视频可能被切成 3 段分别生成,段与段之间人物长相、服装、色调各自「重新掷骰子」,接缝处的动作断裂最先被看见,而且每段都单独计费。现在分段只由总时长决定: - 框选片段 **不超过 30 秒**:整条一段生成到底,没有接缝,换人换景换色调都不再是分段理由。 - **超过 30 秒**:按镜头切点切成尽量少的几段,每段不超过 30 秒。 「分段生成」步骤的标题下会直接写出本次的规则与「N 段 · X 秒」。已经切成多段的老项目不会自动改变,在参考图步重新点一次「确认参考」(1 积分)即按新规则重新反推。 ## 口播视频:逐句保留说话时机 口播视频在提示词里此前只有一行「口播:整段台词」,12 秒 8 句话没有任何时机信息,视频模型只能均匀铺开。现在拆解时保留每句台词的起止时间,分段提示词里会渲染成逐句时间表(`0.0s ~ 1.7s:「……」`),生成的说话节奏与原片的口型、停顿对得上;歌词同理。 ## 视频参考模式:提示词只写替换需求 选择「视频参考复刻」时,原片切片本身就是参考视频,镜头切换节奏、运镜、构图与转场时机都以它为准。提示词不再重复描述镜头,只写:被替换的人物 / 产品 / 场景以对应参考图为准、整体风格、口播时间表与画面文字。分段卡片里原片切片下方新增了镜头列表(每镜起止、口播标记、画面描述),提示词不描述镜头时也有对照。 --- # 2026-09-03 更新:MetaDig Skill 对齐 Agent Skills 开放规范,GitHub 公开 - 栏目:产品更新 - 地址:https://waytometa.cn/docs/changelog/2026-09-03-agent-skill - Markdown:https://waytometa.cn/docs/changelog/2026-09-03-agent-skill.md - 摘要:给 Cursor、Claude Code、Codex、OpenClaw 等 AI 助手用的 MetaDig Skill 按 Agent Skills 规范重做:放进 Skills 目录即自动可用,附带命令速查、生成指南与排错手册;仓库在 GitHub 公开。 - 更新:2026-09-03 ## 变化 MetaDig Skill 是一份写给 AI 助手看的操作手册,让 Cursor、Claude Code、Codex、OpenClaw 这类带 Agent 能力的工具学会用 `metadig` 命令行帮你出图、出片、配音、配乐。此前它是一份裸 Markdown,助手无法自动发现,每次都要把链接贴给它读一遍。现在: - 目录结构按 [Agent Skills 开放规范](https://agentskills.io/specification) 重做:`metadig/SKILL.md`(带 frontmatter)+ `references/` 三篇(全部命令与参数、选模型与估算积分、报错对照表)。放进工具的 Skills 目录(通用 `.agents/skills/`、Cursor `.cursor/skills/`、Claude Code `.claude/skills/`、Codex `.codex/skills/`),重开会话后输入 `/metadig` 或直接描述需求即可。 - 仓库公开:[github.com/pythonthink/metadig-skills](https://github.com/pythonthink/metadig-skills),`git clone` 即可;也可以下载 zip 或在线阅读 `SKILL.md`。 - 文档中心新增《MetaDig Skill 使用指南》:装到哪、怎么和 Agent 说话、积分与安全、与画布「Skill 广场」的区别。 - [CLI 落地页](/cli)的安装提示词改为「克隆仓库或下载 zip → 放进 Skills 目录 → 按 SKILL.md 装 CLI」,新增手动安装 Skill 的目录对照表。 ## 怎么开始 把下面这段话原样发给你的 AI 助手: ```text 请帮我安装 MetaDig Skill:克隆 https://github.com/pythonthink/metadig-skills(或下载 https://waytometa.cn/cli-dist/latest/metadig-cli-skill.zip 并解压), 把其中的 metadig/ 目录放进你的 Skills 目录,然后按 metadig/SKILL.md 完成 CLI 安装与登录。 ``` 之后就可以直接说「帮我出三张 16:9 的秋天海报」,助手自己去跑命令,结果落到你网页上的画布项目里。 --- # 2026-09-03 更新:切页、登录退出不再闪屏 - 栏目:产品更新 - 地址:https://waytometa.cn/docs/changelog/2026-09-03-smooth-navigation - Markdown:https://waytometa.cn/docs/changelog/2026-09-03-smooth-navigation.md - 摘要:全站侧栏与顶栏改为常驻,切换页面只更换内容区;退出登录不再先闪出登录框;首页轮播加载有占位骨架;导航进度条不再对瞬时切页闪一下。 - 更新:2026-09-03 不少人反馈「切个页面会闪一下」「退出登录时先跳出个登录框」。这次把根因一并处理了: - **壳常驻**:侧栏、顶栏、公告横幅、登录弹窗改为全站只挂一次,切换路由只更换中间的内容区,不再整套卸载重建。作品详情页加载中也不再出现「侧栏消失再出现」。 - **退出登录**:先回到首页再清登录态,不会在工作空间页先看到未登录态、再弹出登录框;退出后仍在看的公开内容(模板、探索作品)保留在页面上后台刷新,不再整页退回加载骨架。 - **登录后**:扫码或密码登录成功后直接刷新数据,不再整页重载。 - **首页**:轮播图加载期间显示同比例占位,内容到达时页面不再被顶下去。 - **进度条**:顶部导航进度条只在切页超过 200 毫秒时才显示,几十毫秒完成的切页不再闪一下。 - **滚动位置**:新页面回到顶部,浏览器前进 / 后退恢复到离开时的位置。 顺带修掉的一个老问题:在画布、爆款复刻等整屏页面里点「登录」此前没有弹窗,现在全站任何页面都能弹出登录框。 --- # 2026-09-02 更新:爆款复刻六步流程全面重建 - 栏目:产品更新 - 地址:https://waytometa.cn/docs/changelog/2026-09-02-viral-rebuild - Markdown:https://waytometa.cn/docs/changelog/2026-09-02-viral-rebuild.md - 摘要:爆款复刻按「源视频 → 框选片段 → 配方卡 → 参考图 → 分段生成 → 成片」六步重建:支持上传或直链、60 秒内任意框选、21 种套路配方、三档复刻方式、开源墙一键复刻同款。 - 更新:2026-09-03 爆款复刻是把一条你想复刻的视频拆成「配方」——钩子、节奏、切点与必须复刻的要素——再按配方逐段重新生成一条属于你的成片。这次整个流程重建为六步,每一步都可以回看和修改。 ## 六步 1. **给它一条视频**:粘贴视频文件直链,或上传 mp4 / mov / webm(抖音、小红书、YouTube 的页面地址不是视频文件,请先下载再上传)。可以选一张已有画布关联,所有产物都会落到那张画布上。 2. **框出要复刻的那一段**:单次分析最长 60 秒;视频更长时框出最想复刻的部分,通常是开头钩子最强的那段。 3. **看懂配方卡**:AI 拆解出领域与套路(6 大领域 × 21 种套路)、镜头切点、口播文字、画面文字与整体画风。判断不对可以直接改判,或写意见要求重拆。拆解按固定积分计费,失败不扣。 4. **确定人物、产品与场景**:为配方里识别出的实体生成参考图(按原片生成 / 独立生成 / 直接上传),填一句「整体画风」避免动画原片被生成成真人。 5. **分段生成**:三档复刻方式——反推提示词(最自由)、关键帧复刻(更像原片构图)、视频参考复刻(框选段不超过 30 秒且模型支持视频输入时可用,最贴近原片)。每段可改提示词、重新反推、换模型与参数。 6. **成片**:各段生成完毕后一键拼接,原片与成片并排对比,可下载或在画布里继续剪辑。 ## 开源与复刻同款 成片可以「设为开源」进入开源墙。别人点「复刻同款」时不再收拆解费,直接从参考图步开始。 ## 积分 拆解固定积分、失败不扣;分段反推 1 积分;参考图与分段生成按所选模型计费;成片拼接免费。每一步花多少积分,详见文档中心《爆款复刻使用指南》。