很多做短视频的朋友都有同样的痛点:看到一条爆款视频,想照着它的节奏翻拍一条,但手动拆镜头、配素材、对齐字幕要折腾大半天。其实这套活完全可以交给 Codex:它能在本地用 FFmpeg 把参考视频拆成镜头,生成一份结构文件,再自动去你的素材库里匹配画面、生成草稿。下面是一套跑得通的流程。
准备工作:把参考视频和素材放好
先建一个 work 文件夹,把你要拆解的参考视频下载进去,取一个好搜索的名字,比如 ref-美食爆款.mp4。
提示:参考视频可以是你刷到的爆款,也可以是你自己剪过、觉得效果不错的视频。文件名越清楚,后面让 Codex 找它越省事。
同时准备好你的素材库目录(一堆可复用的空镜、实拍片段、配图),后面匹配环节会用到。
第一步:让 Codex 拆解参考视频
在 Codex 里打开 work 文件夹作为工作区,新建对话,把下面这段直接发过去(把文件名换成你自己的):
我需要拆解一个参考视频。
参考视频位置在 @ref-美食爆款.mp4
请帮我完成这几件事:
1. 用 FFmpeg 识别视频的镜头切换点(通过帧间差异分析)
2. 为每个镜头提取关键帧,保存为图片
3. 提取视频的音轨,单独保存
4. 生成一个 recipe.json 文件,记录每个镜头的开始时间、结束时间、时长、关键帧路径
5. 如有文案,根据音频生成配音文本,按镜头分段,文案需要精校,避免出错
完成后按照 AGENTS.md 要求,保存到对应文件夹,并告诉我识别了多少个镜头,让我确认切分是否合理。
Codex 会调用终端跑 FFmpeg,把视频切成若干小片段,并产出 recipe.json。
第二步:检查 recipe.json 和镜头拆分
recipe.json 是整个流程的核心依据,它记录了参考视频的完整结构,后面匹配素材、生成配音、做草稿都基于它。打开看看,确认每段镜头的起止时间是否合理。
提示:大部分情况下自动识别能用。如果某个完整镜头被切成了两段,或两个镜头没分开,直接让 Codex 再调一下就行,不用手工改文件。
第三步:让 Codex 匹配素材库
拆好结构后,最关键的一步是「换素材」。传统做法是你一个镜头一个镜头去素材库翻,容易漏也费时。你只需要告诉 Codex 素材库在哪,让它做视觉匹配:
我需要从素材库中匹配替换素材。
素材库路径:@/work/素材库
请按 recipe.json 里每个镜头的画面语义,从素材库挑选最贴近的关键帧替换,
生成新的镜头清单,并告诉我每个镜头匹配了哪个素材文件。
这一步就是自动化价值最大的地方:你不用再手动拖时间线。
第四步:生成草稿与配音
素材匹配完,让 Codex 按新清单把镜头拼回时间线,并补上字幕、配音和转场,导出成剪映能识别的草稿工程。你拿到的是一份「已经排好的草稿」,而不是散落的片段。
提示:如果文案是 AI 生成的,务必人工精校一遍,尤其是专有名词和人名,避免字幕翻车。
第五步:导出到剪映微调
把草稿导入剪映,做最后的节奏微调、加个封面,就可以发布了。你真正花在「创作判断」上的时间,从几小时压到了半小时左右。
关键点与避坑
- 参考视频命名清楚,Codex 才能准确定位,别用
新建文件夹(2).mp4这种名字。 recipe.json一定要先看一眼再往下走,结构错了后面全白干。- 素材库越规整(按场景分类),匹配质量越高。
- 配音文案一定人工校对,AI 听写的错别字最毁观感。
来源:抖音实战分享《Codex 自动化剪辑从 0 到 1,开源我在抖音赚了 5W 的剪辑工作流》,经本教程改写。
资料最后核对日期:2026-08-02 · 内容整理自 CodexGuide 社区公开教程