“短视频拆解成图文教程”做成了一个 Codex Skill
原创作品 · 创作者联盟

“短视频拆解成图文教程”做成了一个 Codex Skill

starvenstarven创作者联盟2026/09/21 170 浏览

我把“短视频拆解成图文教程”做成了一个 Codex Skill

不会写教程、不会截关键步骤,也能把抖音和小红书内容整理成一篇真实、可复刻的图文文章

把短视频变成可复刻图文教程

图 1:Video Tutorial Skill,从创作者链接到可交付的图文教程。

很多人看到一条不错的 AI 视频或教程,第一反应都是:“能不能把它整理成文章?”

真正开始做,问题马上就来了:视频里到底用了什么工具?哪些步骤是创作者明确说过的?哪些只是我们根据画面推测的?截图怎么选,字幕怎么避开,提示词和参数能不能照抄?

如果把这些问题全部丢给普通 AI,它很容易写出一篇“看起来完整、实际上无法验证”的文章。软件、模型、参数甚至创作者的隐藏流程,都可能被自动补齐。

于是,我把自己反复做视频拆解的工作方法,整理成了一个可以安装到 Codex 里的开源 Skill:Video Tutorial Skill。

它不是帮你把视频简单概括一遍,而是把“判断内容—核实证据—推荐方案—等待确认—制作教程—评测复刻性—交付 Word”变成一套稳定流程。

01|这个 Skill 到底能做什么?

它面向抖音、小红书以及其他短视频或创作者页面,目标只有一个:把来源内容整理成小白能够跟着操作的中文图文教程。

收到链接后,它不会立刻开始写,而是先判断内容属于哪一种:

  • 教程类: 尽量忠实还原视频中出现的操作顺序、输入内容、按钮、参数和结果。

  • 作品展示类: 分析人物一致性、视觉风格、分镜、镜头语言、运动、剪辑和声音,再设计一条可实现的复刻路线。

  • 工具披露类: 优先采用创作者明确公开的工具;没有公开的环节,只能标注为推断或我们的复刻方案。

  • 证据不足: 明确告诉你缺少录屏、截图还是文字,而不是靠猜测把空白补满。

Video Tutorial Skill 开源项目

图 2:这是一个 MIT 开源 Skill,仓库中包含工作流、排版规范和校验脚本。

它还会把文章里的信息分成四层:来源画面事实、创作者披露、当前官方资料、我们的复刻方案。这样,读者能够看懂“视频里确实出现了什么”,也能知道“哪些步骤是为了复刻同类型作品而重新设计的”。

02|怎么安装?推荐先用 Skill Installer

OpenAI 官方文档说明,Skill 本质上是一个包含 SKILL.md 的目录,可以附带参考资料、脚本和资源。Codex 既可以显式调用 Skill,也可以根据任务描述自动匹配。

最省事的安装方式,是在 Codex 中输入:

$skill-installer

请从 https://github.com/star-ven/video-tutorial-skill 安装这个 Skill。

如果需要让一个项目里的成员共同使用,也可以把仓库放入项目的 .agents/skills/video-tutorial-skill 目录:

git clone https://github.com/star-ven/video-tutorial-skill.git \

.agents/skills/video-tutorial-skill

两种安装方式

图 3:个人使用推荐 Skill Installer;项目共享可放进 `.agents/skills`。

安装后如果没有马上出现在技能列表中,重启 Codex。你也可以输入 $ 搜索已安装的 Skill,或在 Codex CLI、IDE 扩展中运行 /skills 查看。

需要说明的是:这个项目是独立开源的工作流 Skill,并不是 OpenAI 官方发布的内置 Skill;它使用的是 Codex 官方支持的 Skill 机制。

03|第一次怎么用?复制这段话就够了

显式调用最稳定。新建一个任务,把创作者链接和下面这段话一起发给 Codex:

$video-tutorial-skill

这是一个抖音 / 小红书创作者链接。

请先判断它是教程、作品展示还是工具披露,

给我推荐复刻路线、拆解重点、篇幅和配图方案。

我确认后,再制作成可供小白跟做的图文教程 Word。

第一次调用 Skill 的提示词

图 4:第一次使用时,先要求它推荐方案,不要直接让它写最终文章。

这里最重要的不是提示词有多长,而是“先推荐,再制作”。Skill 会先告诉你:它判断这是什么内容、准备使用什么工具、文章重点是什么、需要几张图片、预计多长,以及哪些地方证据不足。

你确认以后,它才进入正式制作。这一步能避免做了几页之后,才发现路线和你想要的完全不同。

04|三种常用任务,可以直接照着发

场景一:原视频本身就是教程。

按视频真实顺序整理操作步骤。每一步写清输入什么、点击哪里、预期结果是什么。

如果当前软件界面与视频不同,请单独标注版本差异,不要自行补写不存在的按钮。

场景二:视频只展示了最终作品。

先分析人物一致性、分镜、镜头语言、运动、剪辑、声音和视觉风格,

再选择目前能够实现的工具,设计一套制作同类型作品的复刻教程。

不要声称这就是创作者的原始操作。

场景三:创作者只透露了部分工具。

创作者明确说使用了即梦、LIBTV 和 Midjourney。

请优先用这些工具设计复刻路线;没有披露的步骤标注为“我们的复刻方案”,

不要虚构创作者的模型、参数和提示词。

05|你把链接发过去以后,它会做什么?

整个流程不是“一次性生成”,而是六个阶段:检查来源、判断内容、提交推荐、等待确认、正式制作、复核交付。

Video Tutorial Skill 工作步骤

图 5:每个新作品都先经过判断和推荐,确认后才进入文章制作。

正式制作时,它会优先选择没有被字幕遮挡的原视频画面;必要时裁掉字幕区,不用生成图替代真实画面。图片和图片标题居中,不叠加干扰性框选标记,也不做思维导图。

文章会先给出“能不能复刻、能复刻到什么程度”的结论,然后再写具体步骤、可复制提示词、失败排查和限制。最后默认生成紧凑的 Word 文档,并进行逐页渲染检查。

06|为了得到更好的结果,你最好提供这些信息

链接之外,最好再补充四件事:

  1. 是否已经获得转载或分析授权;

  2. 创作者有没有明确说过使用什么工具;

  3. 你想做“忠实教程”还是“同类型复刻”;

  4. 最终需要 Word、普通文章,还是只要拆解结论。

如果平台登录、反爬或地区限制导致页面无法完整读取,直接补一段录屏、视频文件、字幕或关键截图。证据越完整,教程越接近真实操作。

07|最后能得到什么?

最终结果不是一份视频摘要,而是一篇可以发布、也可以让别人跟做的图文教程:有标题、有真实配图、有具体步骤、有可复制输入、有复刻评测,也有明确边界。

真实教程文档效果

图 6:真实交付示例,视频拆解、操作步骤、配图和评测进入同一份 Word。

但它不会承诺两件事:第一,不会把推断冒充事实,本文中的复刻方案不等于创作者的原始完整流程;第二,不会保证所有平台链接都能直接访问。当来源不够,它应该请求补充材料,而不是继续编写。

这正是这个 Skill 的价值:不是让 AI 写得更多,而是让它少猜一点、多核实一点,把每一步写到别人真的能够复刻。

08|开源地址与使用入口

GitHub: https://github.com/star-ven/video-tutorial-skill

站内下载:物界前沿|AI 评测

OpenAI 官方 Skill 文档: Build skills

如果你经常需要把教程视频、AI 作品或创作者案例整理成图文内容,可以直接安装使用。第一次不必研究目录和脚本,记住一句话即可:

先帮我判断这个视频该怎么拆、用什么工具复刻;我确认后再制作成图文教程。

09|几个常见问题

没有视频文件,只有平台链接能不能用?

可以先检查链接。若页面能够正常读取,就根据视频、字幕、配文和创作者说明整理证据;如果遇到登录、反爬或地区限制,再补充录屏、原视频、字幕或关键截图。Skill 不应该把无法看到的内容当成已核实事实。

每次都必须输入 `$video-tutorial-skill` 吗?

不一定。这个 Skill 允许根据任务内容自动触发,但显式调用更容易得到稳定结果,也方便你确认当前任务确实使用了指定工作流。

只能做 Word 吗?

不是。Word 是默认交付形式,因为它能保留图片、标题、代码块和完整排版。你也可以在任务里要求输出普通文章、网站稿、公众号推文初稿或仅提供拆解结论。

为什么它总要先让我确认方案?

因为同一个视频可能有完全不同的目标:忠实转写教程、分析成片方法、复刻同类风格,或只评测工具能否实现。先确认路线,能够避免后面整篇文章方向错误,也能提前暴露证据不足和版本差异。

别人安装以后,也会得到和我完全一样的文章吗?

不会。Skill 固定的是判断标准、证据边界和交付流程,最终内容仍取决于来源材料、用户要求、可用工具和当前软件版本。它更像一套可重复使用的编辑规范,而不是固定文章模板。

把工作流交给 Skill,把最终判断留给自己。

作品来自 创作者联盟,已通过内容审核。