最近很多人开始接触Skill,但第一次制作时,往往不知道应该从哪里开始。
有人会问:
Skill到底是什么?
它和普通提示词有什么区别?
是不是要先学会写代码?
没有现成流程,能不能制作Skill?
一个Skill需要包含哪些文件?
其实,制作Skill并没有想象中那么复杂。
如果你已经跑通过一项任务,可以把真实工作流程整理成Skill;如果还没有跑通过,也可以先使用Codex的计划模式,帮助你搭建第一版流程。
这篇教程会分别介绍这两种方法。
其中,第一种方法会使用我实际制作的“中式种田文生活群像”Skill作为案例,展示如何把一套已经跑通的视频制作流程,整理成可以被AI反复调用的工作方法。
第一章:Skill到底是什么
1.1 把AI想象成一名刚入职的新同事
AI很聪明,学习速度也很快。
但是面对一项具体工作时,它并不了解你的个人经验和工作习惯。
它可能不知道:
这项工作应该从哪里开始
先做什么,后做什么
每一步需要什么材料
遇到不同情况应该怎么判断
哪些要求必须遵守
最终做到什么程度才算完成
如果只做一次任务,我们可以临时写一段提示词,把要求告诉AI。
但如果这项任务会反复出现,每次都从头解释就会非常麻烦,最终结果也不一定稳定。
这时候,我们可以给AI准备一份能够反复使用的工作说明书。
这份工作说明书,就是Skill。

1.2 一份Skill会告诉AI什么
一份Skill通常需要让AI知道六件事:
什么情况下使用这套方法
这项Skill需要完成什么任务
整个任务分为哪些步骤
每一步需要什么信息
哪些规则必须遵守
最终应该交付什么结果

例如,一份中式种田视频Skill可能会告诉AI(案例链接https://www.1ai.net/58465.html):

当用户想制作中式种田风格的古装生活群像时,使用这套方法。
先帮助用户确定主题,再规划不同景别的图片。
图片生成后,必须检查实际画面,才能继续制作视频提示词。
视频中的人物动作必须与图片里的生活事件有关。
这已经不只是一句生成要求,而是一套完整的任务处理方法。
1.3 Skill和普通提示词有什么区别
普通提示词解决的是当前这一次任务。
例如:
帮我生成五组中式种田风格的图片提示词。

AI会根据这句话完成当前任务。
但是换一个新对话后,你可能还要重新说明:
什么才算中式种田风格
需要规划哪些景别
人物应该做什么
图片提示词采用什么结构
生成图片后如何继续制作视频
有哪些容易出现的问题
Skill解决的是一类会反复出现的任务。
制作成Skill后,AI可以提前知道:
什么时候应该使用这套方法
用户当前处于哪个阶段
接下来应该做什么
哪些步骤不能提前执行
最终需要按照什么格式交付
可以简单理解为:提示词是这一次交代给AI的任务;Skill是AI以后处理这类任务时可以反复使用的工作方法。
第二章:什么样的任务适合做成Skill
并不是所有事情都需要制作成Skill。
如果一项任务只执行一次,而且两三句话就能说清楚,直接使用提示词更简单。
一项任务出现以下情况时,才比较适合做成Skill。
2.1 这项任务会反复出现
例如:
经常制作同一种风格的视频
经常按照固定结构撰写文章
经常分析同一种类型的资料
经常生成同一种风格的图片
经常把相同格式的数据整理成报告
如果每次开始任务,都需要重新告诉AI一遍相似的要求,就可以考虑制作Skill。

2.2 每次的操作步骤比较相似
虽然每次输入的主题和素材不同,但整体流程基本相同。
例如,制作中式种田风格的视频时,主题和人物可以变化,但通常都会经过:
确定主题
→ 规划图片
→ 编写图片提示词
→ 生成图片
→ 检查实际成图
→ 编写视频提示词

这种相对稳定的流程,很适合被整理成Skill。
2.3 任务中包含重要判断
有些工作并不是按照步骤机械执行,中间还需要进行判断。
例如:
用户没有明确主题时,应该先提供几个方向
用户已经确定主题时,不需要重复询问
没有看到实际图片时,不能假装已经检查过
图片不适合运动时,不能强行设计复杂动作
用户要求超出Skill能力时,需要说明边界
如果这些判断每次都会影响最终结果,也应该写进Skill。

2.4 任务有相对明确的完成标准
例如:
每张图片必须有一个明确的生活事件
人物不能只是站立、微笑和展示服装
视频动作必须有先后和因果关系
只能选择一种主要运镜
最终结果必须按照固定结构交付
只有知道什么样的结果才算合格,AI才能检查自己的工作是否已经完成。

第三章:制作Skill有两种方法
制作Skill并不存在唯一正确的起点。
根据自己的实际情况,可以选择两种不同的方法。
方法一:任务已经跑通过
如果你已经亲自完成过这类任务,或者已经有一套比较成熟的教程和操作流程,可以直接从真实经验中提炼Skill。
基本过程是:
回顾真实任务
→ 写出完整流程,写出注意事项
→ 找出重复使用的方法
→ 删除只属于单次项目的内容
→ 整理成Skill
→ 换一个任务重新测试

这种方式的优点是比较稳。
因为很多步骤、问题和解决方法已经在真实任务中出现过,不需要完全依靠想象设计流程。
之前的“中式种田文生活群像”Skill,就是用这种方法制作的。

方法二:任务还没有跑通过
如果你只有一个Skill想法,但还没有真正完成过这类任务,也可以先使用Codex的计划模式。

基本过程是:
说明想完成什么任务
→ 使用计划模式梳理步骤
→ 检查并调整计划
→ 根据计划制作第一版Skill
→ 使用真实任务测试
→ 根据测试结果修改

这种方式适合:
只有一个大概想法
不清楚完整步骤
不确定需要哪些输入
不知道中间有哪些判断
想先搭出第一版工作流程
需要注意:
计划模式帮助我们得到的是第一版流程,不代表这套流程已经经过验证。
两种方法没有谁更高级。
已经有真实经验,就使用第一种;暂时没有完整经验,就使用第二种。根据自己的情况选择即可。
第四章:方法一——从真实流程中提炼Skill
在制作这份Skill之前,我已经跑通了中式种田风格图片和视频的制作流程。(案例链接:https://www.super-i.cn/info-3041.html)。

于是,我把自己的需求整理成下面这段话,交给Codex:
我要制作一个Skill。请回顾我生成的图片和制作过程,帮我总结图片生成流程,包括“种田文”“各种景别”“画面要求”“乡间野外”等要求。当用户想制作中式种田风格群像时,先让用户选择主题,再引导用户选择需要的景别和场景,并生成一系列图片提示词。用户完成图片生成并上传实际图片后,再结合视频模板,为每张图片生成对应的视频提示词。
这段话虽然比较口语化,但已经包含了制作Skill需要的主要信息。
我们可以用五个问题把它拆解清楚。
4.1 这个Skill要完成什么任务
这项Skill需要帮助用户完成中式种田风格的图片和视频创作。
它包含两个阶段:
图片阶段:选择主题、规划画面、生成图片提示词
视频阶段:检查用户上传的图片,生成对应的视频提示词

因此,它不是一个只负责“写图片提示词”的Skill,而是一套从图片规划继续到视频制作的完整方法。
4.2 什么情况下使用
我的提示词中已经说明:
当用户想制作中式种田风格群像时使用。
例如,用户提出下面这些需求时,可以使用这项Skill:
中式种田风格
古装慢生活群像
东方水乡生活
乡间野外日常
古代小镇生活

如果用户只是想生成一张普通古装肖像,或者制作写实农业教学内容,就不适合使用这项Skill。
4.3 整个任务有哪些步骤
根据真实创作过程,可以整理出下面这条流程:
用户提出制作需求
→ 选择一个主题
→ 选择需要的景别和场景
→ 生成一系列图片提示词
→ 用户生成并上传实际图片
→ 检查图片中的人物、场景和道具
→ 结合视频模板生成视频提示词

这条流程就是整份Skill的主干。
后面的规则和参考文件,都是为了帮助AI把这些步骤完成得更好。
4.4 有哪些重要规则
我的提示词中特别提到了:
种田文
各种景别
画面要求
乡间野外
视频模板

这些内容需要结合以前的真实生成过程,整理成AI能够执行的规则。
例如:
“种田文”不只是种地,还包括水乡、小镇、手作、饮食和邻里生活
图片需要包含远景、中景、近景和镜头互动
人物不能只站立和微笑,要参与具体的生活事件
乡间野外不能只有空景,需要有人物活动
用户没有确定主题时,先提供几个方向
用户生成图片以后,必须检查实际画面
没有看到实际图片时,不能直接编写视频提示词
视频动作需要与图片中的人物、场景和生活事件有关
这些规则决定了Skill最终生成结果的质量。
4.5 最终需要交付什么结果
这项Skill需要交付两类结果。
图片阶段交付:
可供用户选择的主题
不同景别和场景的组合
一系列完整的图片提示词
视频阶段交付:
对用户实际图片的检查结果
与每张图片对应的视频提示词
人物动作、运镜和声音要求

通过这五个问题,原来比较口语化的需求就变得清楚了:
完成什么任务
→ 什么情况下使用
→ 按照什么步骤执行
→ 必须遵守哪些规则
→ 最后交付什么结果
4.6 让Codex创建第一版Skill
五个问题回答清楚以后,就可以让Codex把流程整理成Skill。
最终得到的文件结构是:
create-chinese-slow-life-ensemble/
├── SKILL.md
├── agents/
│ └── openai.yaml
└── references/
├── image-workflow.md
└── video-workflow.md

这些文件可以简单理解为:
SKILL.md:保存核心流程和重要规则
image-workflow.md:保存图片阶段的详细要求
video-workflow.md:保存视频阶段的详细要求
openai.yaml:保存Skill的显示名称和默认使用方式
从真实流程制作Skill,不是把以前的聊天记录全部复制进去,而是用五个问题找出真正需要重复使用的内容。
可以概括成:
回顾真实任务
→ 用五个问题拆解需求
→ 删除只属于单次作品的内容
→ 让Codex整理成Skill
这样,一套已经跑通的中式种田视频制作流程,就被整理成了一项可以反复调用的Skill。
第五章:方法二——没有跑通任务时,使用计划模式
如果你想制作一项Skill,但还没有跑通完整流程,可以先让Codex帮助你研究参考资料、规划工作方法。
我制作微软风格宣传片Skill时,就使用了这种方式。(案例链接如下https://www.super-i.cn/info-3013.html)
当时,我已经收集了多段微软风格宣传片,也准备了一个小剧本,但是还不知道:
这种视频的质感应该怎样总结
镜头为什么衔接得很丝滑
参考视频应该怎样分析
分析结果怎样用于Seedance 2.5
最终的制作流程应该分成哪些步骤
所以,我没有直接让Codex创建Skill,而是先进入计划模式。

5.1 先说明目标和现有材料
我当时给Codex的要求大致是:
这里面是多段微软风格的宣传片。我现在有一个小剧本,想制作成这种微软风格的宣传片。请先仔细分析这些视频的画面质感、视觉风格和镜头衔接。镜头衔接非常重要,我需要的是微软宣传片中连续、丝滑的视觉动态。不要一帧一帧单独描述画面,而是观察一连串的视觉变化,分析物体怎样运动、画面怎样转换、前后镜头怎样连接,以及整体为什么看起来流畅。我最后会使用Seedance 2.5制作视频。请先进入计划模式,规划应该怎样分析这些参考视频,不要立即开始制作。

这段提示词告诉了Codex四件事:
参考材料是什么
最终想制作什么
分析时最重要的内容是什么
最后会使用什么视频工具
5.2 先审查计划,再开始执行
Codex给出计划后,不要立即执行。
先检查计划里有没有包含真正重要的内容:
是否先分析参考视频,再处理自己的剧本
是否关注连续的视觉动态
是否分析物体的运动方向和速度变化
是否分析前后镜头的匹配关系
是否重点研究镜头衔接和丝滑感
是否考虑怎样把分析结果用于Seedance 2.5
确认计划符合目标后,再让Codex开始执行。

5.3 执行计划,得到动态手册
按照确认后的计划分析参考视频后,Codex可能会整理出一份“动态手册”。

这时候得到的还不是最终Skill。
它更像是一份通过参考视频总结出来的制作方法。
5.4 再梳理自己的制作步骤
有了动态手册以后,再结合自己的实际需求,整理完整的制作流程。
例如:
用户提供宣传片剧本
1、提炼产品信息和视觉重点
2、生成16:9微软风格板提示词
3、用户生成并上传实际风格板
4、根据剧本拆分视频段落
5、规划关键画面和镜头衔接
6、编写Seedance 2.5视频提示词
7、补充画面文字和声音要求

接下来,再用前面的五个问题检查这条流程:
这项Skill要完成什么任务?
什么情况下使用?
整个任务有哪些步骤?
有哪些重要规则?
最终需要交付什么结果?
5.5 最后再制作成Skill
当参考视频的分析方法、动态手册和自己的制作步骤都整理清楚后,再让Codex创建Skill。
这种方法适合下面的情况:
已经有参考资料
大致知道想要什么结果
但还没有完整制作方法
需要先研究参考资料中的规律
需要Codex帮助梳理流程

计划模式在这里的作用,不是直接替你写出Skill,而是先帮助你想清楚:
参考资料应该怎样分析,以及这项任务以后应该按照什么步骤完成。
结语:选择适合自己的方法
制作Skill不要求你一开始就拥有一套完美流程。
如果已经完成过这类任务,就回顾真实过程,用五个问题提取其中可以重复使用的方法。
如果还没有跑通过,就先使用Codex计划模式搭建第一版流程,再通过真实任务不断测试和修改。
两种方法的起点不同,但最后都要经过真实测试
