手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

普通人,也能做出好莱坞级别的大片吗?

如果我告诉你,低成本、不用进剧组,一个人在家,就能做出《魔戒》风格的玄幻大片——你信吗?

这篇文章,我会把这套完整的工具流一步步拆开给你看。

学完它,你不只是看个热闹,而是真正掌握方法,做出属于你自己的高级视效大片。

从一个想法到一条完整的片子,中间要经过哪些步骤?

正好最近,我在做一部类似《魔戒》风格的 AI短片

今天就拿这个案例,把从 0 到 1 的制作流程拆开讲清楚。

从剧本怎么写、人物怎么定、场景怎么做,到分镜怎么拆、视频怎么生成,

最后怎么剪成一条完整的片子,我会结合实际制作过程,一步步展开。

文章里也会放出我实际使用的提示词、人物三视图模板,以及视频生成时的思路和处理细节。

希望你看完后,既能看懂整套流程,也能动手开始做自己的第一条 AI 短片。

一、工作流总览

很多新手第一次做 AI视频,最容易犯的错误,就是还没想清楚要拍什么,就急着打开工具生成视频。

今天刷到一个新模型,赶紧试试;

明天看到一个新平台,又换过去试试。

最后,工具试了一圈,积分花了不少,手里攒了一堆零散的镜头,却始终拼不出一条完整的片子。

问题往往就出在这里:每个工具都试了,却没有把制作流程串起来。

其实,AI 视频的制作逻辑并不复杂。

先把步骤理清楚,知道每一步要解决什么问题,后面就会顺畅很多。

你可以先记住下面这条流程:

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

想法 → 剧本 → 风格测试 → 人物 / 场景 / 道具资产 → 视频生成 → 剪辑成片

后面不管你做的是古装、玄幻、都市、广告还是文旅片,底层思路其实都差不多。

题材会变,模型会变,但这套流程基本不会变。

二、市面上AI软件这么多,我该怎么选?

先说结论。

如果你只是想完整做出第一条 AI 视频,其实不需要一口气学十几个软件。

这篇里主要会用到三个:

•DeepSeek/ChatGPT:负责剧本、剧情拆解和提示词优化。

•LibTV:负责人物、场景、分镜和视频生成。

•剪映:负责最后的剪辑、字幕和音乐。

基本就够了。

聚合平台:LibTV

我自己主要用 LibTV 来跑整套生成流程。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

它比较方便的一点是,人物、场景、图片和视频都可以放在同一个画布里处理,不需要在不同网站之间来回切。

双击画布,就可以创建图片或视频节点。模型选择栏里,也可以直接切换不同的图片、视频模型。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

对新手来说,这种节点式画布有一个好处:

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

你可以非常直观地看到,一条视频到底是怎么一步一步做出来的。

素材如果在其他平台做的,直接上传到 LibTV 就行。

三、剧本:先把这一集发生的事讲清楚

剧本没想清楚,后面的人物、场景、分镜,都可能跟着返工。

但在 AI 时代,你不需要一上来就写出一个完整的故事。

哪怕只有一个模糊的想法,也可以先丢给AI,让它帮你搭出剧本骨架,再一步步把故事打磨清楚。

这次,我分别用 DeepSeek V4 Pro 和 GPT-6 Astra 的高模式测试了剧本创作。

就这次实测而言,我更偏向 GPT-6 Astra。

它在剧情逻辑、世界观搭建,以及人物的欲望和动机上,处理得更到位,写出来的故事走向也更接近我的预期。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

当然,DeepSeek V4 Pro 的表现也很能打。

以我的使用感受来看,它的剧本能力和 GPT-5.6 的中模式基本打平,用来梳理想法、搭建故事框架,完全够用。

大家可以根据自己的需求选择模型。

关键是借助 AI,把“我大概想讲什么”,逐步推敲成“这个故事到底该怎么讲”。

不过,AI 秒出剧本,不代表这个剧本能直接拍。

有了初稿,还要继续删改。

拿到第一版以后,我会自己再过一遍,核心只看三点:剧情逻辑顺不顺、画面能不能生成、台词像不像人话。

比如这次,故事设定在中古欧洲风格的奇幻世界,桥上出现车辆就显得有些违和。

所以,我删掉了车辆,把伤兵撤退改成由卫兵搀扶着离开。

原本从车底滚出来的爆炸铁球,也相应改成由独眼恶魔投出,让动作衔接更顺,也更符合世界观。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

有什么问题和需要调整的,只需要用大白话和AI沟通就好。

在我看来,AI时代,学会发现问题和向AI抛出问题是很重要的能力。

四、风格测试:先把片子的美术调子定下来

剧本定稿之后,先别急着去定人物、做场景。我习惯先做一轮「风格测试」——找对标、找参考图,把整部片子的美术方向先试出来。

风格不是凭空想出来的。我会先去找对标——电影、剧集、摄影里喜欢的画面,都是现成的参考。把参考图丢给 AI,让它反推成提示词,方向就慢慢清晰了。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

这次前期做了不少参考图反推,方向逐渐集中到了暗黑史诗奇幻、哥特宗教美学和写实 CG 质感、神圣核。

我的做法是,先把剧本放进 ChatGPT,让它根据剧情生成一批概念图。

这一步先把世界的大致样子找出来:云海上的王城是什么气势,天使与恶魔交战的东桥是什么结构,圣殿内部又是什么氛围。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

概念图出来以后,再从里面挑选构图、空间和氛围比较合适的画面,继续细化成正式的场景图。

不过,我在实际使用中发现,ChatGPT 生成的图有时候涂抹感比较强。

远看氛围不错,仔细看,建筑结构、石材纹理和装饰细节还不够清楚。

这时候,我会把选中的概念图再交给 AI,

让它反推提示词,把画面的构图、光线、色调、材质和建筑特征描述出来,

再放进 MidJourney 生成一轮场景图和空镜图。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

我一开始的场景就是这样做的。先用 ChatGPT 找到想要的感觉,再用 MidJourney 继续细化。

从这次的出图效果来看,涂抹感减轻了不少,原本想要的画面氛围也保留得比较好。

我就是用这样的方法生成了这次视频的场景资产。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

●●●

暗黑史诗奇幻场景,被远古森林吞没的哥特式大教堂内部,超宽横屏,电影级写实游戏cg环境概念图。 低机位广角,从破败中殿望向远处圣坛,纵深强烈,视觉消失点位于画面偏右。左侧前景是一尊巨大的风化石雕天使,低头垂首,羽翼残损,长袍褶皱精细,表面爬满苔藓与藤蔓。右侧前景横卧断裂的石柱,碎石、蕨类和少量白色野花散落其间。中央湿润的石板路与层层残破台阶通向远处高耸的石制祭坛。 数棵巨大而扭曲的古树从教堂内部生长,粗壮黑色树干沿两侧盘绕,根系撕裂地面、缠住石柱,巨大的枝干横跨上方,形成天然拱框。高耸的哥特尖拱、细长立柱、残缺墙体与树木融为一体。屋顶大面积坍塌,顶部垂落藤蔓与枯枝。远处高墙保留一扇巨大的圆形玫瑰花窗,精密放射状石质窗棂,下方排列狭长尖拱窗,冷白天光穿过窗洞与破损穹顶。 前景深暗,远景明亮,柔和体积光穿过薄雾,空气透视分明,阴影保留丰富细节。整体以炭黑、冷灰、灰绿色、暗橄榄绿为主,低饱和,克制的银白色高光。潮湿石板和浅水呈现微弱反射,真实的粗糙树皮、侵蚀石材、苔藓绒感、泥土与落叶,材质细节丰富,光照自然。 庄严、寂静、荒凉、神秘,文明消逝后被自然重新占据的失落圣殿,宏大尺度,环境叙事,电影级构图,物理真实渲染,细腻全局光照,厚重空间感,画面清晰但不过度锐化。

风格测试跑下来,如果哪张概念图里的角色形象特别对味。

可以直接把它转成人物三视图,省得后面从零开始定人物。

这样美术调子和角色形象就连起来了。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

五、资产设计:整个流程最花时间的一步

剧本和风格都定下来以后,下一步不是生视频,而是先做资产。

所谓资产,就是片子里反复出现的东西。主要有三类——人物、场景、道具。

因为 AI 记不住上一镜:角色穿什么,房间什么样,桌子在哪边。前面不固定,后面每一镜都可能重新随机生成。所以连续剧情想稳,就必须把反复出现的资产固定下来。

人物资产

风格定下来以后,下一步就是固定人物三视图。

因为人物最容易出的问题就是变脸——不同批次生成的视频,人物样子变了,怎么办?、

不管拍什么类型的短片,生成之前,先给主要角色建一张标准参考图。

这里有四个要点。

要点 1:尽量不要背景。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

错误示范

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

正确示范

第一次做人物设定,背景越简单越好:纯色背景、主体完整、光线干净。背景越复杂,模型要处理的干扰信息就越多。

要点 2:人物比例要好看。

尤其是现偶、古装、武侠这类真人题材,我会明确要求:

头小身长、接近二八比例、完整全身。不然很容易头大、腿短,像游戏 Q 版角色。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

错误示范

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

正确示范

要点 3:人物尽量不要拿道具。

图片的权重大于文字的权重。

定妆照里让角色手里拿着道具,哪怕生成视频时你在文字里写”不要拿任何东西”,画面里还是大概率攥着道具。

所以先把”人”定下来,再单独做道具。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

错误示范

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

正确示范

要点 4:人物图一定要改成三视图。

这是整个流程里最容易忽略的,但我现在一定会做的一步。

很多人生成一张好看的角色半身照,就直接拿去做视频了。

问题是:一张正面照,AI 根本不知道这个人背后长什么样。

你让他转身,衣服结构就变了;让他侧脸,发型也换了。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

采用三视图这个结构,

我用下来非常方便:左边负责锁脸,右边锁身体、服装和背面结构。

后面无论做近景、侧面还是背影,都可以直接拿这一张当参考。

提示词总结:

这套角色提示词我磨了一周,实测效果如下。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

创作总结不易,跪求观众老爷们一键三连支持一下~

人物提示词(9:16)

●●●

高级感,氛围感,朦胧感清晰流畅细腻自然,oc渲染,cg渲染,真人质感 3D偏真人画风, 真人三庭五眼比例 人物渲染,神似bjd,肌理感,毛孔细腻 皮肤质感纹理 写实逼真,发丝精细且根根分明,细节五官细节发丝,发丝发光面部发光,虚拟引擎背景渲染轮廓光,暖色硬光/冷色硬光(选一个) 勾勒轮廓。面部柔光 均匀打亮。黑柔镜头 纯黑色背景 棚拍定妆照,正面镜头,半身照 。+你的提示词(只需要简单的描述就好 例如 身份+风格/性格)

三视图(16:9/21:9)

●●●

生成全身三视图以及一张面部特写。(最左边占满 1/3 的位置是超大的面部特写,右边 2/3 放正视图、侧视图、后视图,二八身材比例),纯色背景

道具资产:把会参与动作的道具单独做出来

人物确定以后,还有一批东西需要单独准备。

这次就有圣剑、剑鞘和传音石的资产制作。

传音石看起来只是一个小配饰,但开场林晚要按住它汇报巡逻,陆恩的求救也通过它传来。

镜头会专门拍到,它就需要一个明确的样子。

已有设定采用银色哥特镶座和冰蓝发光晶石,并配了近景与不同角度。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

提示词可以这样写。

●●●

奇幻短片道具设定图,一枚可佩戴在领口的传音石,银色哥特镶座包裹冰蓝色发光晶石,金属边缘有细微磨损。纯色背景,左侧展示清晰特写,右侧排列正面、侧面与背面,保持同一形状、材质和镶嵌结构,背面展示佩戴连接部位。无人物、无手部、无文字、无水印。

做分镜之前,把这些道具从剧本里找出来,标清第一次出现的位置。

后面的动作就有东西可以承接。

六、视频生成

人物、场景、道具都齐了,终于可以开始生成视频。

把资产上传到LibTV :

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

链接对应资产,选择sd2.5模型,全能参考,选择对应比例和秒数。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

提示词的一个简单模板

例如:

●●●

CG电影质感 3D渲染 史诗奇幻电影质感,横屏16:9。
开场人物A站在画面左侧,身体朝右,人物B站在画面右侧,面向人物A,两人中间隔着木桌。
镜头1:2s 中景固定机位,人物A抬头看向人物B,说:“你终于来了。”
镜头2:4s 切人物B近景,人物B没有回答,只缓慢握紧右手。
镜头3:3s 人物A表情逐渐严肃,镜头缓慢向前推进。只生成对白、衣料摩擦声和室内环境音,不生成背景音乐。
禁止字幕、文字、水印、音乐

但在实际生成视频的时候,几乎所有人一定会遇到一个麻烦——不同批次的视频,人物站位很容易发生变化。

上一条里还是男主站左边、女主站右边,到了下一条,AI 可能直接把两人的位置对调。

不同批次之间,AI 不会自动记住你上一条视频里的空间关系。

所以我现在每开启一个新的视频批次,都会重新把这两件事描述一遍:

人物和人物的位置关系,以及人物和场景的位置关系。

所以每开启一个新的视频批次,都要重新把两件事描述一遍:人物和人物的位置关系,以及人物和场景的位置关系。

这一步看似麻烦,但对剧情的连贯性非常重要。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

对于人物位置关系比较复杂的情节,可以从上一批生成的视频中截取一张静帧。

上传到这一批次的视频的全能参考中,并明确告诉它:“人物站位和位置关系参考这张图。”

这样,AI 就有了直观的画面参照,更容易延续上一段视频中的人物站位,让前后镜头衔接得更自然。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

遇到穿帮镜头,也可以截取静帧,修正画面后单独重新生成这一段视频,再替换回原片中。

不用重新整段的抽卡,节省积分。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

七、剪辑微调:声音是决定你视频成败的关键

所有镜头生成好以后,就进入最后的剪辑和后期阶段。

把素材统一放进剪映,按照剧情顺序拼起来,再根据节奏调整镜头长短,补上字幕、音乐、环境音和必要的转场。

这里有一个小建议:生成视频的时候,尽量不要让 AI 自动加背景音乐。

因为不同镜头生成出来的 BGM 很容易各不相同,拼在一起会很跳。

留到剪辑阶段统一配乐,听感会更连贯,情绪也更好控制。

音效也需要在后期补充。

AI 直接生成的声音有时候会比较单薄,撑不起画面的冲击力。

所以这次我在后期重新做了配音,也重新铺了一遍音效,把动作、环境和人物的声音层次补起来。

画面上,我还对部分镜头做了局部调色,并适当加了一点辉光,让高光处透出柔和的光晕,进一步突出天使与圣殿那种神圣的质感。

手把手教你从0到1完整制作AI视频短片全流程(零基础入门版)

写在最后:先跑通,再谈完美

到这里,一条 AI 视频从 0 到 1 的完整流程已经很清楚了:

一个想法 → AI 写剧本 → 风格测试 → 人物三视图 → 场景 / 道具资产 → 视频生成 → 剪辑成片

接下来最该做的,是真正动手跑一遍。

提示词永远收藏不完,但第一条视频得靠你自己做出来。

第一条不必追求完美,把流程完整跑通,比什么都重要。

很多问题,只有做到那一步才知道卡在哪;很多技巧,也是在一次次调整里慢慢摸出来的。

先把第一条做出来,再做第二条、第三条。每做完一条,回头复盘——哪步顺、哪步卡、下次怎么更快。

做得多了,属于你自己的方法论自然就沉淀出来了。

声明:内容来源公开的各类媒体平台,若收录的内容侵犯了您的权益,请联系邮箱,本站将第一时间处理。
教程百科

AI绘画提示词创作第四节:模拟真实设备与纪实瞬间, 让 AI 学会“抓拍”

2026-9-14 9:19:01

资讯

OpenAI承诺向美国AI安全研究所提供下一个AI模型早期访问权限

2024-8-2 9:33:23

搜索