
AI视频最长生成15秒,15秒以上的AI视频应该如何快速生成?今天分享我的三个快速方法(之前分享过视频操作教程,这次将细节和提示词总结了下,方便大家复制)
第一段15秒的提示词:
基础设定:一段15秒中国古代雪山战争的电影片段。 主角:女将军“秦昭宁” {{Mixed 4}} ,女将军的马 {{Mixed 3}} ,女将军的红缨长枪 {{Mixed 1}} 反派: 一个塞外的军队 {{Mixed 5}} 配角:女将军带领的军队 {{Mixed 6}} 环境:雪山峡谷 {{Mixed 2}} 其他约束: 35mm 胶片摄影机拍摄,需要运用到分镜和不同视角切换,让整个画面更有节奏感和电影感,动作凌厉。画面强烈的视觉冲击。画面带有强烈的冲击力和打击感。整个画面有节奏感和电影感,仅生成环境的音效,不要配背景音乐。真人写实中式史诗电影风格。画面禁止出现任何字幕和任何白色的字体;画面出现文字,采用透明字体。完全真人实拍质感,经典武侠战争电影风格。极寒雪山峡谷,暴雪纷飞。所有人物面部细节的风格参考 画面一:低角度贴地运镜。镜头紧贴黑色战马的马蹄,跟随马匹缓慢踏过厚重积雪,积雪被马蹄踩碎,冰粒向镜头飞溅。镜头沿着战马前腿平稳上摇,经过手持红缨长枪的秦昭宁的红黑金铠甲和手中的缰绳,最终推进至她的面部近景。秦昭宁骑在马上,神情沉稳警觉,目光观察前方峡谷。 画面二:镜头切换至高空航拍大全景。秦昭宁率领军队在狭长的雪地峡谷中前进。女将军一马当先在最前面,队伍被两侧高耸陡峭的雪崖夹在中央。 画面三:航拍镜头继续缓慢升高,并向峡谷两侧横移。雪崖顶部的风雪中,逐渐出现大量敌军黑影。切换分镜,敌兵从岩石和积雪后方站起,部分敌兵合力推动悬崖边缘的巨石,岩石从崖壁上缓慢滑落。敌军铺满峡谷两侧,形成居高临下的包围。 画面四:近景画面,一名士兵抬头发现雪崖上的敌军和开始滚落的巨石,脸色骤变,指向上方大喊:士兵:“有埋伏!”。巨石砸中个别士兵,军阵开始骚动,战马不安嘶鸣。镜头切至秦昭宁面部特写,她猛然抬头,眉头收紧,并回头看向自己的士兵,被巨石砸中。眼神中同时出现愤怒与坚毅。
方法一:关键帧截取法
这个方法是参考前序视频 生成后续视频的一个改良方法,将原本参考整个视频 改为参考 几张关键帧图片。

它有两个优点,一个是相比参考视频 生视频,它可以减少一半的积分,二是 直接用参考视频 生视频,连续生成三次的时候 画面就会开始有一些噪点,这种方法能一定程度解决这种现象。

具体实操:截取前序视频的关键帧——生成色卡(固定风格使用)——将色卡+前序视频的关键帧 作为参考物料——生成后续视频

-关键帧截取:重点以下几个画面:



-色卡生成:(2K画质,image2.16:9)

分析我上传的所有参考图片,提取其中最具代表性的主色、辅助色和点缀色,并将它们整理成一张横向的专业设计色卡。画面采用极简、克制的编辑设计风格:温暖的米白色纸张背景,上方居中排列色卡标题与一行简短的色彩氛围说明;中间横向整齐排列 12–13 个等宽的竖向矩形色块,色彩从浅到深自然过渡,准确反映参考图的整体配色,不添加参考图中没有的鲜艳颜色;每个色块下方标注对应的 HEX 色值,并附上简短的中文的标准色彩名称以及对应的使用场景。整体具有工业设计档案、电影色彩研究、材质样本册与高级品牌视觉手册的质感。留白充足,排版严谨,低饱和度,哑光纸张质感,柔和自然光,正面平视,高清、干净、无多余装饰
-后续视频生成:

-提示词:
[基础础设定:一段15秒中国古代雪山战争的电影片段。生成尾帧画面 的后续剧情 主角:女将军“秦昭宁” {{Mixed 6}} ,人物三视图 {{Mixed 1}} (没有披风),骑着马,手持图片中的红缨长枪 反派: 一个塞外的军队 {{Mixed 2}} 配角:女将军带领的军队 {{Mixed 3}} 环境:雪山峡谷 {{Mixed 4}} 其他约束: 35mm 胶片摄影机拍摄,需要运用到分镜和不同视角切换,让整个画面更有节奏感和电影感,动作凌厉。画面强烈的视觉冲击。画面带有强烈的冲击力和打击感。整个画面有节奏感和电影感,仅生成环境的音效,不要配背景音乐。真人写实中式史诗电影风格。画面禁止出现任何字幕和任何白色的字体;画面出现文字,采用透明字体。完全真人实拍质感,经典武侠战争电影风格。极寒雪山峡谷,暴雪纷飞。所有人物面部细节的风格参考 画面色彩参考: 色卡图
画面一:全景镜头,秦昭宁的军队被巨石砸伤,很多伤员。切换秦昭宁面部特写,眼神坚毅 大喊了一句:前军,随我冲出谷口!” 画面二:侧面跟拍 秦昭宁带领骑兵向谷口冲锋。。转为第一视角,前方风雪中,敌军骑兵缓缓出现。 画面三:采用电影级别的多分镜切换和组合,秦昭宁转头一看,眼神变的更加坚毅,大喊一声,策马冲入敌阵,长枪扫落数名敌兵。并冲入峡谷口的一个拐弯处的背影,塞外的敌军在后面追赶的背影。 第三段: 画面一:正面高空俯拍视角,秦昭宁单枪匹马在峡谷奔袭,后面敌军在追 画面二:切换女主的近景分镜,背景虚化 敌军再追赶 画面三:正面高空俯拍视角,女主甩远了敌军了,峡谷仅剩女主单枪匹马。突然,女主拽动缰绳,停下了马,紧接低角度马蹄特写。随后,切换近景女主镜头(女主背后没有任何的人),女主似乎看到了什么,深呼吸坚毅的表情。]
注意事项:
截图的画面 (除了尾帧)一次 先不要在提示词框直接引用,仅作为参考就行;
第二段视频的 首帧画面的剧情,尽量不要是参考物料里面的图片(不然生成出来的画面质感会有一些噪点)。
方法二:分镜组合拼接法
这个方法是先生成一段25-30秒的提示词,接着用同样一段提示词重复生成多段15秒的视频,然后将这些视频分割成多段的分镜片段,然后像个导演一样,选择有用的分镜片段 ,基于视频人物的动作和节奏,重新拼在一起。

具体实操:生成一段25-30秒的长提示词——同段提示词多次生成——每段视频拆分为多个分镜——基于人物动作/剧情节奏 等 完成 分镜的组合拼接
-提示词生成:(Gemini或者GPT)
我要一段 1000 个字的提示词,大概 25 秒 – 30 秒。剧情:女将军骑马从峡谷冲出来,背后有追兵,前面有千军万马的敌军。女将军回头,接着看下旁边有一条非常宽广的冰河,女将军接着就往河的方向跑去,然后敌军首领喊:给我拿下她,别让她跑了,女将军途中与敌军(有骑兵步兵)交战(这边需要很多的细节提示词),斩杀多个敌军。女将军跑进冰河,敌军停在了河岸,不敢下去,似乎担心什么。女将军在冰面快速奔袭,突然刮起了风暴。参考提示词:后面我的提示词
-视频生成(截取上个视频尾帧 作为参考)
画面一:紧接 {{Mixed 5}} 剧情,采用广角全景,在女将军的正前方,漫山遍野的敌军列阵在暴雪中若隐若现,千军万马的肃杀之气与极寒的风雪融为一体。画面切换为女将军近景画面,女将军的目光猛然向右侧撇去。镜头切换分镜,远处一条极其宽广、一眼望不到尽头的巨大冰河横亘在暴雪肆虐的荒原之上。鹅毛大雪如乱絮般狂舞,远处的雪山连绵起伏,裸露出的冰面呈现出深邃幽暗的青蓝色。 画面二:女将军猛勒缰绳,战马发出一声凄厉的长嘶,在厚重的雪地中强行完成了一个极度惊险的漂移转向,朝着那片死寂的宽广冰河疯狂疾驰而去。 画面三:敌阵之中,镜头瞬间切入长焦镜头特写(Telephoto lens close-up),敌军首领发出一声震耳欲聋的怒吼(视觉表现为他呼出的大口浓重白色哈气在极寒空气中瞬间凝结),他猛然举起手中那把带着深深血槽的重型弯刀,刀身在黯淡的雪光下闪烁着寒芒,刀尖直指在风雪中向冰河逃窜的女将军,下达了死命令:给我拿下她,别让她跑了。。 随着首领的咆哮,画面切回中远景。一队装骑兵与步兵,踏着深达膝盖的积雪,从侧翼阵型中悍然杀出,斜向拦截女将军的去路。几百匹战马同时奔腾 画面四:镜头切入极具临场感、剧烈晃动的跟拍加环绕运镜等多种分镜切换,女将军借着马速,右臂肌肉暴起,手中长枪猛然而出,锋利的枪尖瞬间贯穿了第一名蒙面步兵举起的木制圆盾,毫不停滞地刺透了他的胸甲。女将军借着战马向前的恐怖惯性,手腕极速翻转,长枪横向猛然一撕!步兵的身体犹如破布袋般被挑飞出去。紧接着,左侧一名敌军骑兵挥舞弯刀,借着马速向她当头劈来。女将军展现出了惊为天人的马术与腰腹核心力量。她双脚死死踩住马镫,上半身瞬间向后仰倒,几乎与马背完全平行(经典的武术“铁板桥”闪避动作)。敌人的弯刀擦着她的鼻尖和飞舞的雪花劈空。在两马交错的绝对瞬间,女将军腰部如弹簧般暴起,重新坐直身体,双手反握长枪,借着腰力向后方极其狠辣地一记回马枪(Backwards spear thrust)。枪尖精准无误地刺入那名交错而过的敌军骑兵的后心,将其直接从马背上捅飞,重重砸进深厚的雪堆里。短短8秒,战马未损分毫,女将军在马上长枪如龙,硬生生在狂风暴雪中杀出一条血路,呈现出极度硬核、拳拳到肉的史诗级马战质感。 画面五:低角度跟拍杀穿重围的黑马发出一声高亢的嘶鸣,四蹄猛然跨出了厚重的雪地,踏上了那片宽广的冰河。 镜头立刻拉高,采用无人机视角的广角俯拍(High-angle Drone shot),女将军在冰面单枪匹马快速的奔袭。数百名穷凶极恶的追兵齐刷刷地在冰河边缘的雪地岸边死死勒住了战马。敌军隔着漫天大雪,死死盯着那片广袤、散发着幽蓝光泽的脆弱冰面,面面相觑,没有任何一个人敢向前再迈出半步。
完成第一遍生成以后,有能用的关键帧截取下来,作为第二遍生成的参考物料。
然后第一遍已经可用的画面,可以把画面描述的提示词去掉(节省积分),再点击生成
相同的方法生成2-3次左右,几个画面的视频 就生成好了。
-智能拆分分镜+剪辑拼接

使用剪映的智能分割镜头,然后结合视频的节奏每个运镜的衔接完成视频的组合拼接,部分镜头之间可以加一下转场。
备注:前面两种方法相结合,基本能生成大部分场景的15秒以上视频了,制作一般的短片/短剧也基本够用了。
方法三:故事板法
原理:利用一张30秒的完整故事板 把整个视频的画面内容,风格 给全部固定。然后 分两次 生成 前后 两段15秒,再拼接在一起就行了。
具体实操:生成一张30秒的故事板图片——先生成前15秒的视频内容——截取关键帧,再生成后15秒的视频——前后两段视频拼接-故事板图片 AI
提示词生成:(给Gemini或者)
我要生成一个日式校园风格的粉色罐装气泡水广告的故事板的提示词,只给我返回纯文字的提示词,参考下面的画面提示词:后面我的提示词
-故事板图片生成(GPT-image 2)

整体构图与布局: 生成一张极致精细、充满日式电影美学与叙事感的专业商业广告分镜脚本(Storyboard)。画面比例为 16:9,背景采用带有轻微胶片颗粒感的暖灰色粗糙纸纹理。顶部横幅包含项目标题“樱之信笺 | SAKURA POP 气泡水”以及 30 秒时长、16:9 比例、全色彩、和“Shunji Iwai Style × Cinematic Nostalgia × Pure Sound × Narrative”的风格标签。 分镜网格系统: 画面中心区域由两排、共八个独立的分镜模块组成(Scene 01-08)。每个模块包含:顶部的场景编号及精确到 0.1 秒的时间轴(如 0.0-4.0s);中间两个并列的画面帧(Start Frame 和 End Frame),展示动态瞬间;下方是带有箭头的相机运动描述(镜头语言),详细标注“固定长镜头 (Static)”、“缓慢推轨 (Dolly-in)”、“焦点转换 (Rack Focus)”以及“手持跟随 (Handheld Tracking)”等术语。 视觉叙事内容: Scene 01 (0.0-4.0s) [夏日空镜]: 镜头一展示午后空荡荡的教室,白色的窗帘被微风高高吹起,窗外光线产生轻微的过曝效果(Halation)。镜头二缓慢推向靠窗的一张旧木课桌,空气中悬浮着清晰可见的光尘。 Scene 02 (4.0-8.0s) [无声试探]: 镜头一采用手持微晃跟拍,一名短发少女(身穿宽松夏季水手服)轻手轻脚地走到那张空课桌前。镜头二转为特写,少女小心翼翼地将一罐粉色的 SAKURA POP 气泡水放在桌角,罐身表面布满冷凝水珠。 Scene 03 (8.0-11.5s) [欲言又止]: 镜头一展示少女在易拉罐底部压了一张折叠整齐的白纸(信笺),手指微微停顿。镜头二中,走廊传来脚步声,少女受惊般转头,逆光下看不清表情,只有飞舞的发丝。 Scene 04 (11.5-15.0s) [光影交错]: 镜头一展示教室推拉门被拉开,一个少年的模糊剪影出现在门口。镜头二采用焦点转换 (Rack Focus),焦点从远处的少年迅速转移到近处课桌上的粉色气泡水上,阳光正好打在樱花暗纹上。 Scene 05 (15.0-19.0s) [凝结的微凉]: 镜头一极近特写少年的手拿起那罐气泡水,一滴冷凝水顺着指尖滑落,浸湿了桌面。镜头二展示压在罐子底部的白纸(信笺)暴露在空气中,边缘被微风吹得微微翘起。 Scene 06 (19.0-23.0s) [心跳的回声]: 镜头一特写少年修长的手指扣住拉环拉开,微细的粉色水雾在逆光下喷薄而出。镜头二采用匹配剪辑 (Match Cut),瞬间切至躲在走廊转角墙后的少女,她靠着墙闭上眼睛,仿佛在聆听那声清脆的开罐声。 Scene 07 (23.0-27.0s) [未知的结局]: 镜头一采用低角度仰拍,少年仰头喝下气泡水,喉结滚动,眼神望向窗外飘落的一片樱花。镜头二缓慢平移 (Pan),那张未被打开的折叠白纸依然静静躺在桌面上,留有水渍的印记。 Scene 08 (27.0-30.0s) [青春留白]: 镜头一画面切回走廊,少女已经离开,只剩空荡荡的走廊和摇曳的光影。镜头二画面渐隐至纯白,中心浮现纤细秀气的日系字体“SAKURA POP”,下方用极小的字号写着“未曾说出口的夏天”,无常规商业按钮,呈现极致的电影感留白。 底层设计规范(电影级定制): 画面底部三分之一区域为详细的品牌手册规范。 色板(Key Color): 包含五个色块:褪色樱粉 (#E8D3D8)、胶片青蓝 (#8FA8B4)、过曝亮白 (#F7F9FA)、树影暗绿 (#4A5D54)、暖灰木色 (#C1B6A9),均附带代码。强调低对比度、低饱和度。 排版(Typography): 标注所有文字使用“筑紫明朝体”或相似的传统日系衬线体,字重极细,字间距极其宽阔(+15%),呈现易碎感与诗意。 音频(Music & SE): 标注“纯环境音与拟音(绝对无背景音乐/No BGM)”。声效包含:风吹动窗帘的摩擦声、远处的微弱蝉鸣、少女轻微的呼吸声、教室拉门沉闷的滑动声、清脆干瘪的开罐声(喀哒-嗤)、细腻的气泡破裂声、远处的放学钟声。要求声音设计具有极强的空间感和 ASMR 般的白噪音质感。 技术规格: 包含 24fps、1920×1080 交付标准及 Fujifilm 电影模拟色彩LUT(如 Classic Negative 或 Eterna)复选框。 风格要求: 整体呈现出极具透明感和忧郁气质的日式青春电影风格。采用“Natural Light & Soft Focus”自然光与柔焦镜头,画面色彩偏冷青调,高光处带有温暖的过曝柔化边缘。通过物理互动和视线引导构建微小的剧情冲突,所有文字必须使用中文,排版遵循极致的留白美学,放弃强烈的商业压迫感,转而追求情绪价值与电影艺术性。
-第一段视频生成(故事板作参考)
视频提示词:(不要生成BGM,否则后续前后两段不好拼接) 基础设定:基于这张分镜故事板的信息,生成一段充满日式电影美学与叙事感的 粉色罐装气泡水专业商业广告。仅生成0-15秒的画面内容 风格设定: 视觉基调: 现代日式青春电影美学,模拟 120 中画幅胶片(Medium Format Film) 的通透空气感,或数字电影机加装 柔光滤镜(Black Pro-Mist) 的纯净质感。画面干净,颗粒感极弱。 光影色调:高调逆光(High-key Backlight) 与漫反射环境光。高光轻微溢出(Bloom/Halation),呈现柔和的樱花粉与阳光白;暗部保留通透的冷青色(Cyan-blue)。整体呈现低对比度、低饱和度的日系治愈调色。 不要生成背景音乐,仅生成音效。 画面内容: Scene 01 (0.0-4.0s) [夏日空镜]: 镜头一展示午后空荡荡的教室,白色的窗帘被微风高高吹起,窗外光线产生轻微的过曝效果(Halation)。镜头二缓慢推向靠窗的一张旧木课桌,空气中悬浮着清晰可见的光尘。 Scene 02 (4.0-8.0s) [无声试探]: 镜头一采用手持微晃跟拍,一名短发少女(身穿宽松夏季水手服)轻手轻脚地走到那张空课桌前。镜头二转为特写,少女小心翼翼地将一罐粉色的 SAKURA POP 气泡水放在桌角,罐身表面布满冷凝水珠。 Scene 03 (8.0-11.5s) [欲言又止]: 镜头一展示少女在易拉罐底部压了一张折叠整齐的白纸(信笺),手指微微停顿。镜头二中,走廊传来脚步声,少女受惊般转头,快速离开画面,逆光下看不清表情,只有飞舞的发丝。 Scene 04 (11.5-15.0s) [光影交错]: 镜头一展示教室推拉门被少年拉开,一个少年的模糊剪影出现在门口。镜头二采用焦点转换 (Rack Focus),焦点从远处的少年迅速转移到近处课桌上的粉色气泡水上,阳光正好打在樱花暗纹上
-第二段视频生成(第一个视频的截图+故事板作参考)



最后,将两段视频完成拼接,一个30秒的视频就完成了。个别镜头不满意,不要全部生成。用下面这段提示词和故事板以及截图作参考(节省大量积分)
以上就是生成15秒以上视频的三个方法。