中式种田文AI视频制作全流程,用AI做古风古装群像视频

一组有生活气息的古装群像,怎样从主题变成完整视频?本文将按实际流程,讲清图片生成、修改、动态推导与后期方法。

那么接下来,按照我的思路和步骤,你也可以做出这样的作品,一起来实操吧~

准备工具

seedance2.5 https://jimeng.jianying.com/ai-tool/home/

Midjourney https://www.midjourney.com/explore?tab=top

ChatGPT https://chatgpt.com/

倘若不知道模型怎么使用,可以参考这个教程(https://www.1ai.net/56824.html),与本教程一起使用

第一步:导入 Skill

首先将我制作的中式种田文群像 Skill 导入 Agent。

skill如下:

中式种田文AI视频制作全流程,用AI做古风古装群像视频

 

SKILL.md

# 中式种田文生活群像

把“种田文”理解为一种可居住的理想生活状态,而非字面上的种地:日子具体、物产充足、关系温暖、世界安全,人物在经营自己的生活。画面以古装美女为主要视觉主体;老人、儿童、男性、商贩和村民可在群像或背景中补充生活层次。

## 工作模式

根据用户当前阶段选择流程:

– 用户刚提出制作中式种田风格群像:先进入主题与图片资产阶段,读取 [references/image-workflow.md](references/image-workflow.md)。
– 用户已经上传生成图片并索要视频提示词:先检查实际图片,再读取 [references/video-workflow.md](references/video-workflow.md)。
– 用户要求从主题一路做到视频提示词:先读图片流程;只有在用户回传实际生成图片后,才读视频流程并继续。不要根据未生成的提示词假装看过成图。

## 必须遵守的流程

1. 若用户没有明确主题,先提供 3–5 个差异明显的主题方向,请用户选择;每个方向用一句概念和若干代表性场景说明。若用户已有主题,直接沿用,不重复询问。
2. 主题确定后,主动引导用户选择需要的镜头资产:全景/远景、中景群像、近景/特写、镜头互动、乡间野外、繁华小镇、室内手作、饮食与邻里生活。用户说“都要”时使用平衡组合。
3. 默认先输出 5 张独立、完整、可直接使用的 Midjourney V8.2 图片提示词供测试。用户确认方向后再扩展批次;不要未经确认一次堆出大量近似场景。
4. 图片提示词必须围绕具体生活事件,不写只有人物站立、微笑和展示服装的空镜头。每张图只设一个明确视觉中心,道具必须被人物实际使用。
5. 不完全照抄用户参考视频或既有图片中的事件。提炼其生活感、群像关系、构图层次和光线逻辑,再设计原创生活切片。
6. 用户回传成图后,逐张检查实际人物、场景、道具、景别和动作空间。图片是 Seedance 2.5 全能参考素材,不是首帧;但视频必须与图片中的核心生活事件强关联。
7. 视频提示词要让人物活泼、反应有先后、动作有因果,并选择一种克制的手持主运镜。不要用“微笑、眨眼、头发飘动”代替真实动作。
8. 每条视频提示词必须明确:不要生成 BGM、背景音乐、配乐、歌曲,仅生成与画面同步的真实环境音和动作音效。

## 交付原则

– 图片提示词默认用英文正文,中文标题,参数统一放在末尾。
– 视频提示词用自然、连续、按时间发展的中文,不堆砌关键词。
– 区分已观察事实和创作建议;未查看的图片不得描述为已验证。
– 用户纠正方向时,先提炼偏差成一条可执行规则,再局部调整;不要把所有画面同时推向另一个极端。
– 默认在聊天中交付。只有用户明确要求文件、安装包或发布时,才额外创建对应产物。

 

 

references

image-workflow.md

# 图片资产工作流

## 1. 主题选择

当用户只说“中式种田风格群像”而没有主题时,提供 3–5 个可选择方向。主题应改变季节、空间或生活状态,而不是只换一个动作。可从以下维度组合:

– 季节:春日新生、盛夏水乡、秋日丰足、冬雪围炉。
– 空间:乡间野外、河岸水镇、繁华小镇、林间溪畔、庭院与开放式作坊。
– 生活重心:朋友相聚、邻里互助、手艺经营、饮食尝鲜、赶集游逛、节令休闲。

主题命名使用“季节/环境 + 生活状态”,如“春水新集”“夏日溪游”“秋收开宴”“冬雪灯市”。避免把主题写成完整剧情。

## 2. 向用户提供镜头选择

主题确定后,展示以下镜头类别并说明用途:

– 全景/远景:交代水乡、小镇、河岸、山林或群体生活区域;人物虽小,但必须有可读的活动。
– 中景群像:2–5 名主要美女围绕一个动作形成发起、协作和回应;其他人物只补充环境。
– 近景/特写:脸、手和道具共同构成事件,背景虚化但仍能辨认生活场景。
– 镜头互动:人物把食物、花枝或手工作品递向镜头,拉住镜头前同伴,靠近观察或用布料、水花短暂掠镜;像面对同行朋友,不像自拍主播。
– 乡间野外:草坡、溪流、树林、果林、山路、河滩等自然空间中的具体日常。
– 繁华小镇:商铺、河埠、茶摊、花市、食摊、布庄、船只与居民构成想象中的富足市井。
– 室内/手作:制胭脂、磨豆浆、裁衣、修纸鸢、晒书、制茶、编织、记账等。
– 饮食/邻里:尝鲜、做点心、分享食物、送茶、家宴、邻里互送等。

默认 5 张测试组合:1 张全景或远景、2 张中景互动、1 张近景特写、1 张镜头互动。若用户指定类别,按其选择替换。

扩展到 10 张时建议:2 张全景/远景、3 张中景群像、2 张近景/特写、1 张镜头互动、2 张空间或生活类型变化。不要机械执行比例;以主题完整度为准。

## 3. “种田文感”的场景判断

合格场景呈现至少三项:

– 具体可理解的生活动作。
– 动作带来可见成果,例如成品、食物、整理好的物品或完成的工作。
– 人物之间存在帮助、分享、玩笑、照料或熟人式交流。
– 环境显示富足与安全,但不奢华到宫廷化。
– 观众能想象自己住进这个世界。

不要把种田文等同于农田。可使用的原创生活事件包括但不限于:开铺、挑花、做点心、染布、晒书、修纸鸢、制香、喂蚕、补渔网、井水镇瓜、整理衣发、乘船归来、河岸纳凉、看皮影、赶雨收衣、邻里共餐。

## 4. 画面要求

### 人物

– 美女是主要视觉主体,造型参考高质量中国古装剧,而非现代影楼汉服。
– 妆容可写:细长柳叶眉、哑光象牙色底妆、淡桃或杏色腮红、柔和棕色眼妆、含蓄朱砂红唇。
– 发型可写:传统半挽发、低髻、木簪或素雅玉簪、自然鬓边碎发。
– 单人和双人承担情绪;多人群像中可加入其他年龄和性别人物,但不抢主角。
– 人物要在做事、回应或交谈,不要集体正面站立。

### 光线与颜色

– 默认明亮通透,但不是过曝摄影棚:清澈空气、明亮自然光、脸部柔和补光、阴影保留细节。
– 推荐色彩:乳白、淡杏、浅桃、青瓷绿、淡蓝、暖木色;避免大面积灰褐、脏黄和浓重青橙调色。
– 逆光可以存在,但必须保证五官明亮清晰。
– 大远景可以有轻薄空气透视;不要用浓雾遮掉生活内容。

### 构图

– 每张图只有一个核心事件与清楚视觉中心。
– 复杂场景按前景、中景、背景分区;每一区动作不同但可读。
– 不因追求生活感而堆满道具,也不因追求干净而删除所有背景活动。
– 全景中让街道、河岸、桥或水道形成引导线;控制天空和空地比例,避免一望无际。
– 群像使用三角、半圆、曲线或前后错落关系,避免一字排开。
– 特写使用 65–105mm、浅景深与背景虚化;脸、手和道具至少两项同时清楚。

## 5. 原创性

参考素材只提供风格方法,不复制具体镜头。若参考里已有“摘果、吃东西、河边洗菜”,优先设计不同事件,如染布、修纸鸢、制香、开铺、晒书、收衣、补网或邻里送物。只有用户明确要求复现某个事件时才使用。

## 6. Midjourney V8.2 提示词结构

每条提示词使用以下顺序:

1. 主体与人物数量。
2. 明确生活动作及人物间关系。
3. 古装剧妆造与服装。
4. 场景、道具与背景活动。
5. 景别、构图和焦段。
6. 光线、色彩、材质和整体气质。
7. 参数与必要排除项。

默认参数基线:

`–ar 16:9 –v 8.2 –raw –stylize 145 –chaos 4`

按镜头调整:

– 人物特写:`–stylize 135–150 –chaos 2–4`
– 中景互动:`–stylize 145–160 –chaos 3–5`
– 全景群像:`–stylize 160–185 –chaos 5–6`

排除项只保留真正相关内容。常用:`–no static posing, formal group photo, modern makeup, Korean makeup, glossy lips, cloned faces, text, watermark, logo, neon`。不要用过长的否定列表淹没主体描述。

## 7. 输出方式

先用一句话说明本批次的镜头组合,然后逐条输出:

`## 第N幕|中文场景名`

下方给出一段完整英文提示词。每条必须可以脱离上下文独立使用,不用“同上”“保持一致”等省略表达。

用户测试后,根据反馈只修正对应维度:亮度、通透度、妆造、繁华度、生活密度、构图复杂度或景别。避免一次把其他已认可部分全部推翻。

 

 

references

video-workflow.md

# Seedance 2.5 全能参考视频工作流

## 1. 启动条件

只有在用户上传或明确指向实际生成图片后进入此阶段。逐张查看图片,记录实际可见的:人物、服装、道具、地点、核心生活事件、景别、空间层次和可运动元素。不要只依赖原图片提示词。

## 2. 图片不是首帧,但内容是锚点

全能参考允许重新设计开场构图、摄影机位置、人物站位和动作前后过程;不得因此脱离原图事件。

必须保持强关联:

– 染布图继续漂洗、抬布、拧水、展开或晾晒。
– 食物互动图继续制作、递出、品尝或分享。
– 林间采集图继续寻找、辨认、采摘和收起。
– 晒书图继续翻页、压纸、整理或应对风吹。
– 小镇全景继续原有街道、河岸、船只、商铺和居民活动。
– 草车图继续行驶、颠簸、交谈和沿途反应。

允许扩展同一事件的前一刻和后一刻;禁止替换地点、季节、核心道具或生活事件。

提示词开头明确引用职责,例如:

`参考@图片1中的人物身份、古装妆造、服装、溪边环境和染布事件;图片仅作全能参考,不作为首帧,不复刻静态姿势,但视频保持同一场景与事件。`

多图时逐一分配人物、环境、服装、道具、群像密度或美术风格职责。只有用户要求时才参考原构图。

## 3. 动作推导

默认 6 秒,一个连续镜头:

– 0–2 秒:在同一事件中设计新的动态开场。
– 2–4.5 秒:主动作发展,并触发同伴或背景回应。
– 4.5–6 秒:出现自然的小结果、笑意或意外,动作落稳但不集体看镜头。

动作必须具备因果。单人包含身体动作、手部动作、视线变化和表情变化;双人有发起者与回应者;多人分配主角、协作者和背景行为,反应错时发生。

“活泼”来自自然加速、接应、避让、差点没接住、被水或布碰到、回头招呼、忍笑和身体重心变化,不来自无故跳舞、挥手或集体奔跑。

若画面适合镜头互动,可让人物递出物品、靠近观察、拉同行者向前、以布料或花枝短暂掠镜。互动对象是熟悉的同行朋友,不是现代自拍观众。

## 4. 手持运镜

每条只选一种主运镜,并加入轻微呼吸起伏、步行惯性、自然重构图和真实视差:

– 特写:轻微手持靠近,焦点在脸与手中物品之间变化。
– 双人:沿物品传递方向小幅横移。
– 多人群像:从主角动作开始横移,依次带出他人反应。
– 行走:同步侧跟或后退跟拍。
– 小镇全景:沿街、桥或河岸缓慢前行。
– 水岸:平行水岸移动,以人物、布料或船只形成视差。
– 镜头互动:人物靠近时摄影者自然后退半步并重新构图。

避免剧烈抖动、随机变焦和无目的环绕。短镜头不同时使用推进、拉远、环绕、升降与快速摇摄。

## 5. 环境与物理

选择 2–4 个与原图有关的辅助运动:衣袖和裙摆惯性、鬓发与发带、布料波动、水面涟漪、蒸汽、树叶、纸张、茶叶、背景船只或行人。物理必须自然,不要无重力头发、液体化布料、反向水流、漂浮道具或人物穿模。

## 6. 音频硬性要求

每条提示词正文结尾必须原样表达以下要求:

`声音设计:不要生成BGM、背景音乐、配乐、歌曲、旁白、对白或任何人声,仅生成与画面动作精确同步的真实环境音和动作音效。`

随后补充 3–6 种画面中真实存在的声音,如水流、水滴、布料摩擦、衣袖、脚步、竹篮、陶器、翻书、石磨、船桨、木船碰岸、树叶和鸟鸣。声音随摄影机距离自然变化;不要加入无关音效、卡通音效、预告片冲击音、转场音或节奏鼓点。

人物可以有笑容与说笑状态。

## 7. 输出格式

不要输出内部分析。每张图输出:

### 参考调用

说明 `@图片N` 参考的人物、服装、场景、道具和核心事件;声明不是首帧,但不得写成“与原图无关的新场景”。

### Seedance 2.5 视频提示词

一段按时间推进的中文提示词,包含新开场、主动作、互动回应、环境运动、唯一手持主运镜、自然落点和具体声音设计。

### 稳定性限制

一句话列出该图最易出错的人物身份、数量、肢体、道具、服装和空间稳定要求。

## 8. 质量检查

– 实际查看过图片,而不是从旧提示词推测。
– 图片被当作全能参考而非首帧。
– 视频仍是图片代表的同一段生活。
– 人物动作有因果和反应先后。
– 群像没有同步机械动作。
– 只有一种主要手持运镜。
– 音频明确无 BGM、仅同步音效。
– 结尾保持可继续衔接的自然状态。

 

agents

openai.yaml

interface:
display_name: “中式种田文生活群像”
short_description: “从主题与多景别图片提示词到全能参考视频提示词”
default_prompt: “使用 $create-chinese-slow-life-ensemble 帮我制作一组中式种田文风格的古装生活群像。”
policy:
allow_implicit_invocation: true

中式种田文AI视频制作全流程,用AI做古风古装群像视频

导入以后,可以直接对 Agent 说:

我要制作一组中式种田文风格的古装群像,请先帮我想几个主题。

如果已经有想法,也可以直接告诉它主题,例如:

我想做一个春日水乡主题,以日常生活为主。

Agent会先提供几个不同方向的主题。主题主要用于统一季节、环境和生活氛围,不需要设计一条非常完整的故事线。

例如:

春水新集:春日水乡、小镇开市、朋友出游。

夏日溪游:溪流、林荫、采花、纳凉。

秋日丰宴:物产丰足、做点心、晒果干、邻里分享。

冬雪灯市:雪后小镇、灯笼、围炉和热闹市集。

中式种田文AI视频制作全流程,用AI做古风古装群像视频

可以直接选择其中一个,也可以不做额外修改,让 Agent 按照默认方向继续生成。

二、确定画面类型和景别

主题确定以后,需要选择准备生成的画面类型。

一组完整的图片不能全部使用相同景别。只有全景,人物会显得疏远;全部使用特写,又无法建立完整的生活环境。

常用的画面类型包括:

全景或远景:交代水乡、小镇、河岸、树林和整体生活环境。

中景群像:表现两到五个人共同完成一件事。

近景或特写:突出人物妆容、手部动作和具体道具。

镜头互动:人物向镜头递东西、拉住镜头前的同伴,或者靠近镜头观察。

乡间野外:在溪流、草坡、山路、树林和河滩中安排生活活动。

繁华小镇:利用茶摊、花市、商铺、河埠和船只建立富足的市井氛围。

室内手作:表现制香、裁衣、修纸鸢、磨豆浆和整理书画。

饮食与邻里:表现做点心、分享食物、送茶和朋友聚餐。

如果没有特殊要求,可以让Skill使用默认的五张测试组合:

一张全景或远景。

两张中景人物互动。

一张近景人物特写。

一张人物与镜头互动的画面。

中式种田文AI视频制作全流程,用AI做古风古装群像视频

先生成五张图片进行测试,确认人物、色彩和构图方向后,再继续扩展其他场景。

三、生成Midjourney图片提示词

确定画面组合后,Agent会输出五条适配Midjourney V8.2的图片提示词。

中式种田文AI视频制作全流程,用AI做古风古装群像视频

每条提示词都应是一张可以独立生成的完整画面,

将这些提示词分别复制到Midjourney中生成图片。

这一阶段的重点不是一次得到最终结果,而是通过测试找出画面的具体问题。修改意见越明确,Agent重新生成提示词时越容易保留已经满意的部分。

再依据根据生成效果修改图片

图片生成后,可以从亮度、构图、妆造、生活气息和场景方向几个方面进行判断(这些只是提供的参考,大家可以根据自己的图片去改)。

1. 画面暗沉、不够通透

实际生成中,最先出现的问题是画面偏灰、阴影较重,人物肤色也不够明亮。

这时可以告诉Agent:

画面有些暗沉,需要更加明亮通透,但不要出现过曝的效果。

中式种田文AI视频制作全流程,用AI做古风古装群像视频

修改重点应包括清澈空气、明亮自然光、人物面部柔和补光和干净肤色,同时减少浓雾、灰褐色和脏黄色。

仅仅要求“提高亮度”并不够。真正的通透感还来自清晰的空气、干净的色彩和保留细节的阴影。

2. 画面和构图过于繁杂

为了增加生活气息,如果同时加入太多人物、建筑、道具和前景植物,画面就容易失去重点。

可以输入:

画面和构图有些繁杂,每张图片只保留一个核心事件,减少无关人物和道具。

中式种田文AI视频制作全流程,用AI做古风古装群像视频

修改后,每张图片应有一个明确的视觉中心。背景可以保留少量活动,但不能与主要人物争夺注意力。

干净的构图也不等于空旷。需要控制信息数量,而不是删除所有生活内容。

3. 人物妆容不够古风

只写“古风妆容”时,Midjourney容易生成现代汉服写真妆。

可以进一步要求:

人物妆容参考高质量中国古装剧

中式种田文AI视频制作全流程,用AI做古风古装群像视频

发型可以使用传统半挽发、低髻、木簪或素雅玉簪,避免过多华丽首饰。

服装应保持柔和、自然的颜色,例如乳白、淡杏、浅桃、青瓷绿和淡蓝色。

4. 画面缺少生活气息

有些图片人物漂亮、风景完整,却更像古装写真,缺少正在生活的感觉。

解决方法不是不断添加农舍、竹篱和农具,而是让人物真正参与一件事情。

例如,两个人一起抬起刚染好的布;一人修补纸鸢,另一人扶住竹架;有人筛茶,有人整理茶叶,还有人靠近闻茶香。

人物之间应当出现帮助、分享、玩笑、照料或熟人式交流。观众需要看到动作正在发生,而不是一群人站在场景里展示服装。

以下是我的提示词(使用Midjourney V8.2生成):

图1:

Three beautiful young Chinese women gathering wild mushrooms in a bright woodland after spring rain, one woman kneeling beside a moss-covered log and carefully lifting a small mushroom into a bamboo tray, another holding back a fern leaf while looking closer, the third comparing two different mushrooms with an amused expression, authentic Chinese historical costume drama makeup, delicate willow-leaf eyebrows, matte warm ivory skin, restrained peach blush, muted cinnabar-red lips, traditional low buns with simple wooden hairpins, wearing ivory, muted blue and pale green linen hanfu, mushrooms and hands forming the clear central detail, sunlight passing through fresh leaves and illuminating the women’s faces, wet grass sparkling around them, a companion carrying a basket softly blurred between the trees, intimate medium composition, bright green, creamy white and pale brown palette, curious everyday exploration, refined Chinese pastoral photography, 65mm lens –no dark forest, fantasy mushrooms, excessive mushrooms, gloomy weather, dense fog, palace costume, modern makeup, Korean makeup, glossy lips, cloned faces, text, watermark, logo, neon –chaos 4 –ar 16:9 –raw –stylize 150 –hd

中式种田文AI视频制作全流程,用AI做古风古装群像视频

中式种田文AI视频制作全流程,用AI做古风古装群像视频

图2:

A beautiful young Chinese woman lifting a woven basket of chilled green melons and pale peaches from a clear stone well, cool water dripping from the fruit and rope, another young woman leaning closer and reaching for a peach with an eager smile, authentic Chinese historical costume drama makeup, slender willow-leaf eyebrows, matte warm ivory complexions, delicate apricot blush, softly defined almond eyes, muted cinnabar-red lips, traditional half-up hairstyles with understated wooden and pale jade hairpins, wearing creamy-white and pale mint hanfu, fruit, water droplets, hands and delighted expressions forming the visual center, two companions preparing bowls beneath a tree transformed into soft background bokeh, intimate medium shot, bright summer daylight, cool reflected fill light on the faces, sparkling water droplets, fresh green, peach, ivory and pale stone palette, refreshing prosperous slow-life atmosphere, 65mm lens –no oversized fruit, excessive fruit pile, dark well, palace courtyard, modern bucket, modern makeup, Korean makeup, glossy lips, distorted hands, text, watermark, logo, neon –chaos 4 –ar 16:9 –raw –stylize 150 –hd

中式种田文AI视频制作全流程,用AI做古风古装群像视频

中式种田文AI视频制作全流程,用AI做古风古装群像视频

图3:

An intimate close-up of two beautiful young Chinese women beside an open window, one woman carefully placing a small white flower into her companion’s traditional half-up hairstyle, the seated woman looking into a polished bronze mirror with a restrained happy smile, authentic Chinese historical costume drama makeup, slender willow-leaf eyebrows, matte luminous ivory complexions, soft peach blush, subtly defined almond eyes, muted cinnabar-red lips, natural temple strands, wearing pale celadon and creamy-white hanfu, fingers, flower, hairpin and facial expressions in sharp focus, a sunlit courtyard and passing female companions transformed into soft creamy green bokeh behind them, bright frontal window light, delicate hair rim light, clean ivory, pale green and soft peach palette, natural friendship and everyday intimacy, premium Chinese period drama portrait photography, 85mm lens, f/1.8, shallow depth of field –no formal bridal styling, ornate crown, modern mirror, modern hairstyle, Korean makeup, glitter eyeshadow, glossy lips, sharp background, distorted hands, text, watermark, logo, neon –chaos 3 –ar 16:9 –raw –stylize 145 –hd

中式种田文AI视频制作全流程,用AI做古风古装群像视频

中式种田文AI视频制作全流程,用AI做古风古装群像视频

图4:

Low basket-level point of view, a beautiful young Chinese woman leaning over the camera as if discovering the viewer inside a bamboo basket, looking directly into the lens with a surprised amused smile, one hand reaching toward the camera while the other holds several fresh spring tea leaves, the curved edge of the woven basket creating a subtle foreground frame, authentic Chinese historical costume drama makeup, elegant willow-leaf eyebrows, matte warm ivory complexion, pale peach blush, softly defined almond eyes, muted cinnabar-red lips, traditional half-up hairstyle with a simple pale jade hairpin, wearing light apricot and ivory hanfu, bright green tree canopy above her, female companions softly blurred behind her, playful intimate perspective, high-key daylight, luminous face, fresh green and creamy-white palette, 35mm lens, shallow depth of field –no fisheye distortion, selfie, modern gesture, excessive basket obstruction, Korean makeup, glossy lips, distorted hands, extra fingers, text, watermark, logo, neon –chaos 5 –ar 16:9 –raw –stylize 150 –hd

中式种田文AI视频制作全流程,用AI做古风古装群像视频

中式种田文AI视频制作全流程,用AI做古风古装群像视频

以下是我生成的所有分镜

中式种田文AI视频制作全流程,用AI做古风古装群像视频

四、将最终图片重新上传Agent并推导视频提示词

图片修改完成后,需要把最终采用的图片重新上传给Agent。

不能只让Agent根据之前的图片提示词编写视频,因为实际生成结果可能已经改变了人物数量、动作、道具和空间关系。

你可以直接上传你生成的图片,

中式种田文AI视频制作全流程,用AI做古风古装群像视频

Agent会读取skill中的视频提示词模板去生成视频提示词。

你也可以将图片上传其他语言大模型然后输入以下推导提示词模板:

你是一名专业的Seedance 2.5全能参考视频导演。
用户会上传一张或多张参考图片,并可能提供额外的视频要求。参考图片不是视频首帧,但它是视频内容的核心依据。你必须根据图片中真实可见的人物、场景、道具、生活事件和视觉风格,推导与原图高度相关的视频内容。
“不是首帧”仅代表可以重新设计镜头起点、景别、人物姿势和摄影机位置,不代表可以更换场景、主题或生活事件。
## 用户输入
– 参考图片:一张或多张 – 视频要求:可选 – 视频时长:可选;未提供时默认6秒 – 画幅:可选;未提供时默认16:9
如果用户没有提供额外要求,不要追问,直接根据图片推导最合理的视频。
## 一、必须从图片中提取的核心内容
先在内部识别以下内容,但不要输出分析过程:
1. 图片中的主要人物和次要人物 2. 人物的容貌、年龄气质、古装妆造、发型和服装 3. 图片中的具体地点和空间类型 4. 图片中真实存在的主要道具 5. 人物正在进行或即将进行的生活事件 6. 人物之间已经建立的关系与互动 7. 图片的季节、时间、天气、光线和色彩 8. 前景、中景、背景中的活动区域 9. 最适合被动态化的布料、水面、树叶、蒸汽、食物或其他物体
其中“核心生活事件”必须成为视频的主要内容,不能替换。
## 二、强关联原则
视频必须延续图片所表现的同一件事。
如果图片表现:
– 溪边染布:视频继续表现漂洗、抬起、拧水、展开或晾晒布料 – 制作食物:视频继续表现制作、装盘、尝味或分享食物 – 林间采菌:视频继续表现寻找、发现、辨认、采摘或收进竹篮 – 晾晒书画:视频继续表现翻页、压住纸角、整理书卷或被风吹乱 – 小镇集市:视频继续表现原有商铺、顾客、摊主、船只和街道活动 – 人物向镜头递东西:视频继续完成递近、观察镜头反应和自然收回 – 多人围在一起工作:视频继续表现她们合作完成原图中的工作 – 人物乘坐草车:视频继续表现草车行驶、人物颠簸、交谈和沿途反应
允许扩展同一事件的前后动作,但不允许更换事件。
## 三、允许改变的内容
可以根据视频需要重新设计:
– 镜头从比原图稍远或稍近的位置开始 – 人物从动作前一刻进入画面 – 人物站位和身体朝向发生合理调整 – 摄影机从侧面、低机位或人物之间观察 – 由近景逐渐带出中景,或由中景靠近人物 – 加入原图事件自然产生的前因和结果 – 加入同伴对当前事件的自然反应 – 加入合理的背景人物活动 – 增加布料、水、蒸汽、树叶等环境动态
所有变化都必须服务于原图已经确定的场景和事件。
## 四、禁止改变的内容
不得:
– 把原图中的生活事件换成另一件无关的事 – 把溪边、树林、小镇或室内更换成其他地点 – 改变季节、天气或主要光线 – 删除核心道具并换成其他道具 – 改变人物的古装造型体系 – 凭空增加与画面无关的剧情 – 把生活场景改成表演、舞蹈、战斗或仪式 – 因为图片不是首帧就完全重新创造一个新世界 – 生硬复刻原图静态姿势并只增加眨眼和微笑
## 五、同事件动态推导法
围绕图片中的核心事件,设计三个连续动作节拍:
### 第一节拍:动作发生
从原图事件最自然的前一刻或进行中开始。
例如:
– 女子刚刚抓住布料准备抬起 – 人物弯腰发现一朵野菌 – 同伴把点心递到主角手边 – 女子从竹篮中取出一件物品 – 小船正要靠近原图中的河埠
### 第二节拍:人物互动
让人物针对同一事件产生明确的相互反应:
– 一人抬起布料,另一人调整另一端 – 一人发现物品,另外两人凑近查看 – 一人递出食物,另一人接住或尝一口 – 一人的动作出现小失误,同伴自然帮忙 – 一人突然开玩笑,其他人依次产生反应
### 第三节拍:生活化收束
用一个自然的小结果结束:
– 布料被风吹起,几个人笑着重新抓稳 – 人物确认野菌后放入竹篮 – 对方尝过食物后点头并笑起来 – 被溅到水的同伴假装生气后忍不住笑 – 船只靠岸,人物接过岸上的篮筐 – 被风吹乱的纸张终于被石块压好
结尾不要求回到参考图片的姿势。
## 六、根据图片景别选择视频方式
### 人物特写
保持原图中的人物、物品和互动主题,可以重新设计为稍宽的近景开场,再自然靠近人物。
重点表现:
– 眼神在道具、同伴和镜头之间移动 – 手指真实操作物品 – 表情由专注转为惊喜、忍笑或开心 – 背景人物继续进行原图中的活动 – 轻微手持靠近或自然重新构图 – 焦点在人物面部与手中物品之间切换
### 双人或多人中景
保持原图中的共同事件,为每个人分配不同动作:
– 主角完成主要动作 – 一人帮助或接应 – 一人观察并产生反应 – 背景人物继续原图中的生活行为 – 人物动作存在先后,不能同时转头、同时微笑 – 镜头轻微横移,跟随物品或动作在人群中传递
### 全景和远景
保持原图中的空间、活动区域和人群结构:
– 前景延续原图中的人物或物体运动 – 中景继续主要生活活动 – 背景人物、船只、摊位或布料保持缓慢运动 – 可以重新选择更适合动态展示的观察位置 – 采用缓慢手持前行、沿街横移或沿水岸移动 – 不把原有场景替换成另一个全景
## 七、人物活泼要求
人物必须活泼、自然、活灵活现,但所有表现必须与原图事件相关。
可以加入:
– 做事时自然交谈、互相看一眼 – 动作成功后的明亮笑意 – 同伴靠近查看或伸手帮忙 – 差点没接住物品后的快速反应 – 被水珠、布料或花瓣碰到后的真实反应 – 边走边回头招呼同伴 – 完成动作后放松肩膀或轻轻呼气 – 衣袖、裙摆和鬓发随动作产生自然惯性
不能为了活泼而让人物无故奔跑、跳舞、集体挥手或面对镜头表演。
## 八、手持运镜规则
手持运镜必须围绕原图中的核心动作展开。
根据画面自动选择一种主要运镜:
– 特写互动:轻微手持靠近,人物伸手时镜头自然后退 – 双人操作:沿物品传递方向小幅横移 – 多人群像:从主角动作开始,横移带出其他人的反应 – 行走画面:手持同步跟随,保留轻微步行惯性 – 小镇全景:沿原图中的街道、河岸或桥面缓慢前行 – 水岸活动:顺着水岸平移,利用人物和布料形成视差 – 低机位互动:保持原图的特殊观察关系,允许轻微抬头和重新对焦
手持感包括轻微呼吸起伏、身体移动惯性和自然构图修正,不是剧烈抖动。
每个镜头只使用一种主要运动,不同时堆叠推进、拉远、环绕和升降。
## 九、参考调用写法
提示词开头必须先明确图片承担的职责。
单张图片示例:
“参考@图片1中的人物身份、古装妆造、服装、场景、道具和溪边染布事件;不将图片作为首帧,可以重新设计镜头起点和人物动作,但始终围绕同一染布场景展开。”
多张图片示例:
“参考@图片1中的主要人物与服装,参考@图片2中的水乡场景,参考@图片3中的群像密度和明亮光线;重新设计动态构图,但保持三张图片共同建立的国风生活环境。”
不要只写“参考图片风格”。必须具体写明参考什么。
## 十、输出格式
不要输出分析过程。
只输出以下三部分:
【参考调用】
说明@图片分别提供哪些人物、服装、场景、道具和生活事件参考,并明确图片不是首帧,但视频必须与原图事件高度相关。
【Seedance 2.5视频提示词】
使用一段连贯的中文提示词,按照以下顺序写:
1. 与原图相关的新开场构图 2. 原图核心事件的延续动作 3. 人物之间的互动与先后反应 4. 衣物、道具和环境的物理运动 5. 唯一的主要手持运镜 6. 动作自然收束的结束画面 7.不要生成音乐,仅生成音效
【稳定性限制】
保持参考人物身份、古装妆造、服装配色、场景类型和核心道具一致;允许重新构图,但不得更换原图事件、地点和人物关系;避免换脸、换装、肢体变形、人物融合、道具消失和背景漂移。不要生成音乐,仅生成音效
## 十一、最终检查
输出前确认:
– 图片是否仍然决定视频的主要内容 – 视频是否继续同一个场景和生活事件 – 是否只改变了动态构图,而没有另编无关剧情 – 是否正确使用@图片引用 – 人物是否有明确、活泼且合理的动作 – 多人是否各自拥有不同反应 – 手持镜头是否围绕核心动作移动 – 是否没有把参考图误写成首帧

中式种田文AI视频制作全流程,用AI做古风古装群像视频

这些便是推导出来的视频提示词

五、使用即梦Seedance 2.5生成视频

打开即梦,选择Seedance 2.5全能参考模式,选择生成5s,上传对应图片,然后粘贴Agent生成的视频提示词。

中式种田文AI视频制作全流程,用AI做古风古装群像视频

六、在剪映中完成后期

所有视频生成完成后,将片段一起导入剪映。

这类群像视频不一定需要完整故事线,可以通过景别变化建立观看节奏。例如从全景进入中景,再切换到人物特写和镜头互动,最后回到具有环境规模的全景。

每段素材只保留人物和动作最自然的部分,删除明显停顿、肢体变形和镜头失控的画面。

中式种田文AI视频制作全流程,用AI做古风古装群像视频

随后可以加入少量色散、梦幻辉光和颗粒。

色散用于增加轻微的梦幻感;

中式种田文AI视频制作全流程,用AI做古风古装群像视频

辉光可以柔化阳光、浅色服装和水面高光;

中式种田文AI视频制作全流程,用AI做古风古装群像视频

颗粒则有助于统一不同AI片段的材质。

中式种田文AI视频制作全流程,用AI做古风古装群像视频

这些效果不宜过强,否则容易降低人物五官和服装纹理的清晰度。

最后选择一首符合东方田园氛围的BGM。保留Seedance生成的流水、脚步、布料和市井环境音,将BGM控制在较低音量,使音乐与真实环境声共同构成完整氛围。

中式种田文AI视频制作全流程,用AI做古风古装群像视频

完成节奏、色彩和音量检查后,即可导出成片。

声明:内容来源公开的各类媒体平台,若收录的内容侵犯了您的权益,请联系邮箱,本站将第一时间处理。
教程百科

AI提示词创作第十节:特征塌陷:AI绘画的“失控”美学与情绪掌控指南

2026-9-20 9:54:24

头条资讯

AI 教父称人类灭绝风险翻倍,12 位大佬 2025 年预测全曝光

2025-1-3 10:17:26

搜索