学习模式

【AI短片】用AI做一支30秒日系预告短片,我是这样完成的

4周前 日系短片拆解 作者:西瓜
AI短片
AI视频制作
日系预告片
日系影调
AI生成视频
短片制作流程
AI角色设计
场景生成
日系青春感
夏日短片
AI电影感
这次我用AI做了一支30秒日系预告片,从风格提炼、剧本生成到人物场景合成,完整记录一次AI短片制作流程。

一起来看一下成品:

那么接下来,按照我的思路和步骤,你也可以做出这样的作品,一起来实操吧~

准备工具


工具链接(教程涉及到的模型)
Nano banan https://labs.google/fx/tools/flow/(需要科学上网)
如果不想打开各个网址进行生成,可以使用flowpix,一站式解决大部分模型。

这里我使用了一个剧本 Skill(复制到浏览器下载)(来源于Github @山音)。

https://github.com/Shanyin-ai/shanyin-screenwriting-master

此次教程的工作流

https://www.flowpix.club/bj/21400.html?token=8db4f362b05e86f86aba0db9eab8216b



第一步:确定短片的视觉风格


在正式写剧本之前,我先确定了整支短片的影像方向。

我选择参考日本摄影师濱田英明的作品,因为他的画面比较适合日系青春短片:自然光、低饱和、生活感强,人物状态也比较安静。

1.这里我让AI(大语言模型)总结一下这几张图片在风格与影调上的共性是什么

prompt:帮我总结这几张图的风格与影调的共性

2.我继续让AI分析 ,这几张图生成时有哪些不可变的条件有什么

prompt:帮我分析这几张张图的风格,告诉我这这张图生成时有哪些不可变的条件

3.让将上面俩者结合

prompt:帮我把这些上面的内容给我的内容整合在一起,分成空间与构图,光线与氛围、色彩与质感、限制与规则这四个板块

最后得到的四大板块:

空间与构图
构图偏向极简风格,大量引入天空、海面或干净的建筑作为背景,进行大面积留白,使画面显得空旷透气。视觉中心明确,多采用平视或略带仰视的客观记录视角,保持几何线条横平竖直。镜头语言上,模拟中长焦镜头配合大光圈产生的浅景深效果,使背景呈现柔和虚化,主体保持清晰,以此强化画面的空间层次与呼吸感。
光线与氛围
照明全部依赖自然光,模拟晴朗白天的充足日光。光线处理极为柔和,强调空气中的光线散射效果,制造出通透的朦胧感。常使用逆光或侧逆光,在人物边缘、发丝或物体轮廓形成柔和的泛光与高光溢出现象,削弱光影的锐利边缘,去除强烈的明暗反差。场景属性聚焦于生活化、非戏剧性的瞬间,如散步、拍照、航行等日常切片。整体氛围传达出轻松、宁静、青春与怀旧的情绪基调,具有强烈的治愈系夏日或春日感。
色彩与质感
整体呈现典型的日系小清新胶片摄影风格,带有传统彩色负片的色彩映射特征,不追求极致的现代数码锐度。画面被统一的青蓝色调主导,带有明显的冷色滤镜感。核心色板以青蓝色、白色、浅绿色为主,色彩饱和度被统一压低,呈现马卡龙或粉蜡笔般的清淡柔和感。采用高调摄影手法,画面整体亮度偏高。高光区域明亮且边缘柔化,暗部被大幅度提亮并附带青蓝或灰绿色偏,画面中几乎没有深邃的纯黑色。整体对比度偏低,明暗过渡非常平滑,赋予画面透明、轻盈的视觉质感。
限制与规则
必须保持高明度、低饱和、低对比度的视觉特征,强制画面整体亮度偏高并保留刻意且轻微的过曝区域。严禁使用浓烈的色彩冲击和深邃的绝对黑色。光源仅限纯自然光,禁止出现锐利的光影边缘和强烈的明暗反差。构图必须包含大面积留白,避免复杂拥挤的元素堆砌。拍摄题材严格限制在日常、安静的非戏剧性瞬间,必须维持治愈、宁静的整体基调。



第二步:用AI语言大模型生成30秒短片剧本


风格确定之后,我开始写剧本。

我在AI语言大模型中使用编剧方向的skill(skill在准备工具中),

将skill直接丢进大模型中,输入启用这个skill

把第一步整理出的四个板块输入进去,让它根据这个视觉风格设计一支30秒左右的日系电影短片。

随后更改为日系电影预告片

以下就是视频的剧本:



第三步:根据剧本生成场景图


剧本确定后,我先不急着生成人物,而是先生成环境。

我把剧本拆成一个个场景,比如:

海边道路;公交车站;旧书出现的房间或书桌;放着汽水的画面;车票特写;男女主可能相遇的街道。

每个场景单独生成。

我使用image2.0(生图模型)生成四宫格图。
四宫格的好处是一次可以看到四个不同版本,方便选择最合适的画面。

生成场景时,我会在提示词里加入第一步整理出的规则。

并且在前面加上你要的场景提示词(使用GPT image2.0生成):

你是一个专业的摄影师,你现在需要依据指南设计四个日系不同的海边公路公交站场景,超写实,电影感日系胶片风格,纯净画面,氛围感拉满,R3D素材,逆光,形成2x2网格,不要人物出境,不要出现字幕 空间与构图 构图偏向极简风格,大量引入天空、海面或干净的建筑作为背景,进行大面积留白,使画面显得空旷透气。视觉中心明确,多采用平视或略带仰视的客观记录视角,保持几何线条横平竖直。镜头语言上,模拟中长焦镜头配合大光圈产生的浅景深效果,使背景呈现柔和虚化,主体保持清晰,以此强化画面的空间层次与呼吸感。 光线与氛围 照明全部依赖自然光,模拟晴朗白天的充足日光。光线处理极为柔和,强调空气中的光线散射效果,制造出通透的朦胧感。常使用逆光或侧逆光,在人物边缘、发丝或物体轮廓形成柔和的泛光与高光溢出现象,削弱光影的锐利边缘,去除强烈的明暗反差。场景属性聚焦于生活化、非戏剧性的瞬间,如散步、拍照、航行等日常切片。整体氛围传达出轻松、宁静、青春与怀旧的情绪基调,具有强烈的治愈系夏日或春日感。 色彩与质感 整体呈现典型的日系小清新胶片摄影风格,带有传统彩色负片的色彩映射特征,不追求极致的现代数码锐度。画面被统一的青蓝色调主导,带有明显的冷色滤镜感。核心色板以青蓝色、白色、浅绿色为主,色彩饱和度被统一压低,呈现马卡龙或粉蜡笔般的清淡柔和感。采用高调摄影手法,画面整体亮度偏高。高光区域明亮且边缘柔化,暗部被大幅度提亮并附带青蓝或灰绿色偏,画面中几乎没有深邃的纯黑色。整体对比度偏低,明暗过渡非常平滑,赋予画面透明、轻盈的视觉质感。 限制与规则 必须保持高明度、低饱和、低对比度的视觉特征,强制画面整体亮度偏高并保留刻意且轻微的过曝区域。严禁使用浓烈的色彩冲击和深邃的绝对黑色。光源仅限纯自然光,禁止出现锐利的光影边缘和强烈的明暗反差。构图必须包含大面积留白,避免复杂拥挤的元素堆砌。拍摄题材严格限制在日常、安静的非戏剧性瞬间,必须维持治愈、宁静的整体基调。

生成后,我会从四张图里挑选一张最接近短片气质的图。

挑选标准主要看:

构图是否干净;光线是否自然;颜色是否统一;场景是否适合后面放入人物;有没有多余杂乱元素;是否符合日系青春短片的感觉。

选好后,再用nanobanan 2把想要的那一张单独提取出来,作为后续人物合成和视频生成的基础画面。

以下是我生成的多个场景图



第四步:制作男女主角


场景确定后,我开始制作男女主角。

这一步的重点是人物一致性。
如果不先做角色设定,后面每个镜头里的人物都会不一样,脸型、发型、衣服都会变化。

我先找了一些网上的脸模和服装作为参考。

脸模参考

服装参考

男主和女主分别制作。

1.我会先使用nanobanan pro生成人物的脸部三视图

prompt:角色三视图, 正面, 纯侧面, 四分之三侧面, 一个美丽的20岁中国女孩, 精致的五官, 瓜子脸, 面部特写,脸上有真实的毛孔细节,以及绒毛细节。白皙皮肤, 黑色长直发,, 照片级真实感, 工作室灯光, 纯白色背景, 8K, 超高细节。

2.再生成服装的三视图

prompt:生成这一整套衣服,装饰的三视图,干净的肤色假人全身人体模特,超模的身材,白底电商风格,光影感超强,超写实。形成1x3网格。

3.服装设计图

prompt:你是一个全球知名的摄影师,现在规划这件衣服的7个角度进行拍摄。细节,材质,纹理,走线。日系电影感女主风,光影感超强。现在制作16:9的展板,排版需要有主次,灵活排版,英文,国际设计竞赛风格,高级感,白底,超写实风格

随后将这三张图片结合

prompt:图3人物穿着图2的一整套服装,服装细节参考图1,白底电商风格,正面照片,整体画面明亮。对比度较低。超写实,细节丰富,超模身材。

确定全身图后,我继续生成三类角色参考图。

1. 脸部三视图

prompt:参考图2的脸部特征,生成图1人物的近景人物肖像,需要正面,半侧面,侧面。超写实细节。

2. 半身三视图

prompt:参考图2的脸部特征,生成图1人物的人物大腿以上肖像图,需要正面,半侧面,侧面。超写实细节。

3. 全身三视图

prompt:参考图2的脸部特征,生成图1人物的人物大腿以上肖像图,需要正面,半侧面,侧面。超写实细节。

男角色也是按照这个流程制作



第五步:把人物、场景和道具合成分镜图


有了场景图和人物三视图后,我开始制作正式分镜。

我会按照剧本,一个镜头一个镜头地生成画面。

比如剧本里有一个镜头是:女主站在公交站旁,手里拿着一张旧车票,

那我生成时就会输入:

女主三视图;公交站场景图;车票素材;第一步整理出的色彩和质感规则;当前镜头的动作描述。如果镜头里需要特殊道具,我也会一起加入。

生成时,我依然使用四宫格图生成。

提取图片prompt:

单独生成【第2行第2列】的分镜图像

以下就是生成的分镜

每一张分镜图都要同时满足:人物稳定、场景正确、氛围统一。



第六步:根据分镜图生成视频


所有关键分镜确定后,我开始生成视频。

这一步我不会直接写很复杂的提示词,而是根据每个镜头单独写。

一个镜头对应一个视频提示词。

基础的prompt(其他的提示词可以在工作流里查看):

日系胶片风电影,逆光,氛围感,r3d素材,大光圈,不要生成任何bgm,但是保留音效。相机拍摄的呼吸效应。

其他的提示词可以自己依据画面进行描写



第七步:剪辑视频拼接


按照剧本将生成的视频进行拼接

搭配一些BGM,以及视频转场即可。



总结


这次AI短片的完整流程是:

先分析参考图,确定视觉规则;
再用ChatGPT生成30秒剧本;
然后根据剧本生成场景;
接着制作男女主角三视图;
再把人物、场景、道具合成分镜;
最后根据分镜生成视频。

我觉得AI短片最重要的不是一次生成,而是分步骤控制。

先控制风格,
再控制剧本,
再控制人物,
再控制场景,
最后控制镜头。

最后在评论区上传您的作品,一起讨论吧~


速用卡

角色设计执行卡

把这节课压缩成一张可执行卡片:看重点、照步骤、避坑,再复制模板直接开做。

一句话重点

这节课不是让你照着参考图抄脸,而是围绕「用AI做一支30秒日系预告短片,我是这样完成的」把原创角色脸拆成结构、比例、五官主次和妆造记忆点。

落地顺序

按原文节奏走最稳:先吃透「准备工具」,再把「第一步:确定短片的视觉风格」定住,接着处理「第二步:用AI语言大模型生成30秒短片剧本」;最后用「第三步:根据剧本生成场景图」收口。

照着做清单
  1. 先把「准备工具」里说的脸型或气质定住。
  2. 按「第一步:确定短片的视觉风格」去统一气质,不要只改表面。
  3. 做完「第二步:用AI语言大模型生成30秒短片剧本」后,先确认角色还是原创。
  4. 先把「第三步:根据剧本生成场景图」里说的脸型或气质定住。
  5. 围绕「第四步:制作男女主角」收一收五官,不要让每个部位都抢戏。
  6. 做完「第五步:把人物、场景和道具合成分镜图」后,先确认角色还是原创。
最容易踩坑

不要直接套真人脸或影视角色脸;不要把所有五官都做成强特征,否则容易撞脸、割裂、不稳定。

成品自检

检查角色是否有清晰记忆点;年龄感和气质是否一致;换妆造后脸是否稳定;是否不像任何明确真人或影视角色。

可直接复制的万能模板
请围绕「用AI做一支30秒日系预告短片,我是这样完成的」帮我做一个可直接执行的方案。
我的目标是:【填写你的具体目标】
我的素材/产品/角色信息是:【填写已有素材和限制】

请输出:角色定位、脸型方向、三庭五眼比例、五官主次、妆造记忆点、完整生图提示词。要求原创、有辨识度、避免撞脸和网红脸。