商业模式

【电商美妆】这不是真人!AI生成的UGC视频已经进化到这个地步了?

5个月前 AI UGC种草视频生成 作者:西瓜
电商
种草
美妆
护肤
UGC
如果不说,你能看出这是全AI生成的吗?利用‘首尾帧接龙’工作流,我解决了AI长视频人物脸崩的难题,实现了这段丝滑的UGC一镜到底

一起来看一下成品:

那么接下来,按照我的思路和步骤,你也可以做出这样的作品,一起来实操吧~

准备工具


FlowPix https://www.flowpix.club/workflow

Nano banana pro (https://gemini.google.com/)

Veo3.1 (https://gemini.google.com/)


以上链接是gemini官方,内置了Nano banana pro和Veo3.1



第一步:构思脚本与生成“黄金首帧”


这一张图决定了整个视频的画风、人物长相和环境。


编写脚本: 确定视频的起承转合。


例如:震惊开头 -> 拿出产品 -> 展示质地 -> 涂抹上脸 -> 满意结尾。


生成首帧 (Base Image):


提示词重点: 强调 UGC style(用户生成内容风格)、phone camera(手机镜头感)、messy background(杂乱背景)、natural lighting(自然光)。


目的:越真实、越不完美,越像真人博主。


提示词(nano banana pro生成):

一张垂直构图的智能手机自拍照,呈现出真实、自然的UGC(用户生成内容)风格。特写镜头中,一位年轻法国女性表情极度震惊,双眼圆睁直视镜头,一只手紧紧捂住嘴巴表示难以置信。她穿着一件深V领的红色长袖上衣,显露出锁骨线条。背景是一个采光自然的居家环境,略显杂乱,可以看到一个半开的衣柜挂着衣服,旁边有架子、盆栽植物和一些生活杂物。光线为柔和的自然日光。图像应具有手机摄像头的真实质感,没有经过专业修饰,并且完全不包含任何TikTok的UI界面、按钮、文字叠加或底部的字幕条。

image.png




第二步:利用 Nano Banana 制作“关键帧序列”


导入首帧: 将第一步生成的图片作为参考。


设计动作链 (Action Chain):


关键帧 A(图1): 震惊捂嘴(引用首帧)。

image.png


关键帧 B(图2): 手持 SK-II 产品特写。

提示词(将图1作为原图,图生图):

一张垂直构图的智能手机自拍照,女主站立向前倾身靠近镜头,不要改变衣服,穿着白色健运动裤,微微露出肩带,桌子前的自拍的视角。表情微笑,右手拿着图2保湿水,左手指着保湿水,不要任何UI界面

image.png


关键帧 C(图3): 闭眼享受/涂抹动作。

提示词(以图2为参考图生成):

左手摸脸,身体更加靠近镜头,变换表情

image.png


关键帧 D(图4): 捂嘴。

提示词(以图3为参考图生成):

左手摸脸,身体更加靠近镜头,变换表情

image.png


关键帧 E(图5): 捂嘴。

提示词(以图4为参考图生成):

把精华放在桌子上,人物前倾靠近镜头画面,手指皮肤,展示皮肤状态,

image.png


生成序列: 使用 Nano Banana ,生成上述 B、C、D、E图。确保人物的衣服(深V红衣)、背景(衣柜、绿植)完全不变。




第三步:Veo 3.1 “首尾帧接龙”生成视频 (最关键!)


我们要生成 5 段视频片段(Clip):
分镜1:图1-图2生成

分镜2:图2-图3生成

分镜3:图3-图4生成

分镜4:图4-图5生成

分镜5:图5生成


分镜一提示词:

图1作为首帧,图2作为尾帧。女孩正在拍摄一个UGC风格的TikTok视频,自然地说着话,就像在社交媒体上和亲密朋友聊天一样。她21岁,兴奋地说着话,就像在和朋友八卦一样。略带法国的口音。肢体语言和面部表情非常丰富。她说:“After using it for a while, my skin has become significantly brighter”她说这话时,把手机放在了桌子上。视频中没有剪辑。是一个长的连续视频。她说这话时,兴奋地与镜头保持眼神交流。她使用填充词来让自己听起来更自然。

image.png



分镜二提示词:

图1作为首帧,图2作为尾帧。女孩正在拍摄一个UGC风格的TikTok视频,自然地说着话,就像在社交媒体上和亲密朋友聊天一样。她21岁,兴奋地说着话,就像在和朋友八卦一样。肢体语言和面部表情非常丰富。她说:“My skin has become delicate and bright. I'm very satisfied with my current natural look”她身体继续前倾,把左手往脸上轻拍,随后举起保湿水。视频中没有剪辑。是一个长的连续视频。她说这话时,兴奋地与镜头保持眼神交流。她使用填充词来让自己听起来更自然。

image.png



分镜三提示词:

图1作为首帧,图2作为尾帧。女孩正在拍摄一个UGC风格的TikTok视频,自然地说着话,就像在社交媒体上和亲密朋友聊天一样。她21岁,兴奋地说着话,就像在和朋友八卦一样。肢体语言和面部表情非常丰富。她说:“Use it immediately after rinsing the water. It absorbs quickly and is not sticky.”她把手中的保湿水放下,放出镜头外,然后从镜头外拿出一个精华。视频中没有剪辑。是一个长的连续视频。她说这话时,兴奋地与镜头保持眼神交流。她使用填充词来让自己听起来更自然。

image.png



分镜四提示词:

图1作为首帧,图2作为尾帧。女孩正在拍摄一个UGC风格的TikTok视频,自然地说着话,就像在社交媒体上和亲密朋友聊天一样。她21岁,兴奋地说着话,就像在和朋友八卦一样。肢体语言和面部表情非常丰富。她说:“My complexion hasn't been so dull recently. I hope the acne marks from before can gradually fade away.”她把手中的精华放在桌面上,然后贴近镜头用手指自己的脸。视频中没有剪辑。是一个长的连续视频。她说这话时,兴奋地与镜头保持眼神交流。她使用填充词来让自己听起来更自然。

image.png



分镜五提示词:

图1作为首帧。女孩正在拍摄一个UGC风格的TikTok视频,自然地说着话,就像在社交媒体上和亲密朋友聊天一样。她21岁,兴奋地说着话,就像在和朋友八卦一样。肢体语言和面部表情非常丰富。她说:“It’s been gentle on my skin. Can't wait to see more changes in a few weeks,Bye~”她把手中放下后,最后在镜头面前摆手再见。视频中没有剪辑。是一个长的连续视频。她说这话时,兴奋地与镜头保持眼神交流。她使用填充词来让自己听起来更自然。

image.png



第四步:剪辑合成“一镜到底”


导入剪映: 将生成的 片段1、片段2、片段3 、片段4 、片段5按顺序拖入轨道。


去头去尾 (微调): 虽然是首尾帧生成,但有时候AI会在最后几帧停滞。建议把两个片段的连接处,微调剪掉 1-2 帧,让动作更紧凑。


最后导出。

image.png


最后在评论区上传您的作品,一起讨论吧~


速用卡

视频生成执行卡

把这节课压缩成一张可执行卡片:看重点、照步骤、避坑,再复制模板直接开做。

一句话重点

这节课不是先追求炫技成片,而是围绕「这不是真人!AI生成的UGC视频已经进化到这个地步了?」先把主体、动作、镜头和节奏稳住。

落地顺序

按原文节奏走最稳:先吃透「准备工具」,再把「第一步:构思脚本与生成“黄金首帧”」定住,接着处理「第二步:利用 Nano Banana 制作“关键帧序列”」;最后用「第三步:Veo 3.1 “首尾帧接龙”生成视频 (最关键!)」收口。

照着做清单
  1. 先把「准备工具」里的主体和动作定死。
  2. 这一段重点看镜头和节奏,别急着炫技。
  3. 做完「第二步:利用 Nano Banana 制作“关键帧序列”」后,先查连贯性和穿帮。
  4. 先把「第三步:Veo 3.1 “首尾帧接龙”生成视频 (最关键!)」里的主体和动作定死。
最容易踩坑

不要一上来就生成最终片;先拆镜头、定主体和运动,再逐段生成,否则容易跳轴、穿帮、节奏混乱。

成品自检

检查主体是否稳定;镜头运动是否明确;前后画面是否连贯;节奏是否服务主题;是否有明显变形或穿帮。

可直接复制的万能模板
请围绕「这不是真人!AI生成的UGC视频已经进化到这个地步了?」帮我做一个可直接执行的方案。
我的目标是:【填写你的具体目标】
我的素材/产品/角色信息是:【填写已有素材和限制】

请输出:核心创意、分镜表、每个镜头的画面描述、视频生成提示词、剪辑顺序和成片自检清单。要求主体稳定、动作明确、镜头连贯。