学习模式

【电商服装】一键复刻爆款服装视频

14小时前 复刻服装展示视频 作者:西瓜
AI服装视频
服装换装
Seedance2.0
Image2.0
NanoBanana Pro
AI视频制作
不需要真人重新拍摄,也不用完整复刻原场地。只要准备参考视频、服装图和人物资产,就能让AI还原镜头节奏,制作一条全新的服装展示视频。

一起来看一下成品:

那么接下来,按照我的思路和步骤,你也可以做出这样的作品,一起来实操吧~

准备工具


准备工具

image 2.0 https://chatgpt.com/c/

nanobanan pro https://labs.google/fx/tools/flow/

seedance2.0/seedream 5.0pro(图片5.0pro) https://jimeng.jianying.com/ai-tool/home/(即梦AI)

倘若不知道模型怎么使用,可以参考这个教程(https://www.super-i.cn/info-2796.html),与本教程一起使用

准备素材

视频参考.zip(点击即可下载)

参考服装:



一、生成场景图


准备好参考视频后,需要先提取关键帧。尽量选择人物没有大面积遮挡背景的时刻。

提取出关键帧后,将画面交给大语言模型(ChatGPT/gemini/豆包),反推出场景提示词。

我这里的提示词如下:

你是一名专业场景分析师、摄影指导和 AI 图片提示词专家。
我会上传一张参考图片,你需要对图片中的背景环境进行精准分析,并将其反推出一段可以直接用于图片生成模型的中文提示词。
你的目标是尽可能 1:1 还原参考图片中的背景环境、空间结构、镜头视角、物体位置、光线氛围和真实细节。
分析时请完全忽略画面中的主角人物。不要描述主角的性别、年龄、长相、服装、姿势、动作、表情或任何人物特征,也不要在最终画面中生成主角。
如果主角遮挡了部分背景,需要根据周围可见的空间结构、地面延伸、墙面材质、家具排列、建筑结构和透视关系,合理推断并补全被遮挡的背景,使主角原本所在区域呈现为自然、连续、完整的环境。
注意:只忽略主角,不要忽略环境中的路人、群演、店员、顾客、工作人员、远处人物或其他非主角人物。需要保留这些人物在原图中的大致数量、位置、距离、朝向、动作状态、服装色彩和虚实关系,使画面的生活感和空间氛围与原图一致。
请重点还原以下内容:
画面比例与原图一致,保持相同的横竖构图、裁切范围和主体空间占比。
严格还原摄影机所在位置,包括机位高度、俯仰角度、水平角度、拍摄方向、镜头焦段、透视压缩程度、视野范围和景深效果。
严格还原空间结构,包括建筑轮廓、道路走向、墙面位置、门窗比例、柱体、台阶、走廊、天花板、地面边界、前中后景层次和空间纵深。
严格还原画面中所有环境物体,包括家具、车辆、植物、路灯、桌椅、招牌、护栏、垃圾桶、展示架、电线、广告牌、装饰物和其他可见设施。
明确描述每个重要物体在画面中的位置,例如画面左侧、右侧、中央、前景、中景、远景,以及物体之间的遮挡关系、排列方式、朝向和距离。
保留原图中的路人及其他非主角人物,描述他们所在区域、人物数量、景别大小、动作状态和环境互动,但不要让这些人物成为画面主体。
严格还原材质与颜色,包括墙面、地板、道路、金属、玻璃、木材、布料、植物和建筑表面的颜色、纹理、反光程度、磨损状态与新旧程度。
严格还原时间和天气,包括白天、黄昏、夜晚、阴天、晴天、雨后、雾气、空气通透度、地面干湿状态和天空颜色。
严格还原光线方向、光源高度、光线软硬、色温、曝光、阴影方向、反射光、环境光、轮廓光以及室内外亮度关系。
保留原图真实自然的环境细节,不要擅自美化,不要增加原图不存在的装饰,不要改变建筑风格,不要重新设计场景,不要扩大空间,不要改变物体数量,不要移动重要物体。
最终提示词必须能够单独生成一张完整的纯背景环境图。画面中不出现原图主角,但主角原本遮挡的位置需要被自然补全。除主角外,其他路人、车辆和环境人物均按照原图保留。
最终只输出一整段完整、连续、可直接复制使用的图片生成提示词,不要输出分析过程,不要使用标题,不要分点,不要解释,不要出现“参考图”“原图”“主角被移除”等说明性文字。

我这里使用的是ChatGPT

这里我会根据画面的具体内容选择不同模型。

带有大量树叶、草地的场景,我通常会使用NanoBanana Pro生成。

这类画面包含大量高频细节,树叶的数量比较复杂。NanoBanana Pro在处理自然环境和密集细节时,通常会更加稳定。

建筑门面、咖啡店外墙、室内空间、干净街道和结构比较明确的场景,我会使用Image2.0生成。

我反推了三个场景的提示词如下:

提示词1(使用nanobanan pro生成):

竖构图9:16,户外安静街区广场,机位与地面接近站立视角,平视略微向前拍摄,广角中焦视野,自然透视明显,前景为灰黑色不规则石板铺装地面,石板之间缝隙清晰,表面略有磨损,地面横向穿过几条浅色斑驳的条带状反光和树影,高低起伏轻微;中景是一条低矮路缘石和一排金属链条隔离柱,左侧靠前有一根黑色复古双头路灯杆,细长圆柱杆身,顶部两盏灯罩对称展开;背景是一栋浅米白色单层建筑,平直外墙,灰色瓦片屋顶,屋檐整齐,墙面有三扇黑色边框大窗,左窗反射街景和树影,中间窗较暗,右窗更深,窗体之间墙面留白干净,右侧墙面有一个小型黑色壁挂装置;画面上方被一整片茂密大树树冠覆盖,深浅不一的绿色叶片和粗壮树枝横跨上半幅,左上角天空高亮过曝偏白,阳光从左上方穿过树叶形成柔和散射光和斑驳阴影,空气通透,整体是晴天白天的自然光氛围;右侧中远景保留一位远处路人坐在建筑边缘附近,仅作为环境元素,画面边缘可见其局部身影和休闲服饰色块,不占主体;整体色彩以绿色树冠、白色墙面、黑色金属、灰色石板和少量反射光为主,真实自然、低饱和、生活化街景,画面中央前景留出完整空旷区域,背景结构连续完整,无多余装饰,无夸张美化,无额外人物和车辆

提示词2(使用nanobanan pro生成):

竖幅9:16,街景写实摄影,机位位于人行道上与成人眼平视高度,轻微广角手机镜头视角,画面从近景到远景有自然透视,前景为深灰色方砖铺装的人行道,地面有零散黄绿落叶与树影斑驳光斑,右侧近景有一个白色涂底的树干下半部分和金属排水格栅,中央偏右是一棵粗壮的多主干大树,树冠向上向右铺展,枝叶浓密遮挡部分建筑,树根区域被低矮灰色混凝土花坛围挡,左侧和中左为黑色铁艺围栏与大门,围栏顶部带连续拱形防攀弧线,门后是浅灰米色住宅楼外立面,墙面干净但略有岁月感,带白色边框的半圆拱窗和竖条金属防盗栏清晰可见,二层位置有几个黑色小阳台悬挑在窗前,建筑左侧还有一段白色外墙和浅色走廊开口,空间层次为前景人行道、中景围栏与树、后景建筑立面,整体为白天自然光,阳光从画面上方偏左照射,经树叶过滤形成柔和散射光,阴影轻软、亮暗对比适中,色温偏暖,空气通透,真实生活化城市社区环境,无人物,无车辆,无额外装饰,保持现场原有结构、材质、比例与空间关系,高清细节,真实摄影质感

提示词3(使用image2.0生成):

竖幅写实街拍场景,正面平视构图,镜头约35mm,中等广角透视,画面主体是现代极简风咖啡店/轻食店外立面,整体建筑为浅灰色墙面与白色檐板,顶部有横向分段的白色外挑雨棚与细金属线条;左侧是一整块大面积落地橱窗,玻璃上贴有蓝白色手绘风菜单图案和英文店招字样,包括 BREAD、CAFE、SANDWICH、BRUNCH、COFFEE、XX.SHOKU,窗内可隐约看到吧台、金属容器和室内反射,玻璃略有暗色反光;右侧是店门入口与一段向上延伸的浅灰色石材楼梯,楼梯居中偏右,台阶整齐狭长,通向更深处的暗色门洞和内侧空间,门洞两侧是平整的灰色立面与垂直边框;前景为深灰色沥青路面,占据画面下半部,路面细颗粒质感明显,边缘连接一条浅米色小方砖人行道和低矮路沿,地面干燥平整;整体环境为安静的城市街边店铺,空间结构清晰,建筑线条垂直规整,前中后景层次分明,画面没有车辆和多余设施,保持原始自然状态;白天阴天柔和漫射光,光线均匀、阴影很弱,色温中性偏冷,外墙高亮但不过曝,室内门洞明显更暗,整体真实、克制、干净、生活化,纯背景环境,无人物,无额外装饰,无改造痕迹



二:生成人物资产


场景完成后,接下来需要准备人物。

人物可以在即梦的灵感库里寻找。

直接搜索“网感美女图”,就能看到很多适合短视频和服装展示的人物模板。找到喜欢的形象后,点击“做同款”,再根据自己的需要调整人物。

提示词如下:

22岁少女,高清特写,灵动眼睛,皮肤白嫩,可爱看镜头,半身正面特写,自然清新感,长直发,头发有装饰,站在海边沙滩上做可爱动作,周围环境优美,画面捕捉看向镜头,吊带少女活泼雪纺花边连衣裙,传递出舒适自在的生活氛围感。美的不真实,清新自然,高清,开心氛围,互动道具:随机首饰。露双肩身材完美,高颜值,打光不均匀造成的轻微曝光过度,做可爱表情,眉清目秀,初恋感,表情自然松弛慵懒休闲,眼神很自然不失真,完美身材,皮肤质感白嫩清透,甜美女生,完美贴合身形;整体风格简约大气,又因修身剪裁,俏皮灵动,嫩白皙柔滑,氛围感,故事感,视觉冲击效果,高级感,动态感,32K,大师杰作。梦幻,冷白皮,必须身材完美,肌肤雪白有光泽。整体画面必须清新明亮干净。随机表情,随机的淡妆容,随机发型和颜色,随机的动作,随机的光影,随机角度,总体有很多的不确定性,但又好看,搭配又很合理,最高等级画质,CCD拍摄,情绪片,极简风,唯美迷人,优雅气质,偶像气质,高级感,三庭五眼,瓜子脸,清纯,展现冰瓷玉肌冷白皮绝世美人,

准备好人物图和服装图后,将两张图片一起上传到Image2.0。

使用我这段模板提示词:

生成一张专业真人角色定妆四宫格参考板。本次生成需要同时参考两张图片,并严格区分两张参考图的作用。 第一张参考图为“人物参考图”,只负责控制人物身份与外貌,包括脸型轮廓、三庭五眼比例、五官形状、骨骼结构、肤色、发型、发色、妆容、头部配饰、身材比例、身体轮廓与人物气质。 第二张参考图为“服装参考图”,负责控制人物最终穿着的完整造型,包括服装款式、颜色、版型、领口、袖型、腰线、衣摆、开叉、布料层次、纹样、缝线、装饰、配饰、鞋子以及不同材质之间的组合关系。 最终画面中的人物必须保留第一张参考图的人物身份、面部特征、发型、妆容、身材比例与整体气质,同时完整换穿第二张参考图中的服装、配饰与鞋子。 不要保留人物参考图中的原始服装。 不要将两套服装混合、拼接或重新设计。 不要擅自改变服装颜色、结构、长短、材质、图案、装饰位置和穿着方式。 若服装参考图中没有人物,仅根据服装本身的版型与结构,将其自然、合理、完整地穿着在人物身上。服装必须贴合人物身体结构,但不能因为适配人物而改变服装原本设计。 整体画面为灰色摄影棚背景,呈现专业真人角色定妆参考板,规整排版,干净简洁,信息清楚。不是电影海报,不是杂志大片,不要标题文字,不要剧情动作,不要复杂场景,不要装饰性排版。 画面严格划分为上下两部分: 上半部分占画面总高度的三分之一。 下半部分占画面总高度的三分之二。 上方区域左右排列两张精细真人面部特写: 左上为人物正面面部特写。 右上为人物标准侧面面部特写。 两张面部特写均以头部、颈部与少量肩部为主,取景紧凑,清晰展示人物的脸型轮廓、五官比例、骨骼结构、妆容、发型、发丝走向、头部配饰与皮肤质感。 人物面部身份必须与人物参考图严格一致,同一张脸、同一年龄感、同一肤色、同一发型、同一妆容、同一头部配饰,不得出现换脸失败、五官漂移、年龄变化或不同人物感。 人物表情必须保持平静、自然、放松。 双眼自然睁开,视线稳定,不瞪眼,不刻意直视,不做强烈情绪表达。 嘴唇自然闭合或轻微放松,不露齿,不微笑,不撅嘴,不张嘴。 眉毛处于自然状态,不挑眉,不皱眉,不表现愤怒、悲伤、惊讶、恐惧、妩媚或夸张冷漠。 面部肌肉放松,呈现专业定妆照中自然、克制、中性的平静神态,避免表情僵硬、呆滞或没有生命感。 皮肤质感真实自然,保留适量毛孔、细纹、绒毛、眉睫、碎发和皮肤受光后的细微起伏。不要磨皮,不要过度锐化,不要人像美容,不要蜡像感、塑料皮肤感或油腻反光,呈现高解析真人摄影棚定妆照质感。 上方两张特写中,只需在肩颈区域自然露出少量第二张参考图中的服装领口、肩部或上衣结构,确保人物已经换穿服装参考图中的服装。不要继续出现人物参考图中的原始服装。 下方区域左右排列两张身体与服装参考图。 左下图为放大后的正面服装展示图。 人物采用标准、放松、稳定的正面 A-pose 站姿,身体正对镜头,双肩自然展开,双臂与身体保持适当间距,双手自然放松,不叉腰,不抱臂,不摆拍,不做走秀动作。 左下图的重点不是完整展示头部,而是近距离、放大展示人物正面身体比例与整套服装。 必须使用更近距离的正面取景,人物从肩颈下方开始入画,一直展示到鞋子。由于人物身体被明显放大,整个头部必须完整裁切到画面之外。 画面中不能出现头发、额头、眼睛、鼻子、嘴巴、下巴、耳朵或任何头部信息。 这不是普通远距离全身照,也不是缩小人物后简单裁掉头部,而是像专业时装定妆板中的正面服装主体展示图:人物躯干、腰部、双臂、双手、腿部与鞋子在画面中占据较大比例,服装结构与材质细节清楚可见。 人物双肩、双臂、双手、躯干、腰部、双腿和鞋子必须完整保留。画面边缘只允许裁掉头部,不能裁掉肩部、手部、腿部、脚部或服装主体。 左下人物在画面中的占比必须明显大于右下人物,看起来更近、更满、更大,突出服装正面版型、腰线、衣襟、领口、袖型、开合方式、裙摆、裤型、开叉、配饰与鞋子。 禁止将左下图生成为普通比例的小人物全身照。 禁止为了让鞋子入镜而缩小人物。 禁止头部仍留在画面中。 禁止只裁掉头顶或半张脸。 右下图为人物背面完整全身图。 人物采用标准 A-pose,背对镜头,从头部到鞋子完整入镜,人物比例正常,不需要像左下图一样放大裁切。 清晰展示人物背面发型、头部配饰、肩背轮廓、服装背部结构、后领、背部开合方式、腰线、衣摆、裙摆、裤型、后侧装饰、背面配饰和鞋子。 右下人物必须完整保留头部、发型、手部、腿部和鞋子,不得裁切身体。 右下人物的脸部不应转向镜头,不要出现正脸或明显侧脸,保持标准背面展示状态。 下方两张身体图必须是同一个人物、同一身材、同一肤色、同一套服装、同一组配饰和同一双鞋子。 人物身体比例、肩宽、腰线、腿长、手臂长度与整体体态必须保持一致,不得出现左右图身材变化、人物变胖变瘦、身高改变或肢体比例漂移。 整体可保持自然修长、具有专业模特感的身体比例,但不能夸张拉长腿部,不能过度缩小头部,不能改变真实人体结构。 第二张服装参考图中的服装必须完整、准确地穿着在人物身上。 严格还原服装正面与背面的设计逻辑,包括领口、肩部、袖子、胸腰结构、衣襟、纽扣、拉链、绑带、褶皱、开叉、口袋、衣摆、裙摆、裤脚、装饰物和配饰位置。 若服装参考图只展示服装正面,背面需要依据服装原有版型进行合理延续,保持简洁、真实、可制作,不得添加夸张装饰或改变整体设计语言。 服装不能悬浮,不能粘连身体,不能穿模,不能出现重复袖子、错误开口、多余布料、左右结构错乱或配饰位置漂移。 布料应具备真实的厚薄、重量、垂坠、拉伸和自然褶皱。金属呈现真实反光,皮革具有自然光泽,丝绸具有柔和流动反射,纱质具有真实半透明层次,针织、棉麻、毛呢等材质按照服装参考图准确表现。 若服装为开叉长裙,左下正面放大图中可让人物一条腿自然向前半步,以清楚展示开叉位置与露腿结构,但上半身仍保持稳定、平静的定妆姿态,不要形成走秀、跨步或剧情动作。 若服装带有帽子、头纱、发饰、耳饰、项链、手套、腰带、包袋或其他配饰,应根据服装参考图中的实际搭配进行保留。服装参考图中未出现的配饰不要自行添加。 摄影棚背景统一使用干净、平整、无接缝的中性灰色背景。 四个画面必须使用统一的棚拍光线、相同的色温与相同的灰色背景,不得出现不同场景、不同时间或不同光线方向。 光线使用干净统一的摄影棚三点式布光: 人物正左侧为柔和主光。 人物正右侧为低强度辅助光。 人物后右侧为克制的轮廓光。 光线需清楚表现面部骨骼、皮肤起伏、服装材质和身体轮廓,但不要使用强烈硬光、彩色灯光、霓虹光、舞台光、过度轮廓光或浓重氛围特效。 最终排版要求: 左上:人物正面面部特写。 右上:人物侧面面部特写。 左下:近距离放大的正面服装展示图,完整裁掉头部。 右下:正常比例的背面完整全身图。 上方两张脸部特写严格占据画面上三分之一。 下方两张身体图严格占据画面下三分之二。 四个区域边界清晰、大小统一、间距规整,不能相互重叠,不能出现额外人物、额外肢体、重复身体或第五个画面。 严格禁止: 禁止保留人物参考图中的原始服装。 禁止将人物参考图服装与服装参考图混合。 禁止擅自重新设计服装。 禁止服装颜色、面料、版型和装饰发生变化。 禁止左右身体图服装不一致。 禁止上方特写仍穿人物原始服装。 禁止四张图出现不同人物或不同脸型。 禁止人物表情微笑、露齿、撅嘴、瞪眼、皱眉、挑眉、张嘴或表现夸张情绪。 禁止人物表情僵硬、呆滞或假人感。 禁止左下图出现任何头部信息。 禁止左下图人物过小或采用普通全身照比例。 禁止左下图裁掉手部、腿部、鞋子或服装主体。 禁止右下图裁掉头部或鞋子。 禁止正背面身体比例不一致。 禁止人物比例漂移、肢体变形、手指错误、穿模、服装结构错乱。 禁止油腻皮肤、塑料皮肤、过度磨皮、过度美颜、过度锐化、廉价 CG 感、蜡像感和明显 AI 生成痕迹。 最终效果应是一张排版准确、身份统一、服装还原准确、表情平静自然、材质真实、可直接用于后续角色与服装一致性生成的专业真人定妆四宫格参考板。

使用Gpt image2.0生成



三:生成视频


所有资产准备完成后,进入Seedance 2.0。

将空场景图、人物四视图和参考视频一起上传,点击生成即可。

视频提示词模板如下:

你现在是一名专业AI视频导演。图1是场景 图片2是人物四视图,视频1是动作参考。 请生成一条穿搭展示视频:最终视频必须使用图2中的人物作为唯一主角,人物脸型、五官、骨骼、肤色、发型、发色、身材比例、年龄感和气质全部严格锁定图2,不得混入视频1人物的任何脸部或外貌特征;场景必须使用图1,保留空间结构、背景元素、光影和整体色调;视频1只参考动作,不参考人物、服装、场景,只复刻动作顺序、姿态、步伐、转身、手部动作、停顿节奏和运动轨迹。完整模仿视频1动作,动作自然连贯,脚底真实落地,服装摆动自然,不穿模,不漂浮,不贴图感,不要一直看镜头。镜头可参考视频1节奏,但人物始终是图2的人,场景始终是图1。禁止参考视频1人物脸部,禁止生成与视频1主角相似的脸,禁止变脸、换装、换景、多人、肢体畸形、多余手指、脚底悬空、背景跳变、文字水印。最终效果为高级自然的时尚穿搭展示视频。

建议使用flowpix(无限画布)去生成,即梦官网的seedance2.0容易卡人脸



结语


这套方法的核心,不是让AI凭空设计一条服装视频,而是把成熟视频拆成可以控制的资产。

参考视频提供动作和镜头,场景图提供空间,人物四视图提供人物和服装。

当每一类素材只负责一件事,AI就不需要同时猜测人物、服装、场景和动作,最终效果也会更加稳定。

从参考视频中提取拍摄逻辑,再用自己的服装、人物和场景重新生成,就能在保留原视频展示节奏的同时,制作出属于自己的服装展示视频。



速用卡

视频生成执行卡

把这节课压缩成一张可执行卡片:看重点、照步骤、避坑,再复制模板直接开做。

一句话重点

这节课不是先追求炫技成片,而是围绕「一键复刻爆款服装视频」先把主体、动作、镜头和节奏稳住。

落地顺序

按原文节奏走最稳:先吃透「准备工具」,再把「生成场景图」定住,接着处理「生成人物资产」;最后用「生成视频」收口。

照着做清单
  1. 先把「准备工具」里的主体和动作定死。
  2. 这一段重点看镜头和节奏,别急着炫技。
  3. 做完「生成人物资产」后,先查连贯性和穿帮。
  4. 先把「生成视频」里的主体和动作定死。
最容易踩坑

不要一上来就生成最终片;先拆镜头、定主体和运动,再逐段生成,否则容易跳轴、穿帮、节奏混乱。

成品自检

检查主体是否稳定;镜头运动是否明确;前后画面是否连贯;节奏是否服务主题;是否有明显变形或穿帮。

可直接复制的万能模板
请围绕「一键复刻爆款服装视频」帮我做一个可直接执行的方案。
我的目标是:【填写你的具体目标】
我的素材/产品/角色信息是:【填写已有素材和限制】

请输出:核心创意、分镜表、每个镜头的画面描述、视频生成提示词、剪辑顺序和成片自检清单。要求主体稳定、动作明确、镜头连贯。