最终效果

做完以后,你会得到一张竖向全身照:人物站在暖灰到浅米色的棚拍背景前,穿着你上传的上衣、短裙和高跟鞋,一只手拿手袋,另一只手自然扶在胯部。人物的脸保持原照片的特征,衣服贴合身体,腰带、鞋跟和饰品都在正确位置。
这篇只做一张静态棚拍图。最终文件不是四张不同姿势,也不需要先做九宫格身份板。先把这一张做对,才能看清多张参考图有没有被正确使用。
示例造型是深红色挂脖上衣、同色腰带短裙、漆皮露跟高跟鞋、心形手袋、红色项圈、金色手链和发夹。你可以换成自己的单品,但要把提示词中的颜色、版型和配件名称一起替换。
结果应该是:一张 4:5 全身图;脸与人物参考相符;所有上传的服装和配件都穿戴在正确位置,没有多出陌生单品。
第 1 步:准备人物和单品图
先把需要上传的图片放到一个文件夹。每张图尽量只展示一个对象,文件名直接写用途:
| 文件名示例 | 图片里放什么 | 为什么单独准备 |
|---|---|---|
person.jpg | 清楚的成年人物全身或半身照 | 负责脸、发型和人物身份 |
halter-vest.jpg | 挂脖上衣正面 | 负责上衣版型、颜色和面料 |
belted-skirt.jpg | 带腰带的短裙 | 负责裙长、腰线和腰带结构 |
heels.jpg | 一双露跟高跟鞋 | 负责鞋型、鞋跟和漆皮反光 |
heart-bag.jpg | 心形手袋 | 负责包的轮廓、比例和五金 |
accessories.jpg | 项圈、手链、发夹 | 负责小配件的位置与颜色 |
为什么要分开?模型需要知道每张图是在提供人物,还是在提供衣服。如果人物和服装都挤在复杂截图里,它可能沿用截图中的模特、背景或其他不需要的商品。
做完应该看到:一个包含人物和五类单品的文件夹。图片没有购物平台按钮、聊天记录或大面积文字,单品边缘能看清。人物照片必须得到本人许可,不要用陌生人的社交头像做练习。
第 2 步:打开 Nano Banana 2 并上传全部图片
在 Bagel 中选择 Nano Banana 2 的图像生成入口,创建一个图生图任务。先上传人物照,再依次上传上衣、短裙、高跟鞋、手袋和饰品图。
上传顺序本身不保证模型一定理解,所以等缩略图全部出现后,数一遍数量,并记住每张图对应什么。缺一张就先补齐,不要在提示词里描述一个没有参考图的复杂单品。
为什么使用图生图而不是只打字?人物的脸、服装剪裁、鞋包外形都来自图片。文字更适合说明“谁负责什么”和“怎样组合”,不能替代这些视觉信息。
做完应该看到:输入区里至少有一张人物图,以及上衣、下装、鞋、包和饰品图。没有混入第二个人物或第二套造型。
如果当前入口显示的模型名称不同,先不要继续。模型能力和界面可能变化,这篇操作以能够选择 Nano Banana 2、并支持多张参考图的入口为准。
第 3 步:说明每张参考图负责什么
提示词的第一段只做素材对应。把名称改成你自己的文件或上传顺序:
这是一个多参考图的时装棚拍任务。
使用人物图作为唯一的人物身份参考,保持她的脸部特征、肤色和发型。
让人物穿上参考图中的深红色挂脖上衣和同色腰带短裙。
鞋子使用漆皮露跟高跟鞋,手里拿心形手袋。
红色项圈戴在颈部,金色手链戴在手腕,发夹固定在头发上。
不要把服装参考图中的模特、背景或姿势带入结果。
这一段回答的是“每张图到底拿来做什么”。如果只写“参考我上传的图片”,模型可能用人物照里的衣服,也可能把手袋的颜色套到裙子上。
做完应该看到:提示词中每一张参考图都有明确用途。人物图只负责身份,服装图只负责对应单品,没有一句含糊的“融合所有风格”。
第 4 步:写清衣服怎么穿、材质怎么看
接着写穿戴关系。不要只写“把这套衣服穿到她身上”,要说明容易出错的位置:
上衣贴合躯干,但保留真实布料褶皱和缝线受力,不要像贴纸。
短裙准确落在胯部,腰带扣有重量感,腰带会轻微压住面料。
双脚自然踩地,高跟鞋后跟与脚跟贴合,左右鞋一致。
手袋大小与身体比例协调,金属五金有真实反光。
项圈沿颈部弧度贴合;手链落在手腕;发夹与头发接触,不悬空。
为什么要写这些细节?多参考图最容易在“接触”处出错:腰带浮在裙子外面、鞋跟穿过脚、包带粘到手、发夹离开头发。直接说明接触关系,比反复强调“真实”更有效。
做完应该看到:每件单品都有一个身体位置和一个材质表现。提示词没有要求模型改变人物身材来迁就衣服。
第 5 步:设置棚拍背景、镜头和姿势
最后补上摄影条件。这里决定画面长什么样:
输出比例为 4:5,竖向全身时装棚拍。
背景是暖灰到浅米色的干净渐变棚景。
左前方使用大型柔光箱,轻微补光,轮廓边缘有柔和分离光,脚下有清楚但不过重的影子。
使用 85mm 镜头感、f/2.8 景深,焦点落在眼睛和服装纹理。
机位略低。人物站姿自信,肩膀放松,一手拿手袋,另一手自然扶胯,目光看向镜头。
深红色不要过度饱和,肤色自然,保留真实皮肤纹理。
为什么用这些设置?中长焦镜头感可以减少全身比例变形;柔光让脸和红色面料都有细节;略低机位配合稳定站姿,会得到更接近时装编辑而不是证件照的效果。
做完应该看到:提示词已经依次写完人物与单品对应、穿戴关系、棚拍背景、灯光、镜头和姿势。所有描述都指向同一张最终画面。
第 6 步:生成一张 4:5 棚拍图
提交提示词,等待图像生成。第一轮只生成这一个站姿,不要同时要求四个动作、多个背景或一段视频。
结果出来时先缩小看全身。你应该看到人物从头到脚都在画面内,深红上衣和短裙属于同一套造型,手袋在手中,鞋底与地面接触,背景从暖灰平滑过渡到浅米色。
如果失败:
- 人物变脸:把“人物图是唯一身份参考”移到提示词第一句,删掉其他人物描述;
- 某件单品没出现:在素材对应段单独点名它,并写清身体位置;
- 身体比例过长:加强
85mm和全身自然比例,去掉“夸张长腿”; - 画面像廉价目录照:保留棚拍灯光与略低机位,不要堆更多“奢华”形容词。
做完应该看到:一张可以继续检查细节的 4:5 候选图,而不是四张变体或九宫格。
第 7 步:检查脸、腰带、鞋跟和手袋
先看脸,再从上到下看穿戴细节。按这个顺序检查,比较不容易漏:
- 脸型、眉眼、鼻子、嘴角和发型是否仍像人物参考;
- 上衣领口和肩部是否贴合,布料有没有融进皮肤;
- 短裙腰线是否自然,腰带扣有没有错位或重复;
- 左右鞋是否同款,鞋跟是否接住脚,脚底是否落地;
- 手指是否自然握住手袋,包的大小是否合理;
- 项圈、手链和发夹是否在正确位置,没有悬空。
如果只有一处错误,把修改指令写得具体,例如“保持脸、姿势和其他服装不变,只修正右脚鞋跟,使鞋跟与脚后跟贴合并接触地面”。如果整个人物或整套衣服都不对,回到第 3 步检查素材对应,不要靠局部修补硬救。
最终保存一张人物身份稳定、穿戴关系自然的 4:5 时装棚拍图,以及生成它的完整提示词。这一张图看起来合理就完成了,不需要继续做视频或四张姿势变体。
