多图合成的难点往往是主体归属:第二张图的颜色跑到第一张物体上,或两个对象被合成一个。Qwen-Image-Edit-2511 接受图片列表,可以用明确的图号和位置来约束编辑任务。下面用两张自有玩具图整理流程;未运行生成,参考效果不代表身份或文字保证。
为每张输入定义角色
toy1.png 是黄色小熊,toy2.png 是蓝色机器人。保持每图一个完整主体,先列出三项要保留的特征:小熊颜色、机器人天线、各自的身体轮廓。素材分辨率和背景差异仍可能影响输出,不能只靠“高清”一词修复。

图片列表与指令一一对应
import torch
from PIL import Image
from diffusers import QwenImageEditPlusPipeline
p = QwenImageEditPlusPipeline.from_pretrained(
"Qwen/Qwen-Image-Edit-2511", torch_dtype=torch.bfloat16).to("cuda")
prompt = ("Place the yellow bear from image 1 on the left and "
"the blue robot from image 2 on the right, on one plain table. "
"Keep them separate and preserve their individual colors.")
with torch.inference_mode():
out = p(image=[Image.open("toy1.png"), Image.open("toy2.png")],
prompt=prompt, generator=torch.manual_seed(0), true_cfg_scale=4.0,
negative_prompt=" ", num_inference_steps=40, guidance_scale=1.0,
num_images_per_prompt=1)
out.images[0].save("combined.png")
模型卡采用 QwenImageEditPlusPipeline,两个输入放在同一个 image 列表中。这里的参数对应所引模型卡;其他 Edit 版本不能假定类名与参数完全相同。
合成验收不能只看场景漂亮
先数对象数量,检查左右位置,再对照原图核对天线、颜色与轮廓。若小熊染成蓝色或机器人长出熊耳朵,任务已经失败,即使背景漂亮也不能通过。产品 logo、细字、关节形状还要放大查看,生成模型并不保证品牌与文字精确。
失败后按一个变量重试
对象归属混乱时,先改为简单背景和“两个独立物体”的指令,保留输入列表顺序。位置错误时改提示,不同时更换素材和随机种子。若细节必须逐像素保留,采用传统抠图与合成更便于控制;这不是多图生成的必然承诺。交付时保留输入、指令与结果三件资料,才能判断新一轮是否真的改进。
参考资料
依据 2026-10-03 读取的官方资料整理:官方文档 1。
Ai菜鸟网。发布者:AI小管家,转载请注明出处:https://www.alyyhw.com/33083.html