ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

Qwen-Image-2.1多图参考编辑详解:如何用10张参考图生成合影与全身穿搭

Qwen-Image-2.1多图参考编辑详解:如何用10张参考图生成合影与全身穿搭 【免费下载链接】Qwen-Image-2.1Qwens most powerful open-source image generation model项目地址https://gitcode.com/gh_mirrors/qw/Qwen-Image-2.1点击查看免费下载Qwen-Image-2.1 是通义千问团队开源的文生图生成与图像编辑模型最大亮点是支持一次传入最多10 张参考图完成合影生成、全身穿搭合成等多图编辑任务。下面为新手完整讲解玩法与操作步骤。️ Qwen-Image-2.1 多图参考编辑能做什么Qwen-Image-2.1 是一个文生图 图像编辑二合一的统一模型视觉生成组件仅 7B 参数32 层 Single-Stream DiT兼顾生成质量与推理效率。核心能力一览多图参考最多 10 张参考图多主体自由组合合影生成多张人像照片合成同一场景合影面部特征保持一致全身穿搭合成模特 衣服 鞋 包 帽子多张参考合成一套完整造型局部编辑用圆圈、涂画标注或独立掩码指定局部修改原生透明直接生成带 alpha 通道的 RGBA 透明图原生 2K 分辨率支持 1:1、4:3、16:9 等 7 种画幅比架构细节可查阅 README.md 的 Architecture 章节。一键安装步骤快速搭好运行环境用 pip 安装核心依赖即可需最新版本的 diffusers提供QwenImage21Pipeline接口pip install torch2.4.0 transformers5.17 diffusers accelerate pillow模型权重可从 ModelScope 或 Hugging Face 下载生态侧还支持 ComfyUI、vLLM-Omni、SGLang 等推理框架详见 README.md 的 Community Support 部分。如何传入10张参考图合影生成实战把多张图片组成PIL 图片列表直接传给image参数用提示词说明人物关系即可images [Image.open(fref_{i}.png) for i in range(3)] # 最多 10 张 result pipe( prompt这三位人物坐在森林的篝火旁保持各自的面部特征不变, imageimages, num_inference_steps40, ).images[0]官方展示案例已用 6 张单人肖像生成了整张合影。仓库自带的编辑示例数据中还有一个multi_portrait双人合影案例将两位人物置入直播间场景拍合影见 edit_example.jsonl全身穿搭生成5张参考图组合一套造型官方全身穿搭案例将模特、衣服、鞋、包、帽子5 张参考图组合成一张完整的全身造型图。使用建议在提示词里给每张参考图明确角色谁是画面主体谁只提供参考素材需要保持不变的部分显式写保持 XX 外观不变多图参考标注规则用 指明每张图的角色多图输入时官方规范要求必须用image1、image2标签引用图片不要写图1 / 第一张图 / image A明确哪张是画布构图与未修改内容保留、哪些是素材来源合影、一起变老这类无画布新场景任务所有图片都作为身份来源每张参考图要逐张单独描述不要合并成一组笼统带过完整规则见 system_prompt_edit.txt。示例数据中的真实写法将 中的人物和 中的人物置入一个现代直播间的场景中生成一张两人并排坐在直播桌后共同面向镜头的合影照片。保持两位人物的面部特征、发型和服装外观完全不变。官方提示词改写让效果再上一个台阶官方配套了两个微调版 Qwen3.5-VL 9B 提示词改写模型T2I 一个、Edit 一个把简短粗放的提示词自动扩写成详细、可执行的长提示词并推荐输出画幅模式作用输出字段t2i短请求扩写为长提示词rewritten_prompt、wh_ratioedit模糊编辑指令改写成精确指令rewritten_prompt、wh_ratio、ratio_followpython run_vllm.py --task edit \ --ckpt Qwen/Qwen-Image-2.1-PE-I2I \ --input data/edit_example.jsonl --output out.jsonl全部代码位于 prompt_rewrite/ 目录使用说明见 prompt_rewrite/README.md。单次验证用 run_transformers.py想做成服务则用 serve.sh client.py。其他热门编辑场景速览Qwen-Image-2.1 处理单图编辑同样出色局部细节编辑—— 例如只把头转向左侧身体和手臂不动创意变形—— 例如把这个徽标画成在空中飘扬的旗帜图内文字编辑—— 例如把动漫插图里的日本文字翻译成印地语单图全景—— 一张自拍扩展成 2:1 的全景画面出图画幅与分辨率如何选输出画布Qwen-Image-2.1 原生 2K常用推荐分辨率比例分辨率1:12048×20484:32400×17923:41792×240016:92752×15369:161536×2752两条经验法则换背景、换脸、换装等局部编辑 → 跟随画布图的画幅ratio_follow合影、穿搭等新场景合成 → 按场景选比例官方建议合影用 3:2默认参数num_inference_steps402048×2048 分辨率。❓ 常见问题显存不够怎么办单卡 40GB 可舒适运行显存紧张时调用pipe.enable_model_cpu_offload()做模型卸载多参考图编辑还会自动复用前缀 KV 缓存以加速。提示词可以用中文吗可以中英文提示词均支持提示词改写模型还支持任意语言输入并按语言规则输出改写结果。合影人物相似度不够搭配官方提示词改写模型使用提示词中显式写明保持面部特征、发型完全不变并尽量使用脸部清晰的参考图。 相关路径速查项目主文档README.md提示词改写文档prompt_rewrite/README.md编辑系统提示词system_prompt_edit.txt编辑示例数据edit_example.jsonl许可协议LICENSE赞分享【免费下载链接】Qwen-Image-2.1Qwens most powerful open-source image generation model项目地址https://gitcode.com/gh_mirrors/qw/Qwen-Image-2.1点击查看免费下载相关推荐拆解 Qwen-Image-2.1 的『改图』革命RGBA 透明图 最多 10 张参考图生成编辑一体的底气在哪拆解 Qwen Image 2.1 的『改图』革命RGBA 透明图 最多 10 张参考图生成编辑一体的底气在哪 2026 年 9 月下旬阿里千问开源人工智能大模型模型量化本地部署媒体生成Qwen-Image-2.1 进阶编辑技巧10张参考图局部圈选人像产品身份精准保持Qwen Image 2.1 进阶编辑技巧10张参考图局部圈选人像产品身份精准保持 Qwen Image 2.1 是 Qwen 团队开源的 AI 图像编辑人工智能大模型媒体生成多模态openpilot开源驾驶辅助系统新手教程从装到上车只需3步openpilot开源驾驶辅助系统新手教程从装到上车只需3步 openpilot 是一款开源驾驶辅助系统目前支持 300 多款车型上车后能直接升级原车的自自动驾驶人工智能计算机视觉深度学习机器人创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进