---
name: qwen-image-gen
description: 为 Qwen-Image 编写和改写生图提示词，区分局部编辑与参考主体创作，处理同人物系列、画幅及原图验收；用户要求生成时连接其已有的 Qwen 图像工作流。不用于下载权重、通用模型运维或其他图像模型。
---

# Qwen Image Gen

将创作需求转成可执行的提示词、参考图关系和尺寸决策。默认由当前 Agent 改写，无需额外部署提示词增强模型。参考图任务需要视觉理解能力；纯文本执行者应先取得准确的图片描述。

## 先区分任务

- **提示词、改写、翻译**：交付可复制文本与尺寸建议，不提交生图。
- **文生图**：描述最终可见画面。身份、数量、文字、动作、颜色和位置是固定要求；只补全必要的构图与光照细节。
- **修改这张图**：先说改哪里、改成什么，再简洁锁定未修改内容。改变姿势时不能同时要求姿势不变。
- **参考主体创作新图**：先实际看图，明确哪张图提供身份、服装或背景，再描述新姿势与场景。不要只靠重复人物形容词维持同一张脸。

写提示词前读 [rewriting.md](references/rewriting.md)。保留用户的创作意图，不用通用美化词覆盖具体要求。简单需求不必扩成长文。

## 把单张、系列和画幅拆开

单张只安排一个明确动作。系列总提示词包含多个动作时，拆为各自完整的单图提示词；同人物系列分别从一张通过验收的身份参考出发，避免逐张把上次生成的误差累积进去。只有用户要拼图时才描述多面板。

画幅是独立参数。明确像素或比例优先；没有指定时，根据构图建议比例并落实到下游接口。不要只在文字里说竖图，却提交方形画布。相同比例可以对应不同像素尺寸。

可供程序衔接的结构：

```json
{"rewritten_prompt":"最终画面描述","wh_ratio":"9:16"}
```

```json
{"rewritten_prompt":"具体编辑要求及保留条款","wh_ratio":"","ratio_follow":"<image1>"}
```

`wh_ratio` 与 `ratio_follow` 互斥。仅将 `rewritten_prompt` 送入模型的文字输入，不把 JSON 包装或解释一并送进去。用户只要提示词时，用普通文本交付即可。

## 已要求生成时

使用用户指定且已有的 Qwen 入口，沿用当前授权。先读 [integration.md](references/integration.md)，核对实际接口：是否支持参考图、多图、显式宽高和原生 Alpha。模型有某能力，不代表当前封装已经接入。

本 Skill 不预置服务器地址或密钥，也不默认下载模型。没有生成连接时仍可交付提示词；不能把“已准备请求”说成“已生成”。

应用需要加载同一份版本化规则时，读 [shared-runtime.md](references/shared-runtime.md)。可选 Node.js 模块只构造规划消息、校验结构和整理质量反馈，不联网、不执行生成；普通 Agent 无需运行它。

附带的 `scripts/prepare_workbench_request.py` 只是一个**可选、离线、特定工作台协议的请求构建器**。它不调用模型、不进行提示词改写、不联网。其 2048 像素和单参考图限制仅适用于该适配器，不是 Qwen 的模型上限。详见 [workbench-adapter.md](references/workbench-adapter.md)。

## 验收与修正

检查未经修饰的原图：目标文字、动作、肢体连接、身份、保留区域、实际像素尺寸；需要透明时检查 Alpha 和边缘，而非仅看文件扩展名。

为每个结果保留原提示词、实际提交文本、参考图、生成设置及结果位置。质量缺陷与审美不喜欢分开记录：多肢不代表不喜欢坐姿。修正时附上缺陷、目标状态和需要保留的内容；保留原图与新版本，让用户比较验收。没有更多生成授权时停止，不无限重抽。

当用户要 A/B 对照，固定图像模型、尺寸、步数、种子和参考图，只改变待测因素。把采用新画幅的实验单独比较。生成成功、图片更美观、严格完成要求是三个不同判断。

遇到文字泄漏、多宫格、姿势粘连、尺寸异常或透明边缘问题时读 [tested-behavior.md](references/tested-behavior.md)。这些是具体条件下的观察，不能扩展为通用成功率。
