bozo-qwen21-prompt — Qwen-Image-2.1 提示词公式扩展
Qwen-Image-2.1 是通义千问的统一文生图 + 图像编辑模型(7B,32 层单流 DiT)。它对提示词的要求与 Midjourney 等模型不同:不喜欢碎片化的标签堆砌,而喜欢一段完整、具体、可观察的自然语言描述。本技能把用户的一句话想法,扩写成模型最容易"听懂"的提示词。
工作流程
第 1 步:判断任务类型
| 用户输入特征 | 模式 | 公式文件 |
|---|---|---|
| 没有提供图片,想从零生成一张图("画一张…""生成一张…海报") | 文生图 | 读 references/t2i.md |
| 提供了输入图片,想对图做修改(改背景、换装、换脸、改文字、扩图、抠主体、透明图编辑等) | 图片编辑 | 读 references/edit.md |
不确定时问用户一句:"你是想从零生成一张图,还是基于手头的图片做编辑?"
第 2 步:读取对应公式文件
- 文生图 →
Skill目录下references/t2i.md(八步观察者法) - 图片编辑 →
references/edit.md(属性解耦编辑法)
两个公式文件都来自 Qwen-Image-2.1 官方提示词重写系统的核心规则,必须严格遵循其中的写作纪律(观察而非指令、枚举而非概括、位置短语导航、引号内文字逐字锁定等)。
第 3 步:按固定模板输出(中文版 + 英文版)
用户的原始想法可能只有中文或只有英文,但输出永远两种语言都给,方便用户直接粘贴到任意语言的调用流程里。使用以下模板:
## 🎨 Qwen-Image-2.1 提示词(文生图 / 图片编辑)
### 🇨🇳 中文版
<中文完整提示词,单段连续文字>
### 🇬🇧 英文版
<English full prompt, single continuous paragraph>
### 📐 建议宽高比
- `wh_ratio`: "<如 3:2>"(或 `ratio_follow`: "<image1>",编辑任务时说明理由)
双语版要求:
- 两个版本内容完全等价,只是语言不同——不是翻译腔的机翻,而是各自用母语的自然表达重写一遍。
- 画面里要渲染的文字(引号内的内容)两种版本里保持同一语言、同一字符,不翻译。例如图里要显示"夏日特惠",英文版的描述里也写
"夏日特惠"。 - 专有名词保留原文。
比例(wh_ratio)确定规则(速查)
用户明确给了比例 → 用用户的。没给时的默认:
| 场景 | 比例 | |---|---| | 一般横向画面 | 3:2 | | 一般纵向画面 / 写真 / 海报 | 2:3 | | 方形徽章、图标、专辑封面 | 1:1 | | 宽幅电影感 / PPT / 演示 | 16:9 | | 手机壁纸 / 竖版 banner | 9:16 | | 小红书封面 / 证件照 | 3:4 | | 全景图 | 2:1 |
编辑任务中"跟随某张输入图的比例"(ratio_follow)的完整判定表见 references/edit.md。
底线纪律(两种模式通用)
- 提示词里绝不出现分辨率、比例、像素数、"2K/4K/8K"、"masterpiece"、"highly detailed" 之类质量词——比例只放进
wh_ratio,画质靠描述本身。 - 观察者口吻:写"画面里有什么",不写"请生成什么"。不用"请""确保""AI 应该"。
- 要渲染的文字放在英文直引号里逐字写全,绝不省略号或概括。
- 中文版提示词同样遵循上述纪律——它是给 Qwen-Image-2.1 直接消费的正式输入,不是给人看的说明。
Scan to join WeChat group