主题
Z-Image
Z-Image 是一款适合使用中文提示词的自然语言图像模型,可以直接理解人物、空间关系、产品细节和画面文字。它适合写实摄影、产品展示以及带中文或英文短标题的场景;Turbo 版本使用较少步骤,便于连续比较描述和构图。
模型设置与首次生成
打开 内容生成,点击页面顶部的 图像,再从 模型菜单选择 Z-Image。在 基础设置中点击 选择主模型。

在 高级设置中选择 Qwen3 4B 文本编码器和 Flux AE。运行组件显示三项均已就绪后:
- 在提示词中用中文或英文描述画面。
- 保留页面默认的
1024 × 1024、8步和 CFG Scale1。 - 点击 运行,在右侧查看结果。
当前内容生成页采用 Z-Image Turbo 的快速参数,适合连续比较提示词和构图。
编写中文提示词
把主体和关系放在前面,再补文字、光线、镜头和风格:
text
主体与人数 → 外观和动作 → 环境与空间关系 → 画面文字 → 光线与色彩 → 构图和风格text
雨夜的街角便利店,一名穿黄色雨衣的女孩站在自动门前,回头看向镜头。
门上方红色灯牌清晰写着“营业中”,湿漉的柏油路反射霓虹灯,
广角街拍,低机位,冷蓝环境光与店内暖光形成对比,写实摄影。产品图可以这样写:
text
一只透明玻璃香水瓶放在浅灰色石台中央,瓶身正面印有“晨雾”两个黑色宋体字。
左侧柔和窗光,背景干净,近距离产品摄影,真实折射,瓶身带有细微水珠。希望排除某种效果时,可以直接写成目标状态。例如,背景需要更整洁时写“干净的浅灰色背景,画面中只有一个产品”;画面需要更清楚时写“主体边缘清晰,焦点准确”。
画面文字的写法
描述画面文字时,最好同时写清四项内容:
text
文字内容 + 所在载体 + 画面位置 + 字体外观与颜色例如:
text
海报顶部居中写着“夏日书市”,白色粗体无衬线字;
右下角有一行较小的深蓝色文字“周末开放”。短标题和少量文字更容易稳定。拼写接近目标但仍有个别错误时,可以固定种子,减少次要装饰,再对文字区域使用图生图或局部重绘。
调整生成参数
| 选项 | 页面默认值 | 具体作用与调整方法 |
|---|---|---|
| 分辨率 | 1024 × 1024 | 决定画面比例和初始细节。产品单品与头像适合方图,人物全身与海报适合竖图,街景和多人画面适合横图。构图确认后再使用二次采样或高清放大 |
| 步数 | 8 | Turbo 使用少量步数完成画面。日常生成保持 8;模型详情明确推荐 9–12 时可以按说明尝试,并固定种子比较细节变化 |
| CFG Scale | 1 | Turbo 使用 1。主要通过改写句子加强对象、位置和文字要求,画面会更自然 |
| 采样器 | res_multistep | 页面默认值与 Turbo 配合使用。切换到其他微调版本时,采用模型详情推荐的采样器 |
| 调度器 | simple | 与默认采样器共同决定采样节奏。Turbo 日常使用保留默认值 |
使用 LoRA 与参考图
选择明确标注支持 Z-Image 的 LoRA,并填写模型详情中的触发词。强度可以从 0.7 开始,效果较弱时逐步提高,画风覆盖主体材质或文字时适当降低。
希望沿用参考图的构图和色彩时,可以使用 图生图;修改局部物体或文字时使用 局部重绘。画面完成后,二次采样用于补充纹理,高清放大用于提高像素尺寸,人物较小时可以再使用 面部修复。完整操作见图像高级功能。
使用 Z-Image Base
Z-Image Base 是另一种模型版本,官方建议从 28–50 步、CFG Scale 3–5 开始,并可使用反向提示词。需要 Base 的完整采样方式时,可以打开 ComfyUI,导入模型作者提供的 Base 工作流。
生成结果调整
- 中文指令有内容遗漏:把长句拆开,先写主体和位置,再写光线与风格。
- 多个对象关系混乱:逐个说明颜色、大小、左右和前后位置。
- 文字不清楚:缩短内容,明确载体、位置和字体外观,再局部重绘文字区域。
- 画面太杂:限定对象数量、背景颜色和镜头范围。
- 内容已经满意,只想增加清晰度:使用二次采样或高清放大,保留原有构图。