主题
配置与版本
同一个模型可以用不同的显存和精度设置运行,缓存方式和 ComfyUI 版本也会影响生成速度、资源占用、画面表现和插件兼容性。配置与版本用于根据设备条件或遇到的具体问题调整这些设置。日常生成沿用默认值即可;出现显存不足、画面异常、生成变慢或插件要求特定版本时,再修改对应项目。启动、停止和打开 ComfyUI 的方法见运行概览。

常见问题与相关设置
可以按照遇到的现象直接查找相关设置:
- 生成时提示显存不足:查看 VRAM 管理、显存预留与动态显存余量和 UNet 精度。
- 任务经常在生成中途或接近完成时显存不足:查看显存预留与动态显存余量。
- 连续生成时频繁重新加载模型,等待时间较长:查看 VRAM 管理和异步权重卸载。
- 图片变黑、花屏或颜色异常:查看 VAE 精度和注意力上采样。
- 系统内存占用过高,电脑明显变慢:查看工作流缓存和内存与磁盘。
- 生成过程中的预览太模糊或占用较高:查看生成过程预览。
- ComfyUI 无法上传较大的图片或视频:查看文件上传上限。
- 插件要求使用特定 ComfyUI 版本:查看切换 ComfyUI 版本。
每次先调整一项,点击 保存并重启,再用同一个工作流生成一次。这样更容易看出哪项设置真正解决了问题。
内存与性能
VRAM 管理
拿不准时选择 默认。显存充足并且经常连续使用同一模型,可以选择 High VRAM 或 GPU Only;生成时提示显存不足,再考虑 Low VRAM 或 No VRAM。
| 选项 | 什么时候选 | 选择后的变化 |
|---|---|---|
| 默认 | 大多数电脑和常见工作流 | 自动兼顾显存占用和生成速度,适合作为调整起点 |
| GPU Only | 运行常用工作流时显存还有很多空余 | 显存占用最高,连续生成时等待较少 |
| High VRAM | 显存比较充足,并且经常连续使用同一批模型 | 尽量让已加载的模型留在显存中,切换模型较少时会更流畅 |
| Low VRAM | 默认模式仍然提示显存不足 | 同时把 动态显存调度 设为 禁用;可以腾出更多显存,生成速度会明显降低 |
| No VRAM | Low VRAM 仍然无法完成任务 | 最大限度节省显存,模型加载最频繁,等待时间也最长 |
生成高分辨率图片、视频或同时使用多组控制功能时,需要给生成过程留出更多显存,优先从 默认 开始。显存还有较多空余时,再尝试 High VRAM;确认整个工作流都能轻松放进显存后,再考虑 GPU Only。
显存预留与动态显存余量
这两项都以 GB 为单位,只填写整数。0 表示使用 ComfyUI 的默认值。
| 设置 | 什么时候调整 | 建议怎么填 |
|---|---|---|
| 显存预留 (GB) | 同一张 GPU 还要供桌面、浏览器或其他程序使用 | 从 1 开始;其他程序仍然卡顿时,每次增加 1 |
| 动态显存余量 (GB) | 显存看起来接近用满,任务偶尔在中途或最后阶段失败 | 从 1 开始;仍然失败时,每次增加 1 |
显存预留是把空间留给其他程序,动态显存余量是给当前生成任务留出缓冲。数值越大,ComfyUI 能用来保存模型的显存越少,模型加载也可能更频繁。
异步权重卸载
| 选项 | 什么时候选 |
|---|---|
| 默认 | 大多数 NVIDIA GPU;通常可以减少模型切换时的等待 |
| 启用 | 默认设置下模型切换仍有较长停顿时,可以用同一个工作流比较一次 |
| 禁用 | 模型加载或切换时反复报错,想确认问题是否与这项功能有关 |
动态显存调度
| 选项 | 什么时候选 |
|---|---|
| 默认 | 日常使用,优先选择 |
| 强制启用 | 教程、插件说明或排错步骤明确要求打开时 |
| 禁用 | 使用 Low VRAM 时,或默认设置下反复出现原因不明的显存不足 |
CUDA 设备
只有一张 GPU 时保持空白。多 GPU 电脑可以填写 0、1 或 0,1,指定 ComfyUI 可以使用哪些 GPU。填写多个编号只是开放这些 GPU;普通工作流通常仍在一张卡上运行,支持多 GPU 的插件或工作流才会同时使用多张卡。
注意力优化
Attention 方案主要影响生成速度和显存占用。ComfyCarry 镜像已经内置 FlashAttention,并在首次部署时默认使用它。工作流运行正常时可以保留 FlashAttention;遇到兼容问题或显存紧张时,再比较其他方案。
Attention 方案
| 选项 | 什么时候选 | 需要注意 |
|---|---|---|
| 默认 | 希望由 ComfyUI 自动选择 | 根据当前环境决定使用哪种方案 |
| PyTorch SDPA | FlashAttention 与当前工作流或插件不兼容 | 兼容范围较广,适合排查问题时切换 |
| Split Cross Attention | 生成图片时显存紧张 | 同时把 xFormers 设为 禁用;速度可能下降 |
| Sub-Quadratic | Split Cross 仍然显存不足,或想比较另一种省显存方案 | 同时把 xFormers 设为 禁用;速度可能下降 |
| FlashAttention | ComfyCarry 日常使用,首次部署默认选择 | 镜像已经内置,适合模型较大、计算量较高的工作流 |
| SageAttention | 首次部署时选择了 SageAttention,并且模型或插件说明推荐使用 | 按模型或插件给出的兼容范围选择 |
SageAttention 需要在首次部署时选择。具体方法见选择 Attention 加速。
xFormers
| 选项 | 什么时候选 |
|---|---|
| 默认 | 插件或旧工作流明确要求 xFormers,并且当前运行正常 |
| 禁用 | ComfyCarry 默认使用 FlashAttention 时保持此项;选择 Split Cross Attention 或 Sub-Quadratic 时也使用此项 |
遇到 Attention 相关报错时,可以在 默认和禁用之间切换一次,再用同一个工作流比较结果。
实验性优化
| 选项 | 什么时候选 |
|---|---|
| 关闭 | 日常生成,优先选择 |
| 启用 | 想比较生成速度时;请使用固定种子和同一个工作流测试 |
启用后如果画面出现明显变化、插件报错或 ComfyUI 退出,改回 关闭。
注意力上采样
| 选项 | 什么时候选 |
|---|---|
| 默认 | 日常生成 |
| 强制上采样 | 使用低精度模型时出现黑图、花屏或异常色块 |
| 禁用上采样 | 排查特定工作流的 Attention 问题时,按插件或模型说明使用 |
精度控制
精度越高,画面通常越稳定,但会占用更多显存;精度越低,显存占用越少,部分模型的颜色或细节可能发生变化。拿不准时,各项都选择 默认。
UNet 精度
UNet 或扩散模型通常占用最多显存。生成时显存不足,可以先从这里尝试更省显存的精度。
| 选项 | 什么时候选 |
|---|---|
| 默认 | 大多数模型,优先选择 |
| FP32 | 排查低精度造成的画面异常;显存占用最高 |
| FP16 | 想减少显存占用,并使用常见 NVIDIA GPU |
| BF16 | 使用 Ampere 或更新架构的 GPU,想在显存和画面稳定性之间取得平衡 |
| FP8 (e4m3fn) | 大模型显存不足,并且模型与 GPU 支持 FP8;通常先尝试这一种 FP8 |
| FP8 (e5m2) | 模型说明明确推荐 e5m2 |
| FP8 (e8m0fnu) | 模型或插件说明明确要求这个格式 |
FP8 出现模型加载失败、颜色变化或细节明显变差时,改回 BF16、FP16 或 默认。
VAE 精度
VAE 影响输入图片处理和最终图片输出。图片变黑、颜色异常,或最后输出图片时显存不足,优先检查这里。
| 选项 | 什么时候选 |
|---|---|
| 默认 | 日常生成 |
| FP32 | 图片变黑、颜色异常或输出阶段出现数值错误 |
| FP16 | 想减少 VAE 占用的显存,并使用常见 NVIDIA GPU |
| BF16 | 使用 Ampere 或更新架构的 GPU,想减少显存占用 |
| CPU | 生成过程可以完成,但最后输出图片时提示显存不足;输出会明显变慢 |
Text Encoder 精度
Text Encoder 负责理解提示词。大型文本编码器占用较高时,可以选择更省显存的精度。
| 选项 | 什么时候选 |
|---|---|
| 默认 | 大多数模型,优先选择 |
| FP32 | 使用低精度后,生成内容明显偏离提示词时用来比较;显存占用最高 |
| FP16 | 想减少显存占用,并使用常见 NVIDIA GPU |
| BF16 | 使用 Ampere 或更新架构的 GPU,希望兼顾显存和稳定性 |
| FP8 (e4m3fn) | 文本编码器占用较高,并且模型与 GPU 支持 FP8 |
| FP8 (e5m2) | 模型说明明确推荐 e5m2 |
如果调整后提示词理解出现明显变化,改回 默认、BF16 或 FP16。
其他精度选项
| 设置 | 什么时候开启 | 可能出现的变化 |
|---|---|---|
| 中间张量 FP16 | 显存紧张,并且前面的显存设置仍然不够 | 可以继续减少显存占用;少数工作流的画面或数值可能变化 |
| Channels Last | 想测试当前 GPU 是否能获得更快速度 | 部分 GPU 会变快,也可能没有变化或稍慢;用同一个工作流计时后决定 |
这两项日常保持 关闭。
工作流缓存
同一个工作流反复生成时,缓存可以减少重复等待,同时会占用一部分系统内存。
| 缓存策略 | 什么时候选 |
|---|---|
| 默认 | 大多数工作流,优先选择 |
| 经典 | 系统内存充足,经常只调整工作流后半部分,希望重复生成更快 |
| LRU | 想限制缓存数量,同时保留最近使用的结果 |
| 禁用 | 系统内存已经很紧张,可以接受每次重新计算 |
选择 LRU 后,再设置 LRU 缓存大小。这里的数字表示保留多少个结果,并不是 GB。
| LRU 缓存大小 | 适合的情况 |
|---|---|
| 16 | 先观察系统内存占用 |
| 32 或 64 | 中等规模工作流反复生成 |
| 128 或 256 | 节点较多,并且系统内存充足 |
数值越大,重复生成时越容易复用上一次的结果,系统内存占用也会更高。
生成过程预览
预览方式决定生成过程中看到的临时画面。
| 预览方式 | 看到的效果 | 什么时候选 |
|---|---|---|
| 自动 | 在速度和清晰度之间自动选择 | 日常生成 |
| 无 | 生成过程中不显示临时画面 | 批量生成或后台运行 |
| Latent2RGB | 显示较快,但画面比较模糊 | 只想提前确认构图和大致颜色 |
| TAESD | 更接近最终图片,显示速度稍慢 | 希望预览更清楚;选择后没有预览画面时,改回 自动 |
预览最大尺寸填写预览图最长边的像素数。0 使用默认的 512 像素;想减少预览占用,可以填写 256;想看清更多细节,可以尝试 768 或 1024。选择 无 时,这项无需设置。

输出元数据
| 输出元数据 | 什么时候选 |
|---|---|
| 写入元数据 | 希望以后从生成文件中找回提示词、种子和工作流;日常使用建议保留 |
| 禁用写入 | 只需要最终图片或视频,并且希望文件中不包含生成信息 |
写入元数据后,把图片拖入 ComfyUI 工作流页面,可以重新读取其中保存的工作流。
内存与磁盘
| 设置 | 选项 | 什么时候选 |
|---|---|---|
| 磁盘优先加载 | 关闭 | 工作区位于机械硬盘或普通 SATA SSD,或当前加载速度正常 |
| 磁盘优先加载 | 启用 | 工作区位于 NVMe,加载大型模型时系统内存占用很高 |
| MMAP 文件映射 | 默认 | 大多数本地模型和本地磁盘 |
| MMAP 文件映射 | 启用 mmap | 较大的 .ckpt 或 .pt 文件占用大量系统内存 |
| MMAP 文件映射 | 禁用 mmap | 模型放在网络磁盘或特殊文件系统中,并且读取时反复报错 |
| Pinned 内存 | 默认 | 系统内存充足,希望模型载入显卡时更快 |
| Pinned 内存 | 禁用 | 系统内存紧张,或开启后其他程序明显变慢 |
磁盘优先加载在高速 NVMe 上更容易带来改善。调整后可以用同一个模型比较首次加载时间和系统内存占用。
文件上传上限
上传上限 (MB) 控制 ComfyUI 工作流页面中单个文件的最大体积。0 使用当前版本默认的 100 MB。
上传视频、高清图片或大型输入文件时,填写略高于文件大小的整数。例如文件大小为 430 MB,可以填写 512;文件接近 1 GB,可以填写 1024。
这个数值只影响 ComfyUI 工作流页面。内容生成页面使用自己的上传上限。
启动命令与额外参数
启动命令会列出这次重启将使用的设置。修改上方选项后,可以在这里确认刚才的调整已经加入。
其中有两项会一直保留:
| 内容 | 含义 |
|---|---|
--listen 0.0.0.0 | 让 ComfyCarry 和 Tunnel 能够连接 ComfyUI,保持默认即可 |
--port 8188 | ComfyUI 使用的端口,通常保持 8188 |
额外命令行参数留给页面尚未提供的特殊选项。模型、插件、教程或技术支持给出完整参数时,按原样填写;多个参数用空格隔开。日常调整直接使用上方选项即可。
页面中已经列出的功能,直接使用上方选项,之后查看和调整会更方便。
保存并应用设置
- 调整需要的选项。
- 点击 保存并重启。
- 等待 ComfyUI 回到 空闲中。
- 用同一个工作流再生成一次,比较显存、速度和画面。
想回到上一次保存的配置,点击 放弃更改。
切换 ComfyUI 版本
| 版本 | 什么时候选 |
|---|---|
| 最新稳定版 | 日常使用和第一次安装,优先选择 |
| Nightly 开发版 | 工作流或插件明确需要尚未进入稳定版的新功能 |
| 其他稳定版本 | 旧工作流或旧插件明确要求某个版本 |
选择版本后点击 切换。确认窗口中还有两种方式:
| 更新方式 | 什么时候选 |
|---|---|
| 仅切换 | 在相近版本之间切换,并且目标版本没有新增依赖 |
| 切换并安装依赖 | 跨越多个版本,或目标版本、插件说明要求安装新的依赖 |
完成后回到运行概览,在 运行环境中确认版本,并查看最新启动日志。插件出现兼容问题时,可以切回之前使用的稳定版本。