出图问题
SD · MJ · 即梦 · 可灵图像01生成图全黑 / 全灰 / 单色→ 切对 VAE+
原因
VAE 错配或缺失(SD 1.5 模型用了 SDXL VAE)。
解法
WebUI → Settings → Stable Diffusion → VAE: SD 1.5 选 vae-ft-mse-840000-ema-pruned.safetensors;SDXL 选 sdxl_vae.safetensors。
02CUDA out of memory(显存爆)→ --medvram --xformers+
快捷
webui-user.bat 加 --medvram --xformers;4GB 显卡加 --lowvram。
代码层
pipe.enable_model_cpu_offload() / enable_sequential_cpu_offload() / enable_attention_slicing();加载 torch_dtype=torch.float16。
03prompt 写清楚,图不跟→ CFG 7-12+
CFG < 3 模型自由发挥;CFG > 15 图像僵硬过曝。CFG 7-12 是甜区。
prompt 写法:"好看的风景" → "阳光明媚的阿尔卑斯山,清澈湖泊,远雪山景,8K 摄影级",立刻见效。
04图像模糊 / 细节丢失→ 步数 30+ + 换 VAE+
步数调到 30-50;换 stabilityai/sd-vae-ft-mse(SD 1.5 标准 VAE)。
img2img upscale 二次补救,strength 0.3。要真画质上 SDXL。
05生成超慢 / 实际用 CPU→ 检查 device: cuda:0+
启动 console 找 Model loaded on device: cuda:0;显示 cpu = GPU 没识别。
nvidia-smi 看不到卡 = 驱动装错。
PyTorch CUDA 不匹配:pip uninstall torch torchvision → 装 cu121(按显卡 CUDA 版本选)。
ComfyUI / 工作流
节点 · 工作流 · 高难度 issue 10 个真难题06节点红框 / INVALID→ Manager 装缺失节点+
70%:导入工作流时缺自定义节点 → Manager → Install Missing Custom Nodes → 重启 ComfyUI。
20%:连线类型不匹配 → VAE Encode/VAE Decode 转换。
10%:SDXL LoRA 接到 SD 1.5 checkpoint。
07CUDA OOM(ComfyUI 跑一半炸)→ --fp8_e4m3fn-unet+
启动加 --fp8_e4m3fn-unet(显存减半);工作流内 Tiled VAE Decode;降分辨率;重启清碎片。
--fp8_e4m3fn-unet + Tiled VAE 直接稳了。08"Expected BFloat16 but found Float"→ --force-fp16+
ComfyUI 内部精度与模型精度不匹配。启动加 --force-fp16 强制统一。
09start 卡住 / UI 加载不出→ 改 offline mode+
Manager 卡:config.ini 设 network_mode = offline。
encoding 错:设 PYTHONUTF8=1 + PYTHONIOENCODING=utf-8。
探活:curl http://127.0.0.1:8188/system_stats,有响应 = core 起来了,问题在 frontend。
10🔥 难题:Wan 2.2 14B(I2V)sampler 发出 NaN latents→ --bf16-unet 别用 float16+
症状
Wan 2.2 14B (I2V) sampler 发出 NaN latents → 每帧一个纯色。
AMD gfx1201(Radeon AI PRO R9700)+ ROCm 7.2.4 + torch 2.14/2.15 上稳定复现。
5B 模型同样节点图能正常跑。
解法
启动加 --bf16-unet(bf16 的 exponent 比 fp16 宽得多,扛得住溢出)。
升级 ComfyUI 到 0.36.0+(该 issue 在后续 patch 修)。
11🔥 难题:Qwen-Image 2.1 在 1024×1024 出 broadband noise→ 改 992 或 1056 避开+
症状
Qwen-Image-2.1 image edit 的 VAE reference-latent splice 节点:
resolution = 1024(节点默认值)时输出 broadband noise;
992 / 1056 完全干净;CPU 也复现。
解法
硬编码 resolution = 992 或 1056,绕开 node 默认值。
关 --enable-dynamic-vram(2026-09 更新后该 flag 静默损坏输出)。
跟踪 patch:PR #15027 fast-disk policy。
12🔥 难题:H3 plain bf16 checkpoints 100% 黑帧→ 改用 int8_convrot repack+
症状
H3 plain bf16 checkpoints(full + pruned)在 v0.32.0 上 100% 黑帧;
同样权重的 int8_convrot repacks 正常。
解法
下载 H3 int8_convrot 版本而不是 plain bf16。
升 ComfyUI 到 0.36.0+(修了 plain bf16 的 fp16 处理路径)。
不要用 minimax_h3_ref2va_pruned_fp8_scaled(metadata 已损坏)。
13🔥 难题:H3 W4A8 + LoRA 在 0.36.0 之前 patches 错权重→ 升 0.36.0+ 或不用 LoRA+
症状
Quantized(W4A8)H3 + LoRA 在 0.36.0 之前会 patch adaln_proj,但权重还在 packed 形状;
生成混乱但没崩。
解法
升 ComfyUI 到 0.36.0+(修了 dequant/cast 顺序)。
临时方案:卸 LoRA,跑裸 H3 W4A8。
14🔥 难题:ImageUpscaleWithModel 给 17.9 MB 模型预留 4.83 GB→ 关 dynamic-vram 重新加载+
症状
ImageUpscaleWithModel 节点给一个 17.9 MB 模型预留 4.83 GB 显存;
同时驱逐其他已加载模型 → 后续节点 OOM。
解法
关 --enable-dynamic-vram。
重新加载大模型时调高优先级。
用更轻的 upscaler(如 4x-UltraSharp)。
15🔥 难题:ACE-Step 1.5 集成 OOM Windows/AMD→ 关 Desktop auto-update + 升 0.36.0+
症状
ACE-Step 1.5 Integration Memory Leak / CPU Fallback → Windows/AMD 严重慢 + OOM。
12 条评论 + linked PR。
解法
升 ComfyUI 到 0.36.0+(相关 PR 已合并)。
关 ComfyUI Desktop 的 auto-update(它会强制升级到不兼容版本)。
AMD 显卡加 --use-pytorch-cross-attention。
视频生成
可灵 · 海螺 · Sora · Veo · H3 · Seedance 3 个真难题16图生视频角色脸漂移→ start+end frame + IP-Adapter+
同时给 start + end frame(可灵 2.0 / 海螺 02 支持)。
ComfyUI:IP-Adapter + FaceID 锁脸,一致性 80% 提升。weight 0.8+,reference 清晰正面。
17运镜不自然 / 镜头僵→ 人物眼神跟随镜头+
运镜中人物眼神必须跟随镜头:crane-up 眼睛抬起,orbit 扫过镜头,push-in 直视镜头。
写法:"the woman's eyes slowly follow the camera movement"。
21Seedance 2.0 视频人物脸部突变 / 性别撕裂→ start frame 必须为正面+
症状
Seedance 2.0(图生视频)前 1.5 秒人物脸部会从 input 图的男性突变到女性,
或五官错位 / 肤色突变 — 火山引擎 i2v 模型自回归解码早期最常见。
解法
start frame 必须为正面、无遮挡、清晰大脸(占图面 30%+),不要用侧脸 / 半遮挡 / 多人物。
跑前用 face_detect 校验:脸部面积 < 20% 直接换图。
紧急方案:改用 Seedance 2.5,2.5 加了第二人称 prompt + face anchor,突变率从 30% 降到 8%。
22Seedance 2.5 多图生视频镜头跳跃 / 失帧→ 同场景 ≤ 3 张图+
症状
Seedance 2.5 的"multi-image to video"输入 4+ 张图时,镜头在帧间会突然跳切,
镜头位置 / 视角不一致,看起来像 3 段不同视频拼接。
解法
同场景多图生视频:输入图控制在 ≤ 3 张,且全部同景别 / 同视角(全是正面中景,或全是俯拍远景)。
prompt 显式写"同一镜头 / continuous shot / no cut"。
不支持 5+ 图输入时:把第 4+ 张图拆成第二个 5 秒视频,后期剪映接上。
18🔥 难题:H3 i2v 输出"独立瓦片方阵"图→ 升 0.36.0+ 修 latent 解码顺序+
症状
H3 i2v 输出是独立解码的正方形瓦片拼成的大图,而不是一张连贯图像。
因为 latent 解码顺序 bug。
解法
升 ComfyUI 0.36.0+(修了 patchifier 的对称解码)。
临时方案:换 LTX-2.3 或 Wan 2.2 跑视频。
不要用 SymmetricPatchifier 节点 + H3 组合。
19🔥 难题:H3 AudioVAE 把音频 leading samples 吃掉→ 别 i2v + audio combo;单独跑+
症状
H3 AudioVAE input 是 center-cropped,丢开头的音频样本,导致 latent 长度不对 → 视频前几帧无声。
解法
不要用 i2v + standalone audio-timbre reference combo,先单独跑 audio。
升 0.36.0+(修复部分 patch 已合并,但还没全修)。
Audio latents 直接对齐 — 用同一份 wav 文件,不用 timestamp 对齐。
20🔥 难题:H3 _forward 阻止 CUDA graph capture→ H3 跑时关 graph capture+
症状
H3 _forward 函数每步做 per-step GPU→CPU sync(sigma_v / text_tags),
每步都阻塞 CUDA graph capture,完全无法用 graph capture 加速。
解法
跑 H3 时 关 CUDA graph capture(从 0.36.0 起有开关)。
临时:用 batch_size ≥ 4 跑批,弥补单步同步损耗。
CPU→GPU H2D copy 在 SymmetricPatchifier 同样阻塞 — 同步处理。
发布投流
千川 · 完播率 · ROI23投流 ROI < 1.0 怎么办→ 暂停 + 自然流测试+
ROI < 1.0 立即止损,暂停该计划,自然流测试涨粉。自然流爆款再投流。
24完播率低(< 30%)→ 钩子 / 中段 / 结尾+
3 大杠杆:钩子(3 秒留人)/ 中段节奏(每 15 秒反转)/ 结尾悬念。
60 秒以下完播率 > 30% 才及格,> 50% 才推流。
25账号封号 / 限流→ 不踩红线 + 多账号矩阵+
常见封号:未成年人脸、同质化内容、低质搬运、敏感词、AI 脸部虚假宣传。
预防:多账号矩阵、玉哥 H 类投流 SOP。
26千川没量 / 0 展现→ 出价 + 定向双排查+
出价太低:参考同行出价区间。
定向过窄:简化定向,系统算不出 100 人就不跑。
素材原创度 < 60% 直接限流。