| 图片 | 发型 | Plan A (9B) | Plan B+ (4B) | 差值 | 胜者 |
|---|---|---|---|---|---|
| girl1.jpg | 椭圆 | 9.41s | 7.69s | -1.72s | B+ 快 |
| girl1.jpg | 花瓣 | 10.51s | 8.77s | -1.74s | B+ 快 |
| girl1.jpg | 心形 | 10.49s | 9.07s | -1.42s | B+ 快 |
| girl1.jpg | 直线 | 10.45s | 8.73s | -1.72s | B+ 快 |
| girl1.jpg | 波浪 | 10.85s | 8.81s | -2.04s | B+ 快 |
| girl7.jpg | 椭圆 | 7.91s | 7.04s | -0.87s | B+ 快 |
| girl7.jpg | 花瓣 | 7.81s | 6.67s | -1.14s | B+ 快 |
| girl7.jpg | 心形 | 7.74s | 6.73s | -1.01s | B+ 快 |
| girl7.jpg | 直线 | 8.17s | 6.96s | -1.21s | B+ 快 |
| girl7.jpg | 波浪 | 7.92s | 6.74s | -1.18s | B+ 快 |
| girl13.jpg | 椭圆 | 8.95s | 7.62s | -1.33s | B+ 快 |
| girl13.jpg | 花瓣 | 9.07s | 7.84s | -1.23s | B+ 快 |
| girl13.jpg | 心形 | 8.82s | 7.83s | -0.99s | B+ 快 |
| girl13.jpg | 直线 | 8.84s | 7.59s | -1.25s | B+ 快 |
| girl13.jpg | 波浪 | 8.96s | 7.77s | -1.19s | B+ 快 |
| 项 | Plan A (9B) | Plan B+ (4B) |
|---|---|---|
| ComfyUI 模型 | flux-2-klein-9b-fp8 | flux-2-klein-4b-fp8 |
| 文本编码器 | qwen_3_8b_fp8mixed | qwen_3_4b |
| 模型大小 | 8.8GB + 7.7GB = 16.5GB | 3.8GB + 7.5GB = 11.3GB |
| ComfyUI --gpu-only | ❌ 关闭(开则 OOM) | ✓ 开启 |
| 工作流 steps | 4 | 4 |
| SEG_DEVICE | cuda | cuda |
| 平均耗时 | 9.06s | 7.72s |
| VRAM 稳态 | 26-28GB(模型频繁换出) | 25-28GB(稳态) |
| 关键问题 | 开 --gpu-only 会 OOM(webui:57860 推理失败) | 稳定 |
✅ 出图质量:9B 和 4B 在视觉上几乎无差异(5 种发型 × 3 张图共 15 组对比)
✅ 出图速度:4B 平均 7.72s,9B 平均 9.06s,4B 快 1.34s
✅ 显存稳定性:9B 必须关闭 --gpu-only 才能跑通(否则 swapHair 调用链中 webui:57860 推理 OOM),4B 可开启 --gpu-only 实现稳态常驻
✅ 综合建议:使用 Plan B+(4B + --gpu-only + SegFormer GPU),既保证出图质量又最大化性能
⚠ 9B 局限:9B 必须关闭 --gpu-only → 每次调用 9B 模型都要 GPU↔CPU 换出 → 稳态下 VRAM 抖动 26-28GB,且接口3 步骤多时会 OOM