简介这份资源面向使用 ComfyUI 进行 AI 绘画与剧情分镜创作的进阶用户聚焦 QwenImageEdit 模型在多角度剧情分镜图生图场景中的工作流配置。它解决的是分镜角色视角切换、镜头连贯性难以稳定复现的问题适合已有 ComfyUI 基础、希望把文生图能力延伸到漫画分镜与故事板制作的创作者。压缩包内共 1 个文件为单个 json 格式的工作流配置整体约 12KB体量轻巧导入 ComfyUI 后即可复用其中的节点连接与参数设定省去从零搭建多角度分镜流程的时间。目前已有 595 人学习下载说明该工作流在分镜创作群体中具备一定参考价值。读者可借此理解 QwenImageEdit 在多视角一致性上的节点组织方式并以此为模板替换提示词与参考图快速产出连贯的剧情分镜画面同时对照自身工作流排查参数与连线问题。1. 多角度剧情分镜为什么总在“第二张图”翻车做剧情分镜的人都遇到过这个场景第一张图主角站姿完美、光影到位你满心欢喜地改一句提示词想换个机位结果第二张图脸变了、衣服换了、连场景都跑到另一个次元。ComfyUI 配 QwenImageEdit 这套组合解决的正是这个痛点——它把“图生图”从单张抽卡变成可控的多角度连续分镜生产。QwenImageEdit 是通义千问团队推出的图像编辑模型在 ComfyUI 里以节点形式接入后能基于一张参考图做指令式编辑保留主体一致性的同时改变视角、姿态和构图。这套方案适合做短剧分镜、漫画分镜、电商多角度展示的从业者尤其是那些已经被“每张图都要重新抽卡”折磨过的人。它不追求一步到位的电影级成片而是让你用工作流把“同一角色、不同机位”这件事批量化、可复现。下面从环境搭建讲到多角度控制再讲我踩过的坑。2. ComfyUI 接入 QwenImageEdit 的环境与节点准备2.1 为什么选 QwenImageEdit 而不是纯文生图纯文生图做分镜的根本问题是“不可控”。你写“主角侧面回头”模型给你正面、侧面、背影各来一张角色一致性全靠运气。QwenImageEdit 的定位是图像编辑模型输入是参考图加编辑指令输出是在保留原图主体特征前提下的修改结果。这意味着你可以拿第一张定妆图作为锚点后续每一张分镜都从它出发只改视角描述角色的脸型、发型、服装配色会被尽量保留。选它还有几个现实理由。第一它在 ComfyUI 生态里有现成节点封装不需要自己写推理脚本。第二它对中文提示词的理解比多数开源图生图模型好做剧情分镜时描述“镜头拉远、角色左转四十五度、背景换成黄昏街道”这类复合指令命中率明显更高。第三它支持较高的参考图权重调节你可以控制“像原图”和“听指令”之间的平衡这个参数在后面多角度控制里是关键。常见做法是先用文生图或图生图产出一张高质量的角色定妆图把它作为整个分镜序列的参考基准。不要拿一张模糊的、构图混乱的图当参考QwenImageEdit 会忠实地把混乱也继承下去。2.2 本地部署与国内源切换ComfyUI 的安装方式很多秋叶整合包是新手最省事的选择它把 Python 环境、常用插件和模型目录都配好了。如果你已经有 ComfyUI 环境只需要补 QwenImageEdit 相关节点和模型。下面是我一般会走的流程。# 进入 ComfyUI 根目录确认 custom_nodes 存在 cd ComfyUI ls custom_nodes # 用 git 拉取 QwenImageEdit 节点封装以常见社区节点为例 cd custom_nodes git clone https://github.com/xxx/ComfyUI-QwenImageEdit.git # 如果国内拉取慢先配置 git 代理源或使用镜像 # 注意这里只改 git 的 remote不涉及任何网络工具 git config --global url.https://gitclone.com/github.com/.insteadOf https://github.com/拉取完成后重启 ComfyUI在节点列表里搜索 Qwen 应该能看到对应节点。模型文件需要单独下载放到ComfyUI/models/qwen或节点文档指定的目录。模型体积不小下载前先确认磁盘空间虚拟内存不足会导致加载时直接崩溃这一点在 8G 显存机器上尤其明显。# 查看模型目录结构确认放置位置 ls -lh ComfyUI/models/qwen/ # 如果显存紧张启动时加低显存参数 python main.py --lowvram --preview-method none参数说明--lowvram会把部分模型层卸载到内存牺牲速度换稳定--preview-method none关闭预览节省显存。如果你的机器有 12G 以上显存可以不加这两个参数出图速度会快不少。国内源切换主要针对 pip 安装依赖在 ComfyUI 的 python 环境里执行pip config set global.index-url https://pypi.tuna.tsinghua.edu.cn/simple即可避免装依赖时卡住。2.3 最小可跑通工作流搭建先不要急着做多角度用一张图跑通“参考图 编辑指令 → 输出图”的最小链路。工作流节点顺序是加载图像 → QwenImageEdit 编码 → 文本编码正向指令 → 采样器 → VAE 解码 → 保存图像。# 这是节点连接逻辑的伪代码示意实际在 ComfyUI 界面连线 # 1. LoadImage 节点载入参考图 # 2. QwenImageEditEncode 节点输入参考图输出条件 # 3. CLIPTextEncode 节点输入编辑指令如角色向左转侧面视角 # 4. KSampler 节点连接上述条件设置步数20CFG 4.5 # 5. VAEDecode → SaveImage关键参数采样步数建议 20 到 28太低细节糊太高收益递减还慢。CFG 值在 QwenImageEdit 上不要开太高4 到 6 之间比较稳超过 8 容易出现过饱和和结构崩坏。参考图权重有些节点叫 image strength 或 denoise是核心做多角度时我一般设在 0.55 到 0.75太低角色就跑偏太高视角改不动。跑通第一张后把参考图固定只改文本指令里的视角描述连续出三到五张观察角色一致性。如果第一张就崩先检查模型是否放对目录、节点是否报错而不是急着调参数。3. 多角度分镜的提示词结构与视角控制3.1 分镜指令的四个组成块多角度分镜的提示词不能像文生图那样堆形容词它需要结构化。我一般把指令拆成四块视角块、动作块、环境块、风格块。视角块放最前面因为 QwenImageEdit 对开头词更敏感。视角块写机位和角度比如“侧面视角、四十五度俯拍、近景特写、背面视角”。动作块写角色在做什么“回头、抬手、低头看手机”。环境块写背景和光线“黄昏街道、室内暖光、雨天”。风格块写画面质感“电影感、写实、柔和阴影”。四块之间用逗号分隔不要写成一句话长句模型对短句组合的响应更准。一个实际例子参考图是角色正面站立你想出侧面回头。指令写“侧面视角角色向左回头黄昏街道背景电影感写实风格”。不要写“请把角色变成侧面并且回头看着镜头”这种祈使句反而容易让模型困惑。3.2 参考图权重与视角强度的平衡这是多角度分镜最核心的参数博弈。参考图权重高角色像但视角改不动权重低视角能改但角色开始漂移。我的经验是分两步走先固定一个中等权重0.65 左右出图看角色是否保留、视角是否变化。如果角色保留好但视角没变降权重到 0.55如果视角变了但脸崩了升到 0.72 并检查参考图质量。还有一个技巧是用两个参考图输入。有些 QwenImageEdit 节点支持多图参考你可以把角色定妆图和一张目标视角的构图参考图同时输入前者管角色一致性后者管机位。这个做法在社区工作流里叫“双参考”实测比单图调权重更稳。# 双参考节点连接示意 # LoadImage(角色定妆图) → QwenImageEditEncode(主参考) # LoadImage(视角构图参考) → QwenImageEditEncode(辅助参考) # 两个 encode 输出合并到同一条件输入 # 主参考权重 0.7辅助参考权重 0.3参数说明主参考权重控制角色特征继承辅助参考权重控制构图和视角。辅助权重不要超过 0.4否则角色会被构图参考图带跑。如果节点不支持双参考就老老实实调单图权重别硬凑。3.3 批量出图的队列与命名管理分镜不是一张一张出的是十几张一起排。ComfyUI 的队列功能可以一次提交多个提示词但默认命名是时间戳后期整理很痛苦。我一般会在保存节点前加一个文本节点把镜头编号写进去或者用支持自定义文件名的保存节点。# 出图后按镜头编号重命名方便剪辑软件导入 cd ComfyUI/output i1 for f in *.png; do mv $f shot_$(printf %03d $i).png i$((i1)) done这段脚本把输出目录里的图按顺序重命名成 shot_001 到 shot_xxx。注意执行前先备份或者确认目录里只有本次分镜的图。批量出图时显存容易累积占用建议每出五到八张重启一次 ComfyUI或者用--lowvram模式跑虽然慢但不会中途崩。4. 避坑多角度分镜里最常见的五个翻车点4.1 角色脸崩参考图权重和分辨率不匹配现象第一张图脸很好第二张开始脸变形、五官错位。原因通常是参考图分辨率和输出分辨率差距太大模型在缩放时丢失了面部特征。解决方法是把参考图先裁剪到和输出接近的分辨率比如输出 1024x1024参考图也裁成 1024x1024 的正方形不要直接拿 4K 大图往里塞。另外参考图权重不要低于 0.5低于这个值角色特征基本保不住。4.2 视角改不动提示词顺序和权重冲突现象写了“侧面视角”出图还是正面。原因有两个一是参考图权重太高模型不敢改二是视角词放在提示词中间被后面的风格词淹没了。解决方法是把视角词提到指令最前面同时把参考图权重降到 0.55 到 0.6 之间。如果还不行在负面提示词里加“正面视角、对称构图”逼模型往侧面走。4.3 背景跟着角色一起漂移现象只想改角色视角结果背景从室内变成室外。原因是环境块描述太模糊模型自由发挥。解决方法是在环境块里写具体锚点比如“同一间咖啡厅、靠窗座位、木质桌面”而不是只写“室内”。如果背景一致性要求极高可以用局部重绘节点把背景区域遮罩掉只让模型改角色区域。4.4 显存溢出导致中途崩溃现象出到第三张或第四张时 ComfyUI 报显存错误队列中断。原因是每张图的中间张量没有及时释放累积占用。解决方法是启动时加--lowvram或者在每张图之间加一个清理缓存的节点。Windows 机器还要检查虚拟内存建议设到物理内存的 1.5 倍以上QwenImageEdit 加载时峰值占用不低。4.5 输出图色彩和参考图不一致现象角色姿势对了但肤色偏黄或偏冷和定妆图对不上。原因是 VAE 解码时的色彩偏移或者采样器 CFG 太高导致过饱和。解决方法是把 CFG 降到 4 到 5并在工作流里加一个色彩匹配节点用参考图的色调去校正输出图。如果节点不支持后期在剪辑软件里统一调色也行但前期能对齐就对齐。5. 用 ControlNet 辅助锁定构图与进阶验证多角度分镜做到后面你会发现光靠提示词和参考图权重机位控制还是有点玄学。这时候可以引入 ControlNet 的 OpenPose 或 Depth 分支用一张目标视角的骨架图或深度图来硬约束构图。具体做法是先用简单几何体摆出目标机位截一张深度图把它接到 ControlNet 节点权重设 0.4 到 0.6和 QwenImageEdit 的条件并联输入采样器。这样角色特征由 QwenImageEdit 保机位由 ControlNet 保两者分工明确。验证一套分镜是否合格我一般看三个指标。第一角色面部特征在连续五张里的相似度肉眼能认出是同一个人。第二视角变化是否符合预期该侧面的不给你正面。第三背景锚点是否稳定不能每张都换场景。三个都过这套工作流才算能用于实际项目。# ControlNet 并联接入示意 # QwenImageEditEncode → 条件A # ControlNetApply(OpenPose) → 条件B # 条件A和条件B合并 → KSampler # ControlNet 权重 0.5Qwen 参考权重 0.65参数上ControlNet 权重不要超过 0.7否则角色会被骨架图带得僵硬。Qwen 参考权重可以适当升到 0.7因为构图有 ControlNet 兜底了。这套组合我用来做短剧分镜十张里能稳定出七到八张可用剩下两三张微调提示词重跑就行。最后说个习惯每次开新项目先花十分钟做一张角色定妆图把它存成模板参考图后面所有分镜都从它出发。不要中途换参考图换了就等于重新抽卡。这个习惯帮我省了至少一半的重跑时间。希望帮到你。本文还有配套的精品资源点击获取