最近我在折腾一个叫 Toonflow 的东西。简单说它是一个本地跑的 AI 媒体生成工作台 —— 你可以把各种图片、视频、音频模型接进来像搭积木一样拼自己的创作流水线。问题是Toonflow 自带的模型列表里没有我最想用的那个MiniMax H3。为什么非要 H3如果你关注 AI 视频生成应该听过 “海螺” 这个名字。MiniMax 出的视频模型在人物一致性、动作自然度和电影质感这块目前确实是第一梯队。我之前一直在用 RunningHub 上的云端 ComfyUI 工作流跑 H3—— 打开网页、上传参考图、粘贴提示词、点提交、等两分钟、下载视频。能用但就是每次都得手动操作。我就想能不能把这套流程直接接进 Toonflow让它变成画布上的一个节点拖一张图进来写段提示词点生成完事。首先把RunningHub api调用和toonflow模板给智能体先进行导入。我用的是同时支持首帧和全能参考的MiniMax H3工作流。但是记得要勾选这些。AI应用Minimax H3二采优化速度-self lift-多参考 体验地址https://www.runninghub.cn/ai-detail/2100129733211148290?inviteCodeoga1ahgc在 Toonflow 设置里填入 RunningHub API Key把章节的剧本给toonflow助手自动生成资产图第一次需要后续可以直接复用剧本可以拆成这样的格式toonflow可以一部到位参考。![在这里插入图片描述](https://i-blog.csdnimg.cn/direct/1f62d68a2b404f43a6f0953f20faa867.png)写提示词 —— 按subject_definitions → summary → retention_analysis → detailed_description四段结构(先把minimaxh3 提示词技能安装一下弹窗对话框选时长5 秒、选画幅竖屏 9:16 或横屏 16:9点生成等 5-6 分钟视频直接出现在画布上toonflow还很贴心把15~30s也放在标题这样方便后续查阅。提示词结构是关键。不是随便写一句话就行要像写分镜脚本一样subject_definitions: Picture 1 妖物群像蓝光大狼、金纹黑熊妖、泛白龙、破帽棕袍白猿妖。蓝狼泛蓝光并从卷轴跃出黑熊妖穿佛冠、挂佛珠、周身金色火焰白龙泛白光、从黑雾中探头嘶吼白猿妖穿破帽棕袍、长白胡须、手持古卷轴、周身蓝色寒气。全片不得漂移。 Picture 2 金光小人与仙山构图左侧金色光团化成的长裙发光小人暖金粒子光右侧云海、尖峰仙山、浮空古建岛屿远处黑袍人影剪影。该图只锁金光小人与空间构图不锁死后续人物身份。 Picture 3 百妖图卷轴左右展开的鎏金铜轴古卷轴龙纹云纹黑色墨流漩涡中心金色光团左侧可见“百妖图”三字。全片保留卷轴材质、墨流与文字风格。 summary: 东方玄幻超写实 15 秒百妖图古卷展开金光小人沿墨流飞升妖物从卷中显现修士闭目盘坐群妖俯首围卷整体压迫、神秘、古卷显灵。 retention_analysis: Picture 1妖物锚点完全保留蓝狼蓝光、黑熊佛冠佛珠金纹火焰、白龙白光、白猿破帽棕袍白须与寒气的身份特征不新增妖物不改变数量。 Picture 2构图锚点完全保留金光小人的暖金光体、云海仙山浮空古建的纵深感后续可释放成飞行与墨流道路不锁死静态摆拍。 Picture 3道具/文字锚点完全保留鎏金卷轴、铜轴、墨流漩涡、中心金色光团左侧“百妖图”三字稳定可读古篆/古隶风格不出现现代字体、UI、水印。 详细描述 写实电影风格东方玄幻胶片颗粒暗金、墨黑、云海蓝紫、妖物冷光的色调。15 秒内完成 4 个动作节点全程以特写、近景、中景为主起势即动不做静态摆拍。 0–1s特写左右展开的鎏金铜轴古卷轴占据画面左侧卷轴上“百妖图”三字清晰可见黑色墨流在卷轴间旋转成漩涡漩涡中心一点金色光团亮起。 1–3s镜头顺墨流推入全景金色光团化成长裙发光小人小人上方黑色墨流迅速扩大为长条巨幅黑影墨流旋成高速漩涡带起金粒子。 3–5s镜头切远景跟拍黑影铺成向前延伸的墨色道路金光小人裹着金光沿道路高速飞行前方是云海中的尖峰仙山与浮空古建岛屿镜头保持快速前冲但不失稳定。 5–9s镜头推近金色龙纹光轮光轮顶部出现金色仙宫造型数道黑色墨流从四周刺向光轮中心的小人同时金光爆发闪过人物眼部特写随后切近景移镜蓝光巨狼从卷轴跃出黑熊妖自卷面显现周身金色火焰升腾。 9–13s切近景白龙从黑雾中探出头嘶吼紧接着白猿妖手持古卷轴显现蓝色寒气外扩再切中景黑红古风长袍修士闭目盘坐于地面身后浮现持火金巨妖、黑熊妖、蓝狼妖虚影金色卷轴碎片从修士肩头缓缓飘过。 13–15s镜头拉成全景修士周身环绕蓝虎、赤火虎、白龙、白狼、黑熊、红狮等群妖所有妖物围着中心小卷轴俯身墨流回落为暗金纹路画面停在群妖俯首、卷轴悬空的压迫静帧。 声音规则BGM 按画面强度生成0–3s 低频风雷与古卷墨流声推进3–7s 金光飞行加入弦乐上扬7–11s 妖物嘶吼与火焰/寒气声增强11–15s 群妖俯首时保留低频鼓点与卷面纸纹摩擦。人物对话音频仅用于对白/人声不加入额外台词。 文字规则必须包含左侧卷轴上的“百妖图”三字古篆/古隶风格稳定清晰不生成其他字幕、标题、UI、水印、说明卡不出现现代字体文字不遮挡金光小人、墨流漩涡、妖物双眼与锁链。 负面约束绝对禁止额外字幕、画面文字、LOGO、水印、多余手指、畸形手部、多肢体、穿模禁止角色变脸、换装、瞬移禁止慢动作长镜头禁止无来源新增妖物或改变妖物数量。retention_analysis这段特别重要 —— 它告诉模型 “什么必须保留不变”否则生成出来的人物脸会漂。其实这些都能复用RunningHub 的 API 不复杂提交任务拿 taskId然后轮询查询接口等结果。如果你也在用 RunningHub Toonflow或者想把其他 ComfyUI 工作流接进来核心就三件事搞清楚每个节点接受什么格式——LoadImage 只要文件名文本节点随便传异步任务要轮询—— 提交后别只返回 taskId要在方法内部等到 SUCCESS 再返回结果Bun 环境没有 atob/btoa—— 用 Buffer 代替现在想复刻爆款视频不用再开浏览器跑网页了。画布上拖拖图、写两句话视频就出来了。你有没有用过 Toonflow 或者类似的 AI 创作工作台接模型的时候踩过什么坑评论区聊聊。