
让 AI 生成一段视频最尴尬的结局不是生成失败而是它把你以为早就翻篇的那句视频还没好吗问了几十遍问到没电。这篇文章讲系统是怎么拦下它的。一、先铺垫AI 的工作节奏想一轮花一格电AI 用工具干活不是一次性的而是一个循环想一步 → 调工具 → 看结果 → 再想一步 → 再调……每一轮都要动用一次大模型推理。所以系统给每次会话设了一个迭代次数预算一轮花一格花完就强制收工——这是防止它无限循环烧钱的保险丝。记住预算这个设定它是整个故事的赌注。二、慢任务不发等待卡发取餐码图片和视频生成是分钟级的慢活。系统不会让工具傻站在原地等到完成——那会把整批工具调用都堵死。视频生成工具的做法是有界等待内部最多盯 8 分钟每 5 秒查一次到时候还没渲染完就把一个取餐码交还给 AI{status:pending,taskId:xxx}工具说明里也写得明白想查进度带着这个 taskId 再调一次同一个工具。像奶茶店饮品没做好给你个小票回头再问。MCP 接入的异步任务同理——很多远程工具返回的就是RUNNING这类进行中状态等着 AI 稍后再来查。图 1慢任务的正确姿势是给一张取餐码不是原地罚站。三、风暴AI 没有时间这个概念设计到这里都挺合理直到你意识到一件事AI 的世界里没有秒表。它的两次回合之间只隔一次推理模型想等 30 秒再问和立刻再问花的是几乎一样的时间。于是它非常自然地立刻带着同样的参数再调一次 → 还是一句 pending → 再调 → 还是 pending……每一圈的代价是一格迭代预算加一次真金白银的模型调用产出是零。预算烧完保险丝熔断循环结束——用户只看到一个没头没尾的回答视频还在后台慢慢渲染。像一位顾客每隔十秒问一次我的奶茶好了吗问到打烊奶茶还没好而他一口都没喝上。图 2结果一个字没变预算一格一格少。四、侦探的规矩不看问了几次看连着几次得到一模一样的答案系统为此装了一个重复调用侦探ReInvocationDetector它蹲在每轮工具执行结束的地方规则简单到近乎朴素观察到的情况动作同一工具、同一参数、结果一字不差连击数 1参数变了 / 结果变了 / 调用被跳过或转去等用户归零连击到2WARN口头提醒连击到3 及以上ESCALATE加重语气两个容易误会的地方。第一它数的是连续不是累计——查任务 A、查任务 B、再查 A不算重复因为第二次查 A 时结果可能真的变了结果一变警报自动解除所以正常的隔一会儿再查完全不会被冤枉。第二它管的是所有工具不管是内置的视频生成还是 MCP 转来的异步接口在侦探眼里都只是名字 参数 结果。五、劝阻的方式不断电而是递上三条出路侦探抓到现行之后不会掐断调用而是往对话里插一条只有 AI 看得见的旁白系统称之为 steering 消息“你用相同参数重复调用工具得到了完全相同的结果已连续 2 次。在没有证据表明重试会有帮助之前避免立即重复这些调用。”到 ESCALATE 级别语气会变成重复仍在继续请改变下一步行动并附上三条具体的出路等一会儿再查——现场有 bash 工具的话去做一次限时的 sleep等完再查且不许把等和查混在同一批调用里换个思路——调整参数、换方法或者坦白卡在哪去问人——如果继续等还是放弃轮不到 AI 自己做主就单独调用 ask_question“视频还在渲染要继续等待还是停止”第三条是硬闸门ask_question 一触发整个循环真的会暂停页面把问题抛给你AI 从此没电可烧——决策权交还到人。图 3旁白给的从来不是不许问而是问之前先选一条路。六、一句话总结这套机制没有禁止 AI 催单它只是把催单的代价摆到 AI 面前再把要不要继续等从模型的瞎猜变回人的决定。好的护栏不是路障是路牌。普通使用者记住两件事AI 突然问你继续等还是停止不是客套。那是侦探确认它即将原地打转把决策权交还给你——长视频值得等临时改个头像不值得就停。回答到一半戛然而止八成是预算烧完了。迭代次数是最常见的隐形天花板催单风暴又是烧预算最快的方式之一重开一轮或者把任务拆小比盯着它更有用。