大模型的指令遵循Instruction Following指模型能否准确、完整地执行用户/系统指令中给定的约束而不只是答得对。它考察的是对指令细节的忠实度典型维度约束遵循字数限制、格式要求JSON/表格、禁止项“不要解释”多指令遵循一条 prompt 里同时给 3~5 条指令能否全部满足而不遗漏顺序/优先级遵循先做什么后做什么、冲突时听谁的边界遵循不越权、不执行被禁止的操作格式遵循输出 schema、字段名、枚举值是否严格匹配注意区分指令遵循 ≠ 能力正确。模型可能答对了内容却违反了格式比如要求 JSON 却输出散文或格式对了却漏了某条约束。两者都要评估。为什么它是 Agent 可靠性评估的关键指标1. Agent 的每一步都依赖指令遵循Agent 是系统提示词 工具 schema 每步反馈驱动的闭环。系统提示词本身就是一长串指令角色、边界、输出契约、工具协议。模型若不能忠实遵循后续所有步骤都会跑偏。2. 误差会沿链路累积放大单轮对话里一次没遵循只是答得不好在 Agent 多步循环里某一步漏掉约束如没按 schema 输出、越权调用了工具会污染后续所有决策最终导致任务失败甚至危险操作。3. 直接决定可编程性Agent 的可靠性建立在模型输出可被程序解析、可被 guardrail 校验之上。指令遵循差 → 输出格式漂移 → 解析失败 → 需要重试/降级 → 稳定性崩塌。指令遵循是模型可被当作程序组件使用的前提。4. 是安全与边界控制的基础Agent 的安全依赖禁止项被忠实执行。若模型不遵循禁止删除生产数据敏感操作需确认这类指令再强的 guardrail 也拦不住。指令遵循弱 安全边界形同虚设。5. 可量化、可回归指令遵循有明确的通过/失败判定格式对不对、约束有没有满足适合做成 benchmark如 IFEval、FollowBench在 CI 中做回归测试——这是 Agent 可靠性工程化的关键。一句话Agent 本质是用指令驱动模型完成多步任务而指令遵循决定了模型能否忠实、可复现地执行这套指令协议。它既是可编程性的前提也是安全边界的根基因此是评估 Agent 可靠性的核心指标。