三级自主权模型
概述
三级自主权模型是人机协作协议的核心框架,根据操作风险等级定义 Agent 的自主程度:完全自主、请求确认、强制人工介入。
关键内容
-
级别 1(完全自主):适用于日常编码任务,如添加新功能实现、编写测试、修复明确的 Bug。Agent 自主执行并记录到日志,无需人工干预。这对应传统工作流中的确定性任务。
-
级别 2(请求确认):适用于架构性决策,如添加新依赖、修改核心数据结构、重构模块。Agent 暂停执行,展示方案并等待人工确认。这体现了 Harness 在灵活性和安全性之间的平衡。
-
级别 3(强制人工介入):适用于高风险操作,如删除现有功能、修改数据库 schema、变更认证逻辑。Agent 完全停止,明确请求人工审查。这是安全底线,防止不可逆的破坏性操作。
-
与 Agent vs Workflow 的关系:三级自主权模型是 Agent 与 Workflow 混合使用的具体实践——级别 1 偏向 Workflow 的确定性,级别 3 偏向人工控制的 Workflow,级别 2 是 Agent 自主决策与人工审核的混合点。
-
修复循环的自动升级:在 持续验证循环 中,如果修复尝试超过 3 次失败,自动触发级别 2 协议(请求确认),防止 Agent 在无效修复中浪费资源。
来源
- 14_harness_design_long_running.md — 第三节"人机协作协议",三级自主权模型章节
相关
- Harness 设计 — part_of (是人机协作协议的核心)
- Agent vs Workflow — relates_to (Agent 与 Workflow 的混合实践)
- 持续验证循环 — relates_to (修复失败时自动升级自主权级别)
- ACI 设计原则 — relates_to (人机交互接口设计)