团队想把一个“给建议”的 Copilot 升级成能自动执行任务的 Agent,你会怎样决定自动化到哪一步?
考察说明
考查 Agent 自主程度和产品责任边界设计。
回答思路
- 按动作的可逆性、金额影响、权限范围和错误可发现性分级,低风险查询与草拟可以更自动,高风险写操作必须严格受控。
- 分析用户当前是否能够判断建议正确,如果专业判断仍完全依赖用户,就不能仅因增加确认按钮而宣称风险已解决。
- 为每一级自主程度定义可调用工具、最大步骤、成本预算、确认点和人工接管条件,避免模型自行决定权限边界。
- 首期可采用观察模式或只生成执行计划,比较建议与人工操作的差异,再逐步开放少量可撤销动作。
- 执行界面要展示将改变什么、依据是什么和如何撤销,部分成功时明确状态并提供补偿或人工处理入口。
- 升级依据应是端到端成功率、误操作、人工节省和用户信任的持续证据,而不是模型在演示中的规划能力。