30 秒答案:一些 Agent 概念包含生成步骤和调用工具,但“能调用”不自动等于“已获授权”;一次接口成功响应,也不能单独证明预期的现实结果已经完成。
先拆开同一个词下的三层意思
当我们说“Agent 会做事”时,可能混入输出、工具动作和治理权限三层意思。它们可以逐层组合,但不能互相代替。本篇只演示概念拆分;对具体产品作判断时,还必须补充产品、版本、场景与信源。
层次 01 · 建议
模型给出下一步该怎么做
它生成一组步骤、文字或代码。此时发生的是输出,还没有任何外部动作。
层次 02 · 工具调用
系统把参数交给一个外部工具
它可能查询日历、写入文件或调用接口。工具是否真正成功,仍要看权限、网络、参数和外部系统。
层次 03 · 执行权限
有人允许系统在现实中产生后果
若要把发送邮件、付款、删除数据或替人承诺等动作交给系统,应按风险明确权限、复核或撤回方式,以及责任主体。这不是模型能力指标能单独回答的事。
能规划步骤 ≠ 已经执行;能调用工具 ≠ 已取得权限;接口返回成功 ≠ 现实结果必然成立。
为什么这和普通人有关
如果只是请模型起草一封邮件,错误通常还能在发送前被看见;一旦允许系统直接发送、付款或删除,潜在损失和责任范围就会明显扩大。是否使用 Agent,不只取决于“它有多聪明”,也取决于你给了什么权限、是否能暂停,以及出了问题谁能把事情撤回来。
下一步,不是信或不信
在打开任何写操作之前,先确认以下条件:具体产品和版本、运行环境、最小权限、执行前确认、费用或数量上限、完整日志、外部结果复核与撤回路径。
这不会保证系统永远不出错,但会把一句抽象的“Agent 能不能替我办事”,变成可以逐项检查的问题。
本篇返指坐标
- K-02:同一个 Agent 词是否指向同一对象。
- M-中:建议、调用、成功回执和现实结果不能等价交换。
- M-尾:输出何时取得行动权,谁复核、撤回并承担责任。
- F-03:一次演示或一次成功不能推出现实全链成立。