你在这里。看看这个问题与其他知识怎样相连。
选择节点前往页面 · 展开后可留在地图中阅读
一个问题
Agent 怎样完成一次可检查的 AFS 任务?
把发现、读取、选择操作和核对结果分开观察。
- 读取状态核对版本和效果→
- 按授权执行检查预期状态→
- 再次读取
用同一份报告走一遍
任务是“查看演讲准备状态”,不是“把所有工具都用一次”。先发现当前可见的挂载,阅读相关路径说明,再读取报告状态。只读任务没有理由执行标记、删除或发送操作。
如果用户随后明确要求“标记为可审阅”,才进入修改流程:发现真实动作、核对参数和权限、执行操作,再读取结果验证状态。遇到拒绝,不应通过换一个入口绕过去;遇到版本冲突,应按应用契约协调,而不是盲目重试。
可以记录哪些证据
| 阶段 | 有用记录 |
|---|---|
| 发现 | 当时可见的资源与能力 |
| 决策 | 为什么选择这条路径和这个操作 |
| 执行 | 参数、结果与明确失败类别 |
| 验证 | 预期状态是否真实出现 |
记录应避免泄露凭据或无关私人内容。架构让任务更可检查,但不能保证模型必然理解正确。
这条路径可以先由确定性客户端跑通,再评估 agent;不要把模型的随机选择和 provider 的契约错误混在同一个实验里。
一条可以逐步核对的记录
下面沿用教学报告的假设路径与状态,不表示现场运行过模型:
| 输入或操作 | 观察结果 | 下一步 |
|---|---|---|
| 用户:查看准备状态 | 只授权查看 | 发现并阅读 /work 的说明 |
读取 /work/report | status=draft, version=7 | 回答“报告仍是草稿”,到此结束 |
| 用户:把它标记为可审阅 | 新增修改请求 | 发现 mark-ready 动作,检查输入与效果 |
| 以期望版本 7 执行动作 | 返回 ready, version=8 | 再读报告核对 |
再读 /work/report | status=ready, version=8 | 报告完成及核对结果 |
如果执行返回版本冲突,后两行不成立:应重新读取并判断用户原意是否仍适用。把成功与失败分开记录,才知道问题出在模型选择、授权、provider 处理还是结果核对。