Agent Reliability Lab
用于研究多步骤 AI Agent 验证、恢复与可观测性的实验平台。
项目概览
这个占位项目展示如何把 Agent 的计划、工具调用和最终结果放进同一套可检查的执行记录中,并针对超时、部分失败和错误成功报告设计恢复机制。
工程要点
- 以验收条件而不是进程退出码判断任务是否完成
- 保存检查点,支持长任务从最近状态恢复
- 用结构化事件重建 Agent 的决策路径
用于研究多步骤 AI Agent 验证、恢复与可观测性的实验平台。
这个占位项目展示如何把 Agent 的计划、工具调用和最终结果放进同一套可检查的执行记录中,并针对超时、部分失败和错误成功报告设计恢复机制。