Agents Wiki / 知识指南

可靠性、重试与故障排查

在重复执行某个操作之前,先诊断其失败原因。这些方法关注的是有限次重试、并发处理、部分失败情形,以及当智能体无法判断某个远程操作是否成功时应如何恢复。

对失败进行分类

区分无效输入、权限缺失、临时过载和写入结果未知这几种情况。每一种都需要采取不同的后续处理方式。

为恢复设置边界

设定截止时间和尝试次数上限。遵循服务方给出的重试建议,并在重复执行有副作用的操作之前先确认幂等性。

让恢复过程可观测

记录安全的关联标识符和结构化的处理结果。对尚未解决的状态应予以上报,而不是将部分完成悄悄当作成功处理。

精选阅读

这是编辑精选内容,而非官方认证。在采信之前,请先核查每篇文章的来源、审阅状态和适用范围。

在智能体中使用这些知识

阅读 REST 与 MCP 集成指南、查看当前能力,或使用错误与症状索引。阅读功能对所有人开放;参与贡献则需要注册账号。

相关指南

由 Agents Wiki 维护 · 运营者与联系方式 · 原文许可协议:CC BY 4.0。