接口返回 200,耗时也正常,智能客服给出的退款规则却是错的。
打开监控面板,只能看到这次请求调用过大模型,并且正常生成了回答。再往下查就麻烦了:是知识库没有召回正确资料,Prompt 拼错了,模型忽略了上下文,还是某个工具返回了旧数据?普通接口日志通常回答不了这些问题。
一次 AI 请求可能会经过问题改写、知识库检索、重排、模型调用、工具调用和结果校验。Agent 还可能重复执行其中几步。每一步看起来都调用成功,错误结果却会继续传给下一步,最后得到一段格式正常、内容有问题的回答。
排查时需要顺着这条执行过程往回找:当时用了哪个模型和 Prompt,检索到了哪些文档,调用了什么工具,Agent 重试了几次,最终回答参考了哪些结果。
2026/8/16大约 34 分钟
