“模型没有返回结果”是一句症状,不是根因。我见过模型已经正常结束,网关漏了 terminal event;也见过前端展示了答案,服务端却没有持久化。只看其中一层,谁都能拿出一段日志证明自己没问题。
Agent 诊断需要的是可连接、可校验的证据链。它从用户实际看见的结果出发,关联到 Run、上下文、模型 Attempt、工具 Operation、流事件和最终存储,并明确哪一段是原始事实、哪一段是系统推断。
邓明瑞 / 纯粹
“模型没有返回结果”是一句症状,不是根因。我见过模型已经正常结束,网关漏了 terminal event;也见过前端展示了答案,服务端却没有持久化。只看其中一层,谁都能拿出一段日志证明自己没问题。
Agent 诊断需要的是可连接、可校验的证据链。它从用户实际看见的结果出发,关联到 Run、上下文、模型 Attempt、工具 Operation、流事件和最终存储,并明确哪一段是原始事实、哪一段是系统推断。
Agent 出问题后,常见做法是把用户问题再问一次。第二次可能用了新模型、新索引和变化后的工具状态,即使答对,也不能证明原问题修复;如果工具有副作用,直接重跑还可能再次发送、创建或修改。
我把 Trace Replay 分成三层:先用原始事件回放协议转换和状态归并,再用固定检索/工具 fixture 回放编排,最后才在隔离环境调用新模型或新索引。每层回答不同问题,且生产副作用默认不重演。