抱歉,您的浏览器无法访问本站
本页面需要浏览器支持(启用)JavaScript
了解详情 >

Agent 出错后,把同一句话再发一次,第二次答对并不能叫回归通过。模型 snapshot 可能升级,知识索引更新了,工具对象状态变了,用户权限和当前日期也不同。输入文字相同,实验条件已经不是同一套。

我把回归环境拆成四个不可变 Bundle:行为、上下文、工具、运行时。用例再声明权限身份与期望不变量。只有把这些版本固定,修改一个目标变量后的差异才有因果意义。

Agent 回归的环境锁定清单

Agent 出问题后,常见做法是把用户问题再问一次。第二次可能用了新模型、新索引和变化后的工具状态,即使答对,也不能证明原问题修复;如果工具有副作用,直接重跑还可能再次发送、创建或修改。

我把 Trace Replay 分成三层:先用原始事件回放协议转换和状态归并,再用固定检索/工具 fixture 回放编排,最后才在隔离环境调用新模型或新索引。每层回答不同问题,且生产副作用默认不重演。

Agent Trace 的三层回放