Agent 出错后,把同一句话再发一次,第二次答对并不能叫回归通过。模型 snapshot 可能升级,知识索引更新了,工具对象状态变了,用户权限和当前日期也不同。输入文字相同,实验条件已经不是同一套。
我把回归环境拆成四个不可变 Bundle:行为、上下文、工具、运行时。用例再声明权限身份与期望不变量。只有把这些版本固定,修改一个目标变量后的差异才有因果意义。
邓明瑞 / 纯粹
Agent 出错后,把同一句话再发一次,第二次答对并不能叫回归通过。模型 snapshot 可能升级,知识索引更新了,工具对象状态变了,用户权限和当前日期也不同。输入文字相同,实验条件已经不是同一套。
我把回归环境拆成四个不可变 Bundle:行为、上下文、工具、运行时。用例再声明权限身份与期望不变量。只有把这些版本固定,修改一个目标变量后的差异才有因果意义。