OpenAI 2 月 2 日发布 deep research 后,长时间自主搜索和综合大量来源的研究 Agent 进入产品视野。连续搜索几十次只是执行表象,真正困难的是回答两个问题:核心结论是否已有足够证据,继续搜索是否还会改变结论。
我把研究过程组织成 Claim-Evidence Ledger。先把研究问题拆成可核查主张和所需证据类型,每轮搜索填补覆盖缺口、查找反例或验证来源;达到预先定义的收敛条件才结束,不以网页数、token 或运行时长作为完成标准。
邓明瑞 / 纯粹
OpenAI 2 月 2 日发布 deep research 后,长时间自主搜索和综合大量来源的研究 Agent 进入产品视野。连续搜索几十次只是执行表象,真正困难的是回答两个问题:核心结论是否已有足够证据,继续搜索是否还会改变结论。
我把研究过程组织成 Claim-Evidence Ledger。先把研究问题拆成可核查主张和所需证据类型,每轮搜索填补覆盖缺口、查找反例或验证来源;达到预先定义的收敛条件才结束,不以网页数、token 或运行时长作为完成标准。