模型上下文窗口变大后,一个直接做法是把更多历史、文档、工具结果和记忆都塞进去。效果未必更好:关键约束埋在中间,重复片段抢占注意力,旧状态与新状态冲突,输出和工具参数又没有剩余空间。
我把 Context Engineering 看成信息预算。先从模型上限中预留输出、工具结果和安全余量,再按 P0/P1/P2 分配输入。压缩的目标不是尽量变短,而是在预算内保住完成任务与验证所需的信息。
邓明瑞 / 纯粹
模型上下文窗口变大后,一个直接做法是把更多历史、文档、工具结果和记忆都塞进去。效果未必更好:关键约束埋在中间,重复片段抢占注意力,旧状态与新状态冲突,输出和工具参数又没有剩余空间。
我把 Context Engineering 看成信息预算。先从模型上限中预留输出、工具结果和安全余量,再按 P0/P1/P2 分配输入。压缩的目标不是尽量变短,而是在预算内保住完成任务与验证所需的信息。