字节新论文:别扔掉草稿纸
错误过程也是上下文
字节最近的论文 Chain-of-Experience 研究了一个很实际的问题:AI 反复修改答案时,之前的尝试应该完整保留,还是压缩成一份摘要?
通常的直觉是,上下文越短,推理成本越低。但这项实验给出了相反的结果:草稿纸不能轻易扔掉。
在 8 个模型、6 个基准测试中,保留完整尝试历史和反馈信号,平均正确率达到 71.0%;不带反馈的迭代求解为 66.8%;叠加外部反馈后,正确率进一步达到 79.3%。
更值得注意的是,质量提高的同时,API 成本还下降了 19%。上下文虽然变长了,但模型收敛得更快,总 token 消耗反而更少。
最值钱的不是结论
这件事对 Agent 的启示很直接:不要一看到上下文变长,就急着压缩。
一次失败尝试包含的不只是无效文字。它记录了模型如何理解问题、在哪一步走偏、外部反馈纠正了什么,以及后续方案为什么发生变化。这些信息共同构成了下一轮判断的依据。
如果只留下“正确答案是什么”,却删掉“当时为什么错”,看起来节省了空间,实际上可能丢掉了最昂贵、也最有价值的学习信号。
所以,上下文管理不能只看长度,还要看信息的功能。重复内容可以压缩,已经失去作用的细节可以删除,但错误路径、反馈和修正关系不应被当作普通冗余处理。
有时候,多即是少。保留更多有效经验,反而能减少无效试探。
Agent 需要经验链
我更愿意把这种记录理解为 Agent 的“经验链”。它不是简单保存全部对话,而是让模型看到一项任务如何从错误走向正确。
答案告诉模型结果,经验链告诉模型因果。前者便于复用,后者有助于避免重犯。
这也意味着,设计 Agent 记忆机制时,不能只做对话摘要。真正应该保留的是关键尝试、反馈信号和决策变化。否则,系统记住了结论,却忘了结论是怎样得来的。
人也一样
人的学习也有类似之处。有些道理听一遍就能复述,但只有真正做过、错过、修正过,才会变成自己的判断。
所谓抄近路,往往只是拿走了别人的结论,没有获得形成结论的过程。省掉的经验并没有消失,今后仍可能要在实践中补回来。
草稿纸看起来凌乱,却保存着思考发生的轨迹。对 Agent 如此,对人也是如此。