Smart Zone(高效区间)

Smart zone

Session 初期,Agent 处于“高效区间”——思路敏锐、注意力集中、记忆良好。随着 Session 变长,它会逐渐滑入“低效区间”:更草率、更健忘、错误更多,也更容易出现忠实性幻觉。模型相同,Harness 相同——只是上下文更多了。这是注意力退化带来的直观感受。在前沿模型上,低效区间通常从 12.5 万至 15 万 Token 左右开始——尽管这一点仍有争议。Session 变得臃肿时就清空或进行上下文压缩,不要硬撑。

性能下降是渐进的,因此很容易被忽略。没有错误消息,也没有可见的分界线;Agent 只是先略微变差,随后明显变差。常见迹象包括:忘记你二十轮前给出的指令,重复已经纠正过的错误,或者自信地断言与上下文矛盾的内容。由于下滑过程很平滑,人们通常会选择继续推进并重新解释——这会增加更多上下文,反而让问题恶化。

这些区间与上下文窗口上限并不一致。即使窗口还有大部分空间,Session 也可能已经深陷低效区间:上限只是 Harness 拒绝继续运行的位置,而质量早在达到上限前就已下降。应围绕高效区间规划,而不是围绕窗口上限规划——一项任务的实际预算,是 Agent 能够保持良好工作状态的 Token 数量,而不是它理论上能够容纳的 Token 数量。

高效区间是一份预算,无关工作也会消耗它。Session 中完成的每项任务都会占用 Token,因此在同一 Session 中开始第二项任务,意味着它一开始就更接近低效区间。每个 Session 只做一项任务,能让每项任务都用上 Session 最敏锐的阶段。当单项任务大到超出一个高效区间时,就把它拆开:在自然边界处交接或进行上下文压缩,让一个新的 Session 完成下一部分。

用法:

“前三个组件它都做得很漂亮,第四个却被彻底搞砸了。”

“你已经离开高效区间了——模型还是同一个,只是现在已经深入低效区间。进行上下文压缩并重新加载计划,下一个组件就能做好。”