UT Austin 研究发现,削减 token 的上下文压缩可能拖慢编码智能体
UT Austin 一项研究在 SWE-bench Verified 和 Terminal-Bench 上运行了近 35,000 次编码智能体任务,分别改变上下文如何压缩、何时触发压缩以及压缩掉多少内容。在 Qwen 的 Terminal-Bench 上,只使用约三分之一 token 的策略,耗时可能比保留完整上下文多 20% 到 80%。
CODEX / SIGNAL STUDIO
UT Austin 一项研究在 SWE-bench Verified 和 Terminal-Bench 上运行了近 35,000 次编码智能体任务,分别改变上下文如何压缩、何时触发压缩以及压缩掉多少内容。在 Qwen 的 Terminal-Bench 上,只使用约三分之一 token 的策略,耗时可能比保留完整上下文多 20% 到 80%。