第 37 章:分层压缩
压缩质量取决于保留了多少决策价值,而不是删掉了多少字符。
公开源码快照:实现细节取自 Kocoro 公开仓库
origin/main的4ec6772提交,复核日期为 2026-07-27。章节讲的是不变量;具体常量应以当前源码为准。
37.1 问题是什么
统一截断会把下一步决策必需的结果,与二十步之前的陈旧输出同等处理;还会破坏 read/search 结果,因为这些工具的价值就在正文而不是元数据。
37.2 设计原则
最新证据保持完整;中等年龄的大结果用语义摘要或首尾片段压缩;真正陈旧的结果只留元数据。对承载正文的检查类工具设置 Tier 2 下限,并限制每轮语义摘要数量,避免压缩本身变成隐藏的模型调用瀑布。
37.3 快照证据
| 源码快照 | 观察 |
|---|---|
4ec6772 | 最新 8 条 Tool Result 消息保持完整 |
4ec6772 | 距离末尾 8–19 使用 Tier 2;20 以上使用 Tier 1——但承载正文的检查类与浏览器类工具保留 Tier 2 下限 |
4ec6772 | Tier 2 语义阈值为 2,000 字符;压缩回退上限为 300 字符 |
以上数值描述的是一个有日期的实现快照,不是普遍契约。
37.4 实现检查表
- 按正文是否仍影响决策来分类工具。
- 重写后仍要保持 tool call/result 配对。
- 测量新增摘要调用与缓存影响。
37.5 本章结论
压缩质量取决于保留了多少决策价值,而不是删掉了多少字符。
这些章节应作为一个系统阅读:上下文、工具 Schema、持久化、操控、时间纪律、循环检测和并发会彼此影响。