第 37 章:分层压缩

压缩质量取决于保留了多少决策价值,而不是删掉了多少字符。

公开源码快照:实现细节取自 Kocoro 公开仓库 origin/main4ec6772 提交,复核日期为 2026-07-27。章节讲的是不变量;具体常量应以当前源码为准。

37.1 问题是什么

统一截断会把下一步决策必需的结果,与二十步之前的陈旧输出同等处理;还会破坏 read/search 结果,因为这些工具的价值就在正文而不是元数据。

37.2 设计原则

最新证据保持完整;中等年龄的大结果用语义摘要或首尾片段压缩;真正陈旧的结果只留元数据。对承载正文的检查类工具设置 Tier 2 下限,并限制每轮语义摘要数量,避免压缩本身变成隐藏的模型调用瀑布。

37.3 快照证据

源码快照观察
4ec6772最新 8 条 Tool Result 消息保持完整
4ec6772距离末尾 8–19 使用 Tier 2;20 以上使用 Tier 1——但承载正文的检查类与浏览器类工具保留 Tier 2 下限
4ec6772Tier 2 语义阈值为 2,000 字符;压缩回退上限为 300 字符

以上数值描述的是一个有日期的实现快照,不是普遍契约。

37.4 实现检查表

  • 按正文是否仍影响决策来分类工具。
  • 重写后仍要保持 tool call/result 配对。
  • 测量新增摘要调用与缓存影响。

37.5 本章结论

压缩质量取决于保留了多少决策价值,而不是删掉了多少字符。

这些章节应作为一个系统阅读:上下文、工具 Schema、持久化、操控、时间纪律、循环检测和并发会彼此影响。

引用本文 / Cite
Zhang, Wayland (2026). 第 37 章:分层压缩. In AI Agent 架构:从单体到企业级多智能体. https://waylandz.com/ai-agent-book/%E7%AC%AC37%E7%AB%A0-%E5%88%86%E5%B1%82%E5%8E%8B%E7%BC%A9/
@incollection{zhang2026aiagent_37_-,
  author = {Zhang, Wayland},
  title = {第 37 章:分层压缩},
  booktitle = {AI Agent 架构:从单体到企业级多智能体},
  year = {2026},
  url = {https://waylandz.com/ai-agent-book/%E7%AC%AC37%E7%AB%A0-%E5%88%86%E5%B1%82%E5%8E%8B%E7%BC%A9/}
}