Part 9: 前沿实践
前沿实践不是热点功能清单,而是把深度研究、Computer Use、Agentic Coding、后台执行、模型路由和可靠 Harness 连起来,同时守住安全与可验证性。
章节列表
| 章节 | 主题 | 核心问题 |
|---|---|---|
| 27 | Deep Research | 如何收集、比较、引用并综合证据? |
| 28 | Computer Use | Agent 如何安全操作界面并验证结果? |
| 29 | Agentic Coding | Agent 如何修改代码,同时保留审查与回滚边界? |
| 30 | Background Agents | 长任务如何应对取消、重启与延迟事件? |
| 31 | 分层模型策略 | 如何按实测能力、成本与延迟路由? |
| 32 | Agent Harness | 模型之外的可靠执行循环需要什么? |
| 33 | Building on the Harness — Kocoro | 公开 OSS 运行时概念如何成为可测试的平台? |
每章增加了什么
第 27 章:Deep Research
证据型研究需要来源质量、论断与引用映射、去重、冲突处理和停止条件。搜索更多,不等于研究更好。
第 28 章:Computer Use
安全的操作循环应拆分感知、动作提议、审批、执行与后置条件验证。只看截图“像成功了”还不够,应尽量核对应用真实状态。
第 29 章:Agentic Coding
Coding Agent 需要明确工作区、编辑权限、可逆变更、测试与可审查 Diff。测试通过是证据,不是自动发布授权。
第 30 章:Background Agents
长任务需要可取消、可检查点恢复、幂等工具调用、有限重试和明确终态。“仍在运行”不是完成条件。
第 31 章:分层模型策略
模型层级是工作负载策略,不是固定厂商名称或配额。应同时评估任务成功率、升级率、延迟与总成本。
第 32 章:Agent Harness
Harness 负责上下文压力、权限、Hooks、循环检测、进度与优雅终止。阈值和探测器数量只是实现快照,设计不变量更重要。
第 33 章:Building on the Harness — Kocoro
Kocoro 的公开引擎与 Daemon 展示 Named Agents、Sessions、Memory、工具隔离、MCP、调度和本地服务集成。原生 Kocoro Desktop 是独立的闭源产品。
学习目标
完成本 Part 后,你将能够:
- 设计有证据链的研究流程;
- 区分 UI 动作提议与已验证结果;
- 把审查、编辑、提交和发布定义为独立关卡;
- 让长任务可取消、可恢复并保持幂等;
- 通过测量决定模型路由,而不是迷信固定比例;
- 用契约、轨迹、故障注入与回归套件评估 Agent Harness;
- 区分公开 OSS 证据与产品专属或私有细节。
不依赖过期价格表的成本计算
使用工作负载公式,而不是记住一个营销式节省比例:
月成本 = Σ(请求数 × 输入 Token × 输入单价 + 输出 Token × 输出单价)
同时记录价格核验日期、缓存、批处理折扣、长上下文溢价以及重试/升级成本。模型或厂商变化后重新计算。
推荐阅读路径
- Research 构建者:27 → 31 → 32 → 33
- Coding Agent 构建者:29 → 25 → 30 → 32 → 33
- Computer Use 构建者:28 → 25 → 30 → 33
- 平台评估者:30 → 31 → 32 → 33
公开来源边界:Shannon 与 Kocoro 引擎/Daemon 可以作为公开参考。本书示例应保持概念化,或只链接公开 OSS。私有仓库、生产配置、事故细节、客户数据、内部实测阈值和专有资产一律不进入公开页面。