篇章五 · 5.2
Fork 与 Coordinator
多 Agent 最贵的不是算力,是重复的 prompt。Fork 的答案是:让所有子代理的请求前缀一个字节都不差。
字节不差 = 缓存全命中
Fork 子代理继承父对话的完整上下文。实现手段:所有 tool_use 结果替换成同一个占位符、工具定义锁定(useExactTools)——前缀完全一致,cache 全部共享。
父对话
systemCLAUDE.md用户消息 1tool结果tool结果用户消息 2
Fork A
Fork B
前缀一致 → 两份请求都命中同一份缓存
防递归:Fork 里再 Fork?isInForkChild() 检测 <fork-boilerplate> 标签直接拒绝——缓存共享链不允许套娃。
Coordinator · 只指挥不干活
👷Agent创建 worker
+
📡SendMessage向 worker 发消息
+
🛑TaskStop停掉 worker
=
🎯全部工具不写代码、不读文件——纯编排
四阶段工作流
1 · Research只读任务并行铺开
→
2 · Synthesis综合理解(核心职责)
→
3 · Implementation写操作:同文件集一次一个
→
4 · Verification验证结果
Continue vs Spawn 决策:上下文重叠多 → 让老 worker 继续;重叠少 → 派新的。一个判断省下整个 worker 的冷启动。
本站要点:多 Agent 的经济学——Fork 靠字节对齐白嫖缓存,Coordinator 靠不干活降低复杂度。下一站是扩展生态:MCP 八种传输 + Skills 的目录嗅探。