再多说几句这个方法吧:
1. 主对话 opus 其实够了,如果特别难的问题,可以让它交给 subagent,在那里面调用 fable 或者 gpt 5.6 sol,这样比主对话里直接用 fable 要省很多 token;
2. 因为主对话可能会跑得很长,所以尽量选用 1m 的窗口,这样不怎么担心要不要压缩;
3. 真要压缩了不如写个 handoff doc,重新开一个主对话;
4. 主对话里基本上不用 plan 模式了,因为丢给 subagent 的时候,基本上就相当于在 subagent 里来了一个 plan 模式。这样的好处,也是在省主对话的 token,subagent 随用随抛,不占主对话的窗口。
Post #696
492
DPS Build 这两天学到的一个技巧是,跑一个主对话,只让它做调度,活全派给 subagents,subagents 的 model 也让它来调度。省 token,省 context window。 举个例子,我在主对话里跑 opus 4.6,让它根据项目进度安排活,然后指派给 subagents with proper models。一般它会调 sonnet 或者 haiku,并且会自动把任务计划写好,等着 subagent 跑完会回报进度。 简单来说就是 mapreduce。尤其适合睡前安排任务跑过夜。