TwKit

推文

@wei_wang · 2026-10-11 22:17

我最近在研究 Claude Code 的自动压缩,之前一直没搞清楚它到底什么时候触发。读下来的结论: 1. 自动压缩就是总结。触发时整段对话被换成一份短摘要,不会留着最近的 1M token 2. 用 1M 上下文的模型,要到约 967K 才触发。在那之前,每发一条消息都带着前面全部对话 3. 这部分大多是缓存读取,便宜,但照样算用量,对话越长越贵 改法就一条命令: /autocompact 400k 到 400K 就总结,单条消息不会涨到那么大。 2.1.296 还加了 autoCompactWindow,可以写进子代理的 frontmatter 和 --agents 定义,让子代理比主对话更早压缩。 开长会话跑 Agent 的朋友可以试试。

曝光 920 · 评论 6 · 点赞 8 · 书签 4 · 曝光/时 258.86230622866645

TwKit
正在载入