推文
@RealYDT · 2026-10-11 07:52
说个,卧槽,兄弟们, Claude Code 额度掉得像流水,X 上面里一堆人在骂它压根没做上下文压缩。 最近 Anthropic 的 Lydia Hallie 出来澄清,压缩一直在做,真正的问题是它等得太晚。 她的说法大意是,auto-compact 是真摘要,一触发整段对话直接换成一小段 summary,不会留着最近 100 万 token。 坑在触发点。1M 窗口的模型,默认要涨到约 967K 才压缩。这之前的每一条消息,背后都在重发一整段几百 K 的历史。缓存读取确实便宜,但再便宜也是按这个体量在算,照样吃你的 5 小时额度。 更绝的是,压缩本身几乎不花钱。官方文档写得很清楚,缓存还热的时候,压缩读的就是现成缓存,之后只为那一小段新摘要重写一次。缓存冷了才贵。所以亏的地方在不压缩,压缩反而是省的。 我拿 haiku 在本机试了,同一段约 108k token 的文本,窗口设成 100k 当场触发压缩,默认设置纹丝不动。 打个比方,缓存打折只是让背包便宜了,没说你不用背。默认设置是让你背着整座仓库走到 967K 才肯放下。 我自己设了 autoCompactWindow 为 400000,也可以直接敲 /autocompact 400k。太小会丢细节,别压到 200K 以下。 额度没被偷。默认设置替你选了最贵的用法,恐怕以后拼 agent,比的就是谁更会管上下文。
曝光 512 · 评论 2 · 点赞 2 · 书签 1 · 曝光/时 27.903463719734322