TwKit

推文

@Zen_with_AI · 2026-10-10 15:02

关于上下文调整--节约token的小技巧: Claude 的 auto-compact 机制确实会将完整对话历史替换为简短摘要,而非保留最近Tokens。 在 1M 上下文模型上,系统默认需累积至约 967K tokens 才触发压缩,导致此前每条消息均需处理持续增长的完整上下文,虽多为缓存读取,仍显著累积用量。 建议通过 /autocompact 400k 命令或配置文件将阈值提前至 400K,使压缩在更早阶段发生。此调整可有效避免上下文规模过度膨胀,降低整体 token 消耗。

曝光 987 · 评论 2 · 点赞 8 · 书签 4 · 曝光/时 69.1264776231403

TwKit
正在载入