推文
@godsonde · 2026-10-12 04:41
周五下午四点,一个改到第六轮的模块,Claude 跳出一行字: "You've reached your weekly limit. Resets Monday." 周六周日,什么都干不了。 后来我想通一件事:问题不在模型贵,在我把 80% 的 token 花错了地方。 往下看 👇 我试过两条路,都失败了。 一是往上买更贵的档位——下周五我还是站在同一个地方。 二是把整个项目丢给便宜模型——两天后拿到一堆能跑、但互相打架的代码。 真正的答案不是"换个模型",是"换个分工"。 先算笔账。一个项目烧 100 单位 token: 20% 在"想清楚做什么",80% 在"把它写出来"。 顶配 10 元/单位,中端 1 元/单位。 全用顶配:1000。 分层:20×10 + 80×1 = 280。 省 72%。 这个算式里没有魔法,只有一个前提👇 前提是:那 80% 的活,中端模型真能干吗? 判据只有一句话——这件事需要看到全局才能做对吗? 需要:需求澄清、接口设计、Code Review、卡住时拍板 → 顶配 不需要:函数实现、补测试、修小 bug、改名重构 → 中端 绝大部分 token 烧在第二类上。 于是分成三个角色: Manager:产出不是代码,是决策。只在拆解、定契约、评审三个点出场。 Worker:只拿任务必需的文件,不拿整个仓库。 Verifier:跑测试、比对契约、集成验收。 能用断言验收的,不要用模型判断。 切任务只问一句话:这件事需要全局视图吗? 需要 → Manager 干,或者升级给我。 不需要 → 扔给 Worker。 这个判据好在,它不依赖你对模型能力的玄学判断,只依赖任务本身的性质。 最不能省的一步:契约先行。 接口没冻结,绝不允许并行开发。 我翻过车:让前后端同时开工,两边对分页参数的理解不一致,来回十几轮,token 烧了一大截,代码一行没动。 后来接口全部落成一个文件,Worker 只许按它实现。 契约文件里不许出现"大概""类似""参考之前的"。 要精确到这种程度: "跨租户访问返回 403 FORBIDDEN,并写审计日志" "limit 缺省 20,超过 100 截断" "游标无效返回 INVALID_CURSOR,400" 不留解释空间,契约才有价值。 派给 Worker 的任务不该是一句话,该是一个文件。 模板里有五样:目标、输入契约、允许改哪些文件、验收标准、卡住了怎么办。 最后一样最关键。 没有它,Worker 不会说"我不确定",它会自己编一个合理解释,继续往下写。 隐形 Token 刺客:MCP 和 Skills。 工具定义不是放在角落里等你调用,它是每一轮都要重发一遍的 prompt 前缀。 你装了 15 个 MCP、每个暴露 8 个工具,这些东西一次不落地跟着你。 先别急着装,先数。 第二重代价更隐蔽:缓存失效。 prompt 缓存有个硬前提——前缀必须完全一致。 而工具定义恰好在 prompt 最前面。它一变,后面几千 token 的缓存全废,按未缓存的价格重付一遍。 一个"顺手装上但没用"的 MCP,收的是两份钱。 长会话的三个症状:变慢、变蠢、变贵。 它开始改需求、重复造轮子、把定好的命名规范改回去。它不报错,只是悄悄越跑越偏。 顺便纠正一个流行说法:长会话不是"指数级"消耗。准确说是每轮成本正比于上下文长度,总成本随"长度×轮数"涨。 解法很土:原子任务一结项,立刻落盘,新开会话。 只留三个文件: DECISIONS.md 只记决策,不记过程 PROGRESS.md 只记状态,不记细节 OPEN_QUESTIONS.md 只记没结论的,防止它自己编 新会话开场读这三个,几百行搞定。 最后回到付费方式。 订阅制买的是"一段时间的可用额度",撞墙不可控。 计量制买的是 token,账单可控。 只有走 API / Router,分层架构才真正成立——否则你没法把 80% 的请求路由到另一个模型。 你现在是单模型硬刚,还是已经分流?
曝光 112 · 评论 0 · 点赞 0 · 书签 0 · 曝光/时 24.332928044514844