推文
@KakaluoteW45042 · 2026-10-12 03:31
同感,Agent 场景只会更极端。 一次任务几十次调用,大多是“这步对不对、要不要重试”的小判断,真正需要深度推理的可能就两三步。 所以 harness 的关键工作之一就是分配 token 预算,便宜模型跑循环,贵模型只在关键节点出手。 单次聪明不决定成败,单位经济性才决定它能不能天天跑。
曝光 16 · 评论 0 · 点赞 0 · 书签 0 · 曝光/时 9.201080215336798
@KakaluoteW45042 · 2026-10-12 03:31
同感,Agent 场景只会更极端。 一次任务几十次调用,大多是“这步对不对、要不要重试”的小判断,真正需要深度推理的可能就两三步。 所以 harness 的关键工作之一就是分配 token 预算,便宜模型跑循环,贵模型只在关键节点出手。 单次聪明不决定成败,单位经济性才决定它能不能天天跑。
曝光 16 · 评论 0 · 点赞 0 · 书签 0 · 曝光/时 9.201080215336798