TwKit

推文

@fireandstart · 2026-10-11 19:13

看这类 7×24 小时 Agent 架构分享,我最关注的不是“自动化”这个标签,而是系统怎样在长时间运行中保持可恢复、可观察、可控。无状态休眠与事件唤醒解决的是资源和调度问题;多 Agent 解耦处理的是任务边界与并行协作;上下文指针化压缩则关系到长流程里,哪些状态必须保留、哪些信息可以按需取回。它们共同回答一个实际问题:模型短暂失效、工具调用失败或进程重启后,工作能不能从可信状态继续,而不是靠一次超长提示词祈祷成功。 不过,架构图和一次演示离稳定运行还有距离。真正决定系统能否交付的,是任务状态是否有明确来源、每个步骤是否幂等、失败是否有界重试与人工接管路径、权限是否最小化,以及运行记录能否解释“它为什么做了这件事”。如果 Agent 会访问外部服务或写入数据,还要把授权范围、回滚方式和重复执行的后果纳入设计。 所以这 45 分钟值得看的地方,不只是某种 Harness 的组件清单,更是如何把模型能力包进可靠的软件系统。可以先挑一个低风险、边界清楚的任务,记录成功率、人工介入次数、恢复耗时和单位成本,再逐步扩大范围。只有这些指标在真实任务里站得住,7×24 才是可验证的运行能力,而不只是一个很吸引人的承诺。

曝光 27 · 评论 0 · 点赞 0 · 书签 0 · 曝光/时 11.959739126219167

TwKit
正在载入