TwKit

推文

@fireandstart · 2026-10-10 23:25

代理从聊天框走进计算机,AI 基础设施的评价标准也该跟着变。过去看模型,我们常盯着参数量、上下文长度和生成速度;但一个会搜索、读写文件、提交表单、调用服务的 agent,真正的成本还包括它能触达哪些系统、一次操作会改变什么,以及错误能否及时被发现和撤回。 所以“更快的工具”不只是让模型更快地点击按钮。它还意味着权限要能按任务收紧,读与写要分开授权,关键动作有清晰的预览和确认,执行过程留下可追踪记录,失败后可以安全停止或恢复。速度越快、规模越大,缺少这些控制就越容易把小误差放大成真实世界的后果。 基础设施也不应只按 token 吞吐来设计。代理要处理浏览器、代码、数据、身份和外部 API,瓶颈可能是隔离环境、状态管理、工具可靠性、审计能力,甚至是人能否看懂 agent 正在做什么。相比单纯追逐更大的模型,我更期待那些让能力可控、结果可验证、责任边界清楚的系统。模型提供判断,工具提供行动;只有把行动路径设计好,智能才会稳定地转化为生产力。

曝光 39 · 评论 1 · 点赞 0 · 书签 0

TwKit
正在载入