推文
@sleepy0x13 · 2026-10-10 13:38
有人把 Anthropic 的 Opus 5.5 Fast 和 OpenAI 的 Sol 6.1 Ultrafast 放在一起比较,结果挺有意思。 两者的输出速度几乎一样,Opus 5.5 Fast 是 280 token/s,Sol 6.1 Ultrafast 是 280–300 token/s。 但 API 价格却差了整整 50%。 按每百万 Token 计算: Opus 5.5 Fast:输入 $8,输出 $40,缓存 $0.4 Sol 6.1 Ultrafast:输入 $12,输出 $60,缓存 $0.6 更尴尬的是,Opus 5.5 是 Anthropic 的高端旗舰模型,而 Sol 6.1 在 OpenAI 的产品线里还算不上最顶级。 当然,单看 Token 生成速度不能证明哪个模型更划算,还要考虑实际任务能力、首字延迟和完成率。 但我觉得这组数据真正有意思的地方,在于它正在揭示大模型行业一个很微妙的变化。 过去模型厂商可以对更强的智能收溢价,现在连更快的智能都开始失去定价权了。 尤其在 Agent 时代,情况会变得更加残酷。 以前用户直接和模型聊天,模型聪明一点、回答快一点,可能就足够让人愿意付更多钱。但当模型成为 Agent 背后持续调用的基础设施,开发者最终计算的是完成一项任务需要多少钱、耗费多少时间、失败多少次。 在这个账本里,品牌忠诚度的价值会越来越低。 如果两家模型能够以接近的质量和速度完成任务,50% 的价格差就很难被忽略。更何况,现在有越来越多的工具让开发者可以随时切换模型。 这才是 OpenAI 最需要警惕的事情。 当开发者开始认真比较每百万 Token 的报价,说明模型之间的可替代性已经在上升。过去靠技术领先建立起来的价格体系,正在被竞争对手一点点拆掉。 模型越来越聪明,但卖模型的生意,可能会越来越像一门薄利生意。
曝光 622 · 评论 3 · 点赞 1 · 书签 0 · 曝光/时 358.7462233585449