TwKit

推文

@divid_lu49394 · 2026-10-08 22:41

Anthropic 发布新一代轻量模型 Claude Haiku 5.5,主打低成本、高速度和 Agent 任务。相比 Haiku 4.5,新模型在编程、电脑操作和专业知识任务上大幅提升,部分评测超过 GPT-6 Luna。Anthropic 称,这是公司迄今速度最快、能力最强的小模型。 
官方测试显示,Haiku 5.5 在 OSWorld 2.1 电脑操作评测中达到 72.4%,高于 GPT-6 Luna 的 48.9%,上一代 Haiku 4.5 仅为 15.7%。在 GDPval-AA 专业工作评测中,新模型获得 1620 分,同样超过 GPT-6 Luna 的 1437 分。编程能力同样提升明显,在 Terminal-Bench 4.0 中从上一代的 0% 提高到 39.2%,超过 GPT-6 Luna 的 16.4%。 
价格降幅更大。对于输入不超过 10 万 tokens 的请求,Haiku 5.5 每百万输入和输出 tokens 分别收费 0.1 美元和 0.5 美元,均比上一代降低 90%。超过这一长度则分别收取 0.5 美元和 2.5 美元。考虑到实际任务的 token 消耗变化,Anthropic 估算平均运行成本下降约 75%。 
Haiku 5.5 还首次在 Haiku 系列中加入可调节推理强度,允许开发者在性能和成本之间取舍。模型现已通过 Claude API、AWS、Google Cloud 和 Azure 提供,适合批量摘要、信息检索、浏览器操作,以及为大型 Coding Agent 执行子任务。

曝光 182 · 评论 3 · 点赞 2 · 书签 0 · 曝光/时 6.181599535988877