TwKit

Claude Haiku 5.5发布与价格、验证码能力讨论

AI科技 · 3 篇公开推文 · 3 位作者 · 曝光 1656 · 评论 0 · 点赞 2 · 书签 2

推文讨论Claude Haiku 5.5发布、价格下降与验证码测试成绩;降价幅度分别出现75%和90%的说法。

创作角度

  • 不同降价口径为何需要核对
  • 验证码基准反映了小模型哪些能力

相关公开推文

@shmily7

#Capbench #Haiku 5.5 #验证码模型竞技场 Haiku 5.5 已经补完冻结题集的 699 题:准确率 55.9%(391/699),总榜第 31/59,总花费 $0.17。 整场情况:一场跑完(ls_bt4acj628hty),14 块,约 7 分钟,879 次调用,0 error。 成本:每 100 道答对约 $0.04。在准确率 50% 以上的模型里它最便宜。和它同分的 gpt-5.4 花了 $30.5,按规则成本低的排前面。 和 haiku-4.5 比:高了 31.7 个百分点,几乎每个题型都大幅提升。 和 sonnet-5.5 比:低了 21 个百分点。差距主要在 FunCaptcha、4x4 网格、文字验证码和拖拽题。简单网格和点选题已经和 sonnet 差不多。 https://capbench.ai/models/anthropic-claude-haiku-5.5

曝光 1341 · 评论 0 · 点赞 0 · 书签 1

查看原帖
@foxbaby666

Anthropic 发布 Claude Haiku 5.5,降价 75% Anthropic 一个月内连发第三款 5.5 系列模型:Claude Haiku 5.5 上线了。 价格战先开炮:比上一代 Haiku 4.5 便宜 75%,10 万 token 内上下文输入 0.1 美元/百万 token、输出 0.5 美元/百万。官方定位"最便宜、最快、最能打"的小模型,主攻摘要、分类、数据提取、实时客服和语音助手这类高频任务。 两个细节:首个带"可调努力度"的小模型,开发者自选"省钱还是更聪明";也是首个内置高风险网络安全请求防护的 Haiku——IPO 前夕,"规模+安全"两手牌齐出。 判断:竞赛下半场不在参数,在 token 单价。Haiku 5.5 压价是想吃掉 Agent 落地的海量调用——谁能让开发者"闭眼用",谁拿下 2027 年的推理增量。

曝光 172 · 评论 0 · 点赞 0 · 书签 0

查看原帖
@mr_mofun

降价90%!Anthropic推出Claude Haiku 5.5,主打最便宜最快小模型 Anthropic 10月7日推出Haiku 5.5,四项API牌价与OpenAI GPT-6 Luna完全相同:每百万token输入0.10美元、输出0.50美元。但降价90%有条件——仅限10万token以内的短请求,超出后费率变贵5倍;且新版tokenizer让同段文字多算约30% token,实际平均降幅约75%。 值得注意的是,官方跑分全开在最高推理强度Max档,若用预设Medium档,Terminal-Bench成绩从39.2%跌至20.3%。 定位上,Haiku 5.5不是取代大模型,而是当子代理替大模型跑腿:摘要、查资料库、分类等高频低成本工作,复杂代理式写程式仍建议用Sonnet与Opus。 https://www.anthropic.com/claude-haiku-5-5

曝光 143 · 评论 0 · 点赞 2 · 书签 1

查看原帖