TwKit

推文

@0x99DaDa · 2026-10-10 19:19

🧮 一个月前发布的 DeepSeek Flash,凭什么一周跑掉 37.6 万亿 token? OpenRouter 最新周榜(截至 10 月 9 日):DeepSeek V4.1 Flash 一周处理 37.6 万亿 token,环比还涨了 56%,是第二名的两倍多。 🔹 前十里 6 个来自中国公司:DeepSeek 两个、智谱 GLM 两个、小米 MiMo、腾讯 Hy4 preview。 🔹 Claude Opus 5.5 排第九,4.32 万亿,环比涨 99%。 🔹 按请求次数算,上周 DeepSeek 占 21.8%,略高于谷歌 21.5%、OpenAI 18.2%;Anthropic 是 2.5%。 用量为什么这么大?先看价格: 🔹 Flash 走 DeepSeek 官方渠道,输出每百万 token 0.60 美元;Opus 5.5 是 20 美元,差 33 倍。 🔹 权重公开,OpenRouter 上有 29 家在托管,最便宜的输出报 0.18 美元。vLLM 发布三周后又把它跑快了 1.9 倍。 🔹 吃量最大的是常驻 Agent:Hermes Agent 一个应用就给它送了 10.4 万亿 token。连 Claude Code 也出现在它的调用来源里,说明有人把 Claude Code 背后的模型换成了它。 但难活上差距还在: 🔹 Artificial Analysis 综合智能指数,Flash 最高档 39.5;Opus 5.5 最低档 42.3,最高档 57.6。 🔹 Agent 写代码的 Terminal-Bench 4.0,Flash 26.8%,Opus 5.5 最高档 59.6%,差一倍多。 所以日常大部分活,Flash 用 Opus 低档九成多的分数、几十分之一的价格就干完了;真正长链路的代码活,还是得上 Opus。Opus 的用量同一周也翻了一倍,两头都在涨。 要注意,这张榜只算走 OpenRouter 的流量,按 token 数排,不算花了多少钱;企业直连 Anthropic、OpenAI 的量不在里面。 Agent 一跑就是几小时、几百万 token,开发者会把能交出去的步骤都交给便宜模型,只把卡住的环节留给最贵的。国产模型这次先在海外开发者的账单上站住了一块。

曝光 328 · 评论 4 · 点赞 4 · 书签 1 · 曝光/时 100.78930155818226

TwKit
正在载入