TwKit

推文

@canghe · 2026-10-06 12:23

美国终于也急了,Reflection AI 发布 Beam,美国在开源模型上第一次真正正面挑战 DeepSeek 和 Qwen。 核心数字:501B 总参数,23B 激活,MoE 架构,专为 coding 和 agent 设计。 效率是卖点:推理算力只需 GLM-5.3 的 25%,声称在主要 benchmark 上追平同级别中国模型。 部分 benchmark(厂商自测,非独立复现): AutomationBench 37.0,GLM-5.2 是 26.2 Terminal-Bench 2.1 是 80.1,Qwen 3.8 Max 是 88.3,Kimi K3 是 86.6 背后投入:Nvidia 押了 8 亿美元,两位前 DeepMind 研究员创建,10500 张 GB300 训练 4 周,Nebius 算力协议超 10 亿美元。权重本月底 Apache 2.0 开放。 过去一年开源排行榜基本被中国模型垄断,这次是第一个这个体量的美国玩家下场。

曝光 6691 · 评论 16 · 点赞 18 · 书签 9 · 曝光/时 3.1146858752159345