TwKit

推文

@BirdTechVision · 2026-10-09 22:07

🧩 JetBrains发布Mellum2.1,12B开源编码模型学会自己改代码 💻 10月8日JetBrains发布Mellum2.1。这个12B参数的MoE编码模型激活参数只有2.5B,这次迎来的是训练方法的版本升级。架构没动,全部升级在训练后阶段:强化学习从收尾步骤变成训练主体,数百万次沙盒环境运行让模型学会探索代码库、编辑文件、自查修改。Apache 2.0协议全开源,可在自有硬件部署。 ⚡ 为什么一个小模型值得注意:编码智能体时代真正跑量的是子任务执行器,不是每次都动用旗舰模型。Mellum2.1在重负载下是同组最快模型,吞吐接近Qwen3.5-9B的两倍,多token预测让单请求快1.6倍。对比对象Qwen3.5-9B和Gemma 4 E4B是同级别开源竞品,速度优势直接换算成推理成本优势。 🧐 多数讨论在追旗舰模型的榜单,漏掉了基础设施层的变局:IDE厂商自己下场训模型还开源,打的是工具链纵深牌。你的代码在哪家IDE里写,就有可能用哪家的模型跑——开发环境正在从编辑器变成模型分发渠道。自托管场景下代码不出内网,这对金融和军工客户是刚需,而这块市场云端API模型够不着。 👀 接下来看两件事:GGUF量化版和vLLM的MTP支持落地后本地部署的实测口碑、JetBrains会不会把Mellum2.1直接织进IDE的补全和agent功能。当编码模型的发行渠道变成IDE本身,开源模型的竞争点就从权重文件变成了工作流嵌入。 📌 TL;DR: • 10月8日JetBrains开源Mellum2.1,12B MoE激活2.5B参数 • RL成为训练主体,数百万次沙盒运行学会探索编辑自查代码 • 重负载吞吐近Qwen3.5-9B两倍,单请求快1.6倍 • Apache 2.0全开源,GGUF与vLLM MTP支持在路上 • 定位编码智能体的自托管执行器,代码不出内网 💬 编码智能体时代,IDE厂商的模型和通用大模型你选谁? A. IDE厂商模型,工作流集成是王道 B. 通用大模型,能力上限更重要 C. 小模型跑子任务+大模型兜底,混合最实际 D. 只看自托管能力,代码不能出内网 #JetBrains #OpenSource #CodingAgents

曝光 129 · 评论 2 · 点赞 2 · 书签 0 · 曝光/时 79.59954440038649