小米 MiMo-V2.6 技术报告:260 万美元 RL 算力与三维扩展,将万亿 MoE 模型推入前沿梯队
@shao__meng · 2026-10-10 15:57
MiMo-V2.6:以扩展强化学习逼近自我改进 论文:MiMo-V2.6: Scaling Reinforcement Learning Towards Self-Improvement,小米 LLM-Core 团队,2026 年 10 月发布。 核心论点
曝光 1573 · 评论 1 · 点赞 5 · 书签 3 · 曝光/时 127.28761449782823