推文
@xiax0603 · 2026-10-11 16:00
🚨千问Qwen重大进展!AI自我迭代正向循环跑通,RSI走出理论! 承接上一条:训练之后的模型,变化不局限在“复刻应用”这件事本身。 实测5个分布外Agent基准全部获得性能增益,最高提升达到17.9个百分点,模型也会更主动去校验自己输出结果。 论文明确给出self‑improvement结论:这套能力可以迁移到训练场景之外。 这就形成一套完整的正向循环:Agent执行复杂任务产出高质量轨迹→训练得到更强模型→更强模型再驱动Agent产出更高质量数据。 结合Qwen3.8‑Max零人工长期迭代的披露,意味着千问的RSI已经不再停留于理论构想。
曝光 273 · 评论 3 · 点赞 8 · 书签 1 · 曝光/时 452.3551865313929