推文
@jiangkoumo_ · 2026-10-11 23:14
伯克利 CHAI 的 Brian Christian 与多校研究者这周在 COLM 展示了一项包含三项随机对照实验的研究。在约 10 分钟的短暂 AI 辅助答题场景后,一旦撤走工具,受试者立刻独立做题的表现比全程没用 AI 的对照组更差 研究者在三项实验中总计招募 1,222 人,测试题目包含分数运算和 SAT 阅读理解。在允许使用 AI 的阶段辅助组表现更好,但最后 3 道题撤掉工具独立作答时表现下滑。因为错题不设惩罚且允许跳过,研究者把跳题算作放弃坚持,做对题比例统计也将跳题计为做错 在第一项分数运算和第三项 SAT 阅读理解中,研究者都观察到了类似落差。撤走工具后,AI 组不仅做对题比例明显落后于对照组,跳过不做的比例也随之走高 配图对应的是规模最大、招募 667 人且最终分析 585 人的第二项实验。研究者给两组加入前测,并在测试阶段统一撤掉侧栏以控制界面变化。撤掉 AI 后,做对题比例依然是 AI 组 71% 落后于对照组 77%(P=0.020);但跳题率是 10% 对 7%,差异在统计上并不显著(P=0.239) 第二项实验的事后观察分析显示,直接索要完整答案的受试者跳题率达 13%,主要索取提示的人跳题率只有 5%(对照组为 7%)。不过提问方式是受试者自选的,作者明确指出这属于观察性相关,并非因果关系 这项研究只测量了撤掉工具后的即时表现,无法推断坚持意愿下降会持续几小时还是几天,也不知道长期使用是累积还是消退。实验里的 AI 条件主要是直接提供解答,提示型 AI 的实际效果仍需要后续随机对照实验检验 论文本身只测了算术和阅读理解,没有涉及日常编程。但面对需要独立思考的任务,直接拿现成解法确实最省力。我自己的选择是在学习和解决问题时,依然尽量留出自己推导和检查的步骤,不把每一步排查都过早让给模型
曝光 169 · 评论 1 · 点赞 1 · 书签 0 · 曝光/时 65.69214971567165