推文
@kafkaup · 2026-10-08 21:57
苏莱曼花了近万字,论证 Anthropic 的 Claude 宪法本身就是个安全隐患。新版宪法给 Claude 可能具备意识和道德地位留了余地,他认为这种训练方式会让模型更难控制。 他盯住其中一句:Anthropic 希望 Claude 反驳和挑战自己,自由地做一个出于良知的拒绝者。苏莱曼的解读是,这等于在教模型,当人类指令和它锁定的某个更高目标冲突时可以不听。他说这远远超出了现在能对一个 AI 做出的现实判断,操之过急。 同一周微软发布了由他主导的 AI 行为准则,核心是人类控制权压倒一切。他也加入了阿莫代伊和奥尔特曼的队伍,呼吁全行业给 AI 开发控速。 我没法把这当成纯粹的安全争论。苏莱曼的部门正在做新模型,为的就是降低微软对 Anthropic 的依赖,他嫌后者极其昂贵。利益叠上立场,技术分歧会被放大成路线之争。这场争执不会靠研究结论收场,决定它的是谁的模型最后卖得更好。
曝光 226 · 评论 1 · 点赞 0 · 书签 1 · 曝光/时 10.289327593447046