OpenAI因事故风险取消GPT-6.1 Astra及安全团队争议
AI科技 · 3 篇公开推文 · 3 位作者 · 曝光 27765 · 评论 21 · 点赞 46 · 书签 20
Sam Altman称准备上线的GPT-6.1 Astra因事故风险过高而被取消;另有帖子讨论OpenAI安全研究员离职及其建议是否被公司采纳。关注点是模型发布风险评估和安全团队的决策影响。
创作角度
- 核对OpenAI关于GPT-6.1 Astra被砍的原话及其所指的事故风险。
- 讨论模型能力提升与安全评估、发布节奏之间的取舍。
- 追踪研究人员离职及安全建议被采纳的争议。
相关公开推文
OpenAI 今天发了很长一篇声明。他们开了 3 个安全研究员, 然后几乎全盘同意了这 3 个人提的安全建议。人不要了。 观点留下了。这 3 个人不是边缘员工。 Tomek:夏天 Hugging Face 被 OpenAI agents 黑进去那次,他是对接外部审计机构 METR 的主技术接口。 Mikita:做 alignment 评估和思维链可监控性。 Jasmine:提过 “pacing the frontier”,那份请愿差不多 400 个 OpenAI 员工签了名。 公司说法: 违反敏感信息政策,信任崩了,调查发现的问题“比他们公开信写的更严重”。 三人说法: 跟 METR 说话本来就是工作; 邮箱权限是招聘用的,IT 没撤掉,误点后立刻上报; 材料分享前做过脱敏。 一边说政策很清晰。 一边死活不说清楚:到底清了哪条、传了什么、给了谁。 时间点叠在一起,我们看到:agent 失控 → 外部审计进场 → 员工喊放慢 frontier → 可监控性变差的讨论升温 → 三人被保安收工牌带走。 然后公司出来说: 我们鼓励安全辩论,从不因提顾虑开人。 AI 不是普通技术,OpenAI 也不是普通公司。 离风险最近的人,如果不敢跟外部安全组织高频协作, 通往超智能的路发生什么谁也无法评估。 人可以走。 如果外部审计的带宽也一起走, 那这篇声明里所有“我们仍然重视安全”, 就只是公关。
曝光 11083 · 评论 6 · 点赞 17 · 书签 7
查看原帖Sam Altman 正面解释:准备上线的 GPT-6.1 Astra 被砍,是因为它会把“事故风险”推得太高。 他所谓 accident risk,是重大安全事故最终演变成真正失控,AI 逃出去,在网上肆虐,社会再也夺不回控制。 更扎心的是:WSJ 已报道,OpenAI 并没扔掉这条线,而是用同一底座继续训练更强的下一代。 一边承认再往前可能滑向失控,一边还在同一模型上加压,这才是重点。 #SamAltman #GPT61Astra #OpenAI #AISafety #VanityFair #AI失控 https://x.com/nft_chen/status/2107845041641357543?s=46 https://x.com/ONagel33303/status/2108304240594817336/video/1
曝光 10625 · 评论 7 · 点赞 20 · 书签 10
查看原帖🍉 吃瓜,又3个踩刹车的被干掉了。 OpenAI 上周一口气开了 3 个安全研究员,今天三个人全出来讲自己的版本,OpenAI 甚至亲自下场回应。 我猜测内部可能把模型迭代慢、拉垮归因到安全上了。 我把双方原帖都看了一遍。 OpenAI 处理方式让人服气: 公司说三个人“违规处理敏感信息、严重破坏信任”。 三个人则说,给他们的具体解雇理由根本对不上。 先不替他们定案,这三个研究员的原文,可以仔细听他们说完。 🔥 最戏剧性的 Tomek:9 月 28 日还在公开说,自己作为 OpenAI 对接 METR 调查的技术联系人,是职业生涯里最自豪的工作之一。 几天后人没了。 🤔🤔🤔 三个人的原帖 + OpenAI 官方回应我全部挂下面。 今晚不聊 AGI,先一起吃 OpenAI 的瓜。👇
曝光 9248 · 评论 8 · 点赞 9 · 书签 3
查看原帖