TwKit

推文

@kafkaup · 2026-10-09 02:08

纽约市议会周一开了场 AI 风险听证会,三位前 AI 实验室员工作证,其中两人说了同一件事:实验室里的研究人员,已经不怎么逐行核查 AI 写出来的东西了。 作证的是 Jacob Coxon(待过 Anthropic 和 OpenAI)、Alex Turner(原谷歌 DeepMind)和 Daniel Kokotajlo(原 OpenAI)。Coxon 和 Kokotajlo 的说法是,写代码和做研究的流程越来越多交给模型主导,人只在后面大致过一眼,核查的频率在往下走。后半场几家实验室的代表也发了言,他们对这个描述大概不会认同。 我之前就觉得这是迟早的事。模型产出的速度早就超过人工复核,内部又在拼研发节奏,放手是最经济的选择。麻烦在于安全研究本身也跑在同一套流程上,等于用一个你没完全看懂的东西,去检查另一个你没完全看懂的东西。 实验室对外讲的那些评估,可信度取决于内部还剩多少人工复核。按这三位的说法,剩得不多了。

曝光 112 · 评论 0 · 点赞 0 · 书签 0