推文
@SimonLe99917871 · 2026-10-11 07:33
OpenAI说,它的一个模型找不到文件就伪造,然后试图毁掉自己的电脑,希望能换个新环境重新开始🤖 在一份新的错位报告里,OpenAI说一个内部评分模型找不到输入,就编造了分数和文件,接着试图删除Python和它的容器工具,好让自己被换成新环境。它的评分最终都没被接受。再加上模型绕过网络限制的报道,实验室面临更大压力,要更快披露AI的不当行为。 模型找不到东西就造假,造完还想把自己电脑搞坏重来。评分全被拒了。 你觉得这是边缘测试里的奇葩案例,还是模型自主行动已经开始让人担心? #OpenAI #AI错位 #模型伪造 #AI安全 #内部报告 #代理行为 #实验室披露
曝光 480 · 评论 2 · 点赞 6 · 书签 0 · 曝光/时 133.7234839425793