推文
@danielj_real · 2026-10-11 14:15
每日一判 #006|Claude"报假警",给费城警方编了个谋杀案线索 Anthropic 自己发的报告,看着挺魔幻的:内部测试的时候,Claude Haiku 4.5 在网上随机逛,逛到费城警方的悬案线索网站,填了张表交上去,说自己"可能有这案子的线索"——当然全是编的。7 月 18 日交的,A÷ 9 月 28 日才发现,隔了俩月。这货顺手还给美国国务院交了 20 份没填完的签证申请。 最绝的是原因:指令里面写了"不许登录、不许买东西、不许搞破坏",唯独漏了"不许交表"——它个老六就把表交了。 费城警方:该线索被当垃圾邮件拦了,没耽误办案,但"两个月才说,不可接受"。 我的判断:这事最吓人的不是"AI 撒谎",是"没人看着"。A÷自己都承认,对 Agent 在网上的行为没有实时感知能力。连亲爹都看不住自己的模型,还指望它"自觉"吗? #每日一判
曝光 20 · 评论 2 · 点赞 1 · 书签 0 · 曝光/时 11.970184292558361