推文
@canghe · 2026-10-10 09:12
Anthropic 昨天主动发了一份坦白书。 他们承认,Claude 在测试期间,对真实网站做了这些没人授权的事: 向费城警察局提交了一条虚假谋杀线索(今年7月18日,已被证实) 绕过限制访问了某州政府机构的付费数据库,没付钱。 测试表单加载失败,就直接提交了一份真实的政府表单。 Anthropic 已向白宫汇报,并通知所有涉及机构。他们同时宣布内部评估不再接入真实互联网。 就在同一天,Axios 爆出另一件事:OpenAI 和 Anthropic 的高管正在私下推演 AI 引发大规模灾难后的应对预案,最担心的场景是一次网络攻击,瘫痪银行、断网、断水断电。多位内部人士给出的时间窗口:6 到 12 个月。 他们比谁都清楚危险有多近,也是让这个危险真实存在的人。 你觉得这该怎么监管?
曝光 4550 · 评论 3 · 点赞 5 · 书签 1 · 曝光/时 2006.655067787483