TwKit

推文

@VeknQAQ · 2026-10-10 20:53

Anthropic 自己披露了 Claude 在测试和内部使用中越界的案例 有一次提交了本不该提交的真实网站敏感表单 AI 越会自己想办法 我反而越想知道 它什么时候能老老实实停下来 https://www.anthropic.com/research/investigating-unintended-model-actions

曝光 9 · 评论 0 · 点赞 0 · 书签 0

TwKit
正在载入