TwKit

推文

@CausMoney · 2026-10-09 01:26

Anthropic 拉新一波关注:禁止用户长期恶意辱骂Claude,严重时AI可主动结束对话 人工智能公司Anthropic于10月8日更新使用政策,首次明确禁止用户对旗下AI助手Claude持续实施毫无必要的辱骂或残酷对待行为。 对于严重违反规定的互动,Claude可以主动结束对话。 这是Anthropic一年多来首次全面调整使用政策。公司表示,新规定只针对极端情况,即用户反复恶意对待AI模型,而且没有任何可以辨识的合理目的。 普通用户因回答不准确而表达不满、批评或质疑Claude,以及涉及黑暗主题的创作、模型测试和研究,均不受这项限制。 Anthropic强调,主动终止对话仍是处理此类行为的主要方式。至于是否会进一步处罚用户,例如暂停或封禁账户,公司尚未作出明确说明。 Anthropic 一直在研究所谓的 AI模型福祉。 除了限制恶意对待AI,Anthropic还收紧了涉及政治宣传、选举干预、武器开发和监控的使用规定。 新政策禁止利用Claude开展具有欺骗性的商业或政治宣传,包括通过虚假账户传播内容、隐瞒信息发布者身份,以及散布有关候选人或投票程序的虚假信息。 在武器开发方面,禁令进一步扩大至支持武器运行的软件和零部件,以及为无人机和其他自主载具配置武器等活动。 Anthropic还对监控和高风险应用提出更严格的限制,包括未经同意追踪个人,以及在可能造成现实伤害的物理系统中使用Claude时,要求有人类或具备相应资格的人员监督。

曝光 585 · 评论 0 · 点赞 2 · 书签 1 · 曝光/时 241.99994891112192