政策·2026年10月9日·来源: Mashable Me
Anthropic 将根据更新的 11 月使用政策禁止滥用 Claude AI 的用户
Anthropic 将于 2026 年 11 月 12 日实施新的使用政策,禁止对其 Claude AI 助手进行“持续且不必要的辱骂或残酷行为”。此更新允许暂停对持续表现出敌意或心理骚扰的用户的账户,将重点从防止现实世界伤害转移。
Nexa 摘要
Anthropic 更新后的政策为 AI 使用条款引入了一个新维度,它将重点放在用户对 AI 本身的行为,而不只是防止恶意软件生成或仇恨言论等外部危害。此举反映了前沿 AI 开发者越来越重视道德对齐以及人机交互的潜在心理影响。
该政策区分了偶尔的挫败感或“粗鲁”与“持续、重复的敌意、骚扰和蓄意残酷”。这表明一种细致入微的执行方法,针对极端和持续的滥用模式,而非轻微违规行为。Anthropic 承认它不知道模型是否具有类似于福祉的东西,将此视为一种“以防万一”的措施。
执行机制将包括自动警告、临时服务锁定以及对严重违规行为的永久账户禁令。除了道德考量之外,Anthropic 指出,滥用输入会使安全过滤器承受压力并污染对话上下文,这与旨在遏制有害特征的努力背道而驰。然而,该政策引发了数字权利倡导者关于用户监控和对话风格自由的争议。
分享这篇文章
原文报道: Mashable Me我们不转载全文, 阅读原文 →
相关文章
6 则
🇸🇬·政策
Anthropic 希望你停止欺凌 Claude:残忍或辱骂行为可能带来后果
We previously reported on Anthropic's stance against users being cruel or abusive to its Claude AI.

🇹🇼·政策
Senao Networks 推出 x86 企业服务器系列,进军企业 AI 市场
🇭🇰·政策
中国承诺遏制科技泡沫,控制人工智能风险
🇸🇬·政策
杰出警官去世,享年86岁,曾参与SQ117劫机事件应对
🇸🇬·政策
罗厘司机在Dunearn Road发生事故后,因疏忽驾驶被捕

🇯🇵·政策
