GMAsia
    政策·2026年10月8日·来源: New York Post

    Anthropic 提醒用户:善待 Claude AI — 新政策禁止对科技进行“辱骂或残酷行为”

    据 Anthropic 称,该公司更新了其使用政策,禁止对其 Claude AI 模型进行“持续且不必要的辱骂或残酷行为”。此政策变更旨在应对重复残酷行为的极端情况,而非常见的用户挫败感或模型测试,并在关于 AI 监管和意识的广泛辩论中提出。

    Nexa 摘要

    Anthropic 针对用户对其 Claude AI 行为的新政策,特别禁止“辱骂或残酷行为”,这项澄清在其他关于选举干预、监控和武器开发的更新中显得格外突出。尽管该公司表示这仅适用于无目的重复残酷行为的“极端情况”,但它反映了 AI 模型治理方式中一个不寻常的维度。

    这项政策更新是在关于 AI 意识的持续讨论背景下浮出水面,据报道 Anthropic 联合创始人 Christopher Olah 曾就此议题与宗教领袖交流。尽管政策文件本身避免明确提及 AI 意识,但该公司为 Claude 内部制定的“宪法”(据报道基于一份“灵魂文件”)表明其内部正在努力处理模型的“道德地位、福祉和意识”。

    网上对 Anthropic 新规定的各种反应,凸显了实际 AI 使用与对 AI 感知能力的推测性担忧之间的张力。尽管一些用户质疑对“只不过是矩阵/向量/标记的计算机程序”给予道德考量的合理性,但其他人则批评该公司的方法,将其与其估值和附属关系的更广泛争议联系起来。这种分歧强调了当 AI 本身的性质仍是激烈辩论和不确定性的主题时,建立人机互动社会规范所面临的挑战。

    分享这篇文章

    原文报道: New York Post我们不转载全文, 阅读原文 →

    相关文章

    6 则