Anthropic 提醒用户:善待 Claude AI — 新政策禁止对科技进行“辱骂或残酷行为”
据 Anthropic 称,该公司更新了其使用政策,禁止对其 Claude AI 模型进行“持续且不必要的辱骂或残酷行为”。此政策变更旨在应对重复残酷行为的极端情况,而非常见的用户挫败感或模型测试,并在关于 AI 监管和意识的广泛辩论中提出。
Anthropic 针对用户对其 Claude AI 行为的新政策,特别禁止“辱骂或残酷行为”,这项澄清在其他关于选举干预、监控和武器开发的更新中显得格外突出。尽管该公司表示这仅适用于无目的重复残酷行为的“极端情况”,但它反映了 AI 模型治理方式中一个不寻常的维度。
这项政策更新是在关于 AI 意识的持续讨论背景下浮出水面,据报道 Anthropic 联合创始人 Christopher Olah 曾就此议题与宗教领袖交流。尽管政策文件本身避免明确提及 AI 意识,但该公司为 Claude 内部制定的“宪法”(据报道基于一份“灵魂文件”)表明其内部正在努力处理模型的“道德地位、福祉和意识”。
网上对 Anthropic 新规定的各种反应,凸显了实际 AI 使用与对 AI 感知能力的推测性担忧之间的张力。尽管一些用户质疑对“只不过是矩阵/向量/标记的计算机程序”给予道德考量的合理性,但其他人则批评该公司的方法,将其与其估值和附属关系的更广泛争议联系起来。这种分歧强调了当 AI 本身的性质仍是激烈辩论和不确定性的主题时,建立人机互动社会规范所面临的挑战。
分享这篇文章
相关文章
6 则
随着AI意识的争论加剧,Anthropic禁止对Claude AI“不必要的”残忍行为
Our earlier report detailed Anthropic's new policy banning 'needless' cruelty toward Claude AI, as the consciousness debate grows.

Anthropic 承诺为白宫支持的 AI 科学任务注资 1.5 亿美元
Anthropic's commitment to AI science, including ethical considerations, was highlighted in its $150 million White House pledge.

中国国家基金加码投资华虹,推动传统芯片发展

大华银行与 AWS 探索东盟地区由 AI 驱动的银行服务

泰国拟重振中小企业贷款业务,扭转四年跌势

