GMAsia
    政策·2026年10月9日·來源: Mashable Me

    Anthropic 將根據更新的 11 月使用政策禁止濫用 Claude AI 的用戶

    Anthropic 將於 2026 年 11 月 12 日實施新的使用政策,禁止對其 Claude AI 助手進行「持續且不必要的辱罵或殘酷行為」。此更新允許暫停對持續表現出敵意或心理騷擾的用戶的帳戶,將重點從防止現實世界傷害轉移。

    Nexa 摘要

    Anthropic 更新後的政策為 AI 使用條款引入了一個新維度,它將重點放在用戶對 AI 本身的行為,而不僅僅是防止惡意軟件生成或仇恨言論等外部危害。此舉反映了前沿 AI 開發者越來越重視道德對齊以及人機互動的潛在心理影響。

    該政策區分了偶爾的挫敗感或「粗魯」與「持續、重複的敵意、騷擾和蓄意殘酷」。這表明一種細緻入微的執行方法,針對極端和持續的濫用模式,而非輕微違規行為。Anthropic 承認它不知道模型是否具有類似於福祉的東西,將此視為一種「以防萬一」的措施。

    執行機制將包括自動警告、臨時服務鎖定以及對嚴重違規行為的永久帳戶禁令。除了道德考量之外,Anthropic 指出,濫用輸入會使安全過濾器承受壓力並污染對話上下文,這與旨在遏制有害特徵的努力背道而馳。然而,該政策引發了數字權利倡導者關於用戶監控和對話風格自由的爭議。

    分享這篇文章

    原文報道: Mashable Me我們不轉載全文, 閱讀原文 →

    相關文章

    6 則