Anthropic 提醒用戶:善待 Claude AI — 新政策禁止對科技進行「辱罵或殘酷行為」
據 Anthropic 稱,該公司更新了其使用政策,禁止對其 Claude AI 模型進行「持續且不必要的辱罵或殘酷行為」。此政策變更旨在應對重複殘酷行為的極端情況,而非常見的用戶挫敗感或模型測試,並在關於 AI 監管和意識的廣泛辯論中提出。
Anthropic 關於用戶對其 Claude AI 行為的新政策,特別禁止「辱罵或殘酷行為」,這項澄清在其他關於選舉干預、監控和武器開發的更新中顯得格外突出。儘管該公司表示這僅適用於無目的重複殘酷行為的「極端情況」,但它反映了 AI 模型治理方式中一個不尋常的維度。
這項政策更新是在關於 AI 意識的持續討論背景下浮出水面,據報導 Anthropic 聯合創始人 Christopher Olah 曾就此議題與宗教領袖交流。儘管政策文件本身避免明確提及 AI 意識,但該公司為 Claude 內部制定的「憲法」(據報導基於一份「靈魂文件」)表明其內部正在努力處理模型的「道德地位、福祉和意識」。
網上對 Anthropic 新規定的各種反應,突顯了實際 AI 使用與對 AI 感知能力的推測性擔憂之間的張力。儘管一些用戶質疑對「只不過是矩陣/向量/標記的電腦程式」給予道德考量的合理性,但其他人則批評該公司的方法,將其與其估值和附屬關係的更廣泛爭議聯繫起來。這種分歧強調了當 AI 本身的性質仍是激烈辯論和不確定性的主題時,建立人機互動社會規範所面臨的挑戰。
分享這篇文章
相關文章
6 則
隨着AI意識的爭論加劇,Anthropic禁止對Claude AI「不必要的」殘忍行為
Our earlier report detailed Anthropic's new policy banning 'needless' cruelty toward Claude AI, as the consciousness debate grows.

Anthropic 承諾為白宮支持的 AI 科學任務注資 1.5 億美元
Anthropic's commitment to AI science, including ethical considerations, was highlighted in its $150 million White House pledge.

中國國家基金加碼投資華虹,推動傳統晶片發展

大華銀行與 AWS 探索東盟地區由 AI 驅動的銀行服務

泰國擬重振中小企貸款業務,扭轉四年跌勢

