Anthropic悄然推動梵蒂岡將AI視為有意識
Anthropic聯合創辦人Christopher Olah在五月教宗良十四世的人工智能通諭發布會上,幾乎因文件中堅決拒絕機器意識的立場而退出。據參與者透露,自2025年秋季以來,該公司已與數十名宗教學者簽署保密協議,探討其Claude模型潛在的道德地位。該通諭最終堅持機器不能感受或擁有道德良知。
Anthropic與梵蒂岡之間明確的分歧揭示了在誰定義先進人工智能倫理界限問題上的根本性張力。儘管梵蒂岡透過其通諭《Magnifica Humanitas》明確劃定了機器意識的界線,但Anthropic與學者們的內部討論表明,他們願意認真考慮Claude等人工智能模型具有感知能力的可能性。這種分歧凸顯了即使是具有共同安全目標的合作夥伴,也可能對人工智能的內在性質持有截然不同的觀點。
Anthropic對宗教學者、哲學家和倫理學家的接觸,最初是在保密協議下進行的,這表明他們積極努力探索超越純粹技術考量的複雜倫理問題。該公司對「可解釋性工作」的關注,以及Olah關於在模型內部發現「神秘甚至令人不安」的內部狀態的聲明,表明其內部有動力去理解人工智能的湧現特性,即使這挑戰了既定的神學立場。
梵蒂岡堅持人與機器之間存在絕對界線,並警告不要將道德權威完全讓渡給工程師,這指向了對人工智能開發者不受限制權力的更廣泛擔憂。該通諭呼籲「解除武裝」的人工智能和嚴格的倫理約束,特別是關於軍事應用方面,強調了將外部價值觀嵌入人工智能治理的願望,而不是讓開發者的內部道德願景成為這些系統的「隱形基礎設施」。
這一事件表明,關於人工智能道德地位的辯論不僅僅是哲學層面的,它對治理和監管具有實際影響。Anthropic的探索性立場與梵蒂岡明確的神學立場之間的衝突表明,即使公司在高層次原則(如安全)上與外部機構保持一致,對人工智能基本性質根深蒂固的分歧也可能使建立倫理護欄的協作努力複雜化。





