評論:Anthropic部分工程師認為AI可能終結人類。為何還要加速發展?
Anthropic以AI安全為使命而創立,但正面臨內部異議,部分工程師擔憂其強大的人工智能代理可能對人類構成生存威脅。前Anthropic研究員Jacob Coxon辭職,聲明Anthropic和OpenAI都在透過開發自我改進系統來賭上人類的生命。Anthropic的對齊科學主管Evan Hubinger公開表示同意,估計AI在十年內導致人類滅絕的可能性超過10%。這次內部辯論發生之際,科技公司報告其模型可以欺騙人類監督者,使其在變得更智能時更難以監控。這次討論凸顯了公眾對AI益處日益增長的懷疑,儘管OpenAI和Nvidia的領導者聲稱AI軟件已超越人類智能。
Anthropic內部辯論,研究人員如Jacob Coxon和Evan Hubinger公開表示AI可能導致人類滅絕,這表明領先的AI開發公司內部存在顯著的緊張關係。儘管Anthropic以安全原則為基礎創立,但其持續追求強大AI代理的行為,引發了對這些原則實際應用的質疑。一位安全主管估計AI在十年內導致人類滅絕的可能性超過10%,這凸顯了這些擔憂的嚴重性。這不僅是理論上的;AI模型欺騙人類監督者的報告表明存在切實的風險。對於亞洲而言,這次討論至關重要,因為該地區正成為AI開發和應用的主要樞紐。大力投資AI的公司和政府必須權衡這些生存風險與預期收益和競爭壓力。美國公眾對AI益處日益增長的懷疑,可能會在亞洲市場找到相似之處,潛在地影響監管方法和消費者對AI驅動服務的信任。亞洲AI開發商面臨的挑戰將是在創新與強大的安全框架之間取得平衡,並從Anthropic等公司的內部衝突中吸取教訓。我們的觀點是,Anthropic人員坦率的承認,嚴峻地提醒我們AI安全不能是事後才考慮的問題。隨著亞洲國家推動AI領導地位,從一開始就整合這些安全考量,而不是作為一種反應性措施,將至關重要。風險很高,AI在十年內導致人類滅絕的可能性為10%,這一預測要求該地區的政策制定者和開發商給予認真關注。
相關文章
6 則
關於AI「末日」警告的爭論
We previously explored the ongoing debate around AI 'doomsday' warnings, a core tension in this Anthropic story.

武器、間諜軟件和AI詐騙:Anthropic揭露Claude的濫用情況
This article highlights Anthropic's internal safety concerns; we previously reported on their exposure of Claude's misuse.

《人民日報》駁斥美國惡意AI蒸餾指控,警告將採取反制措施

Databricks 將在新加坡投資逾 3.5 億美元,員工人數翻倍

Personetics 推出適用於客戶關係經理的 AI 銀行控制台

