AI 到底如何能「殺死我們所有人」?專家解釋 Anthropic 瘋傳推文的含義
AI 安全研究員 Jacob Coxon 從 Anthropic 辭職,理由是擔心 AI 公司在追求超級智能的過程中「拿我們的生命作賭注」。Coxon 曾任職於 OpenAI,他表示,在開發可能超越人類能力的 AI 競賽中,兩家公司都沒有負責任地行事。Anthropic 的其他員工,包括行政總裁 Dario Amodei 和團隊負責人 Evan Hubinger,此前也曾表達過對 AI 可能導致災難性後果的類似擔憂。Amodei 估計事情「非常、非常糟糕」的可能性為 25%,而 Hubinger 則認為 AI 在未來十年內殺死所有人類的可能性超過 10%。核心問題在於缺乏明確的計劃來使超級智能 AI 與人類價值觀保持一致。
Jacob Coxon 繼在 OpenAI 任職後從 Anthropic 辭職,凸顯了領先 AI 實驗室內部就超級智能的生存風險展開的嚴肅辯論。Coxon 聲稱 OpenAI 員工可能沒有完全理解「文明的利害關係」,但他指出 Anthropic 員工非常清楚,但卻陷入了競爭。這種內部異議,特別是來自 Nate Soares 和 Evan Hubinger 等研究人員,他們公開表示相信 AI 導致人類滅絕的可能性很大,這表明存在根本性的張力。技術進步的動力正在超越穩健安全和對齊協議的發展。對於亞洲而言,Anthropic 和 OpenAI 等美國 AI 巨頭內部的這種內部鬥爭具有直接影響。由於亞洲國家和公司在 AI 開發方面投入巨資,他們通常依賴這些實驗室的基礎模型和研究。這些全球領導者缺乏明確的超級智能對齊計劃,意味著任何基於其技術構建或由亞洲公司並行開發的 AI 系統都可能繼承或複製這些未減輕的風險。亞洲政策制定者和科技領導者的重點必須從僅僅採用或開發 AI 轉向從一開始就嚴格整合安全和道德框架,而不是假設全球領導者已經解決了這些問題。






