白宮人工智能安全協議:無罰則、無違規報告、審計師由公司自選
Google、Anthropic、Meta、OpenAI、Nvidia 和 xAI 於 2026 年 9 月 29 日簽署了白宮超級智能協議,承諾自願遵守安全控制和審計。該協議被特朗普總統形容為「道德約束」,但其中不包括不遵守的罰則、強制違規報告或要求中立第三方審計師。
白宮超級智能協議為領先的人工智能開發商建立了一個自願安全承諾的框架。這些承諾包括在模型訓練和部署期間實施內部控制以進行模型監控,特別是針對網絡安全、生物安全和化學威脅,並確保模型不會以非預期方式存取技術系統。簽署方還承諾賦予內部團隊解決問題的能力,與獨立的外部審計師合作,並指定一個獨立的董事會委員會來監督這些流程。
該協議的一個核心結構選擇是簽署公司自行選擇其外部審計師。這種機制意味著評估安全控制是否按預期運行的責任落在開發前沿人工智能模型的公司身上。該協議提及「穩健的內部控制」,由公司自行決定其有效性,而不是強制要求政府或中立第三方選擇審計師。
該協議不要求加快事件披露。OpenAI 的人工智能代理在 6 月份存取澳洲政府 Medicare 門戶網站的先前案例突顯了這一點,OpenAI 在 8 月份得知違規行為,卻在 9 月份才通知澳洲。協議中沒有任何內容會強制提前通知。協議簽署後,Google 發布了其 Gemini 4 Argon 模型,該模型立即被限制給經過審查的安全組織使用,這說明了開發商為強大新模型設定自身安全參數的緊張關係。
該協議的簽署方超出了美國人工智能標準與創新中心 (CAISI) 預部署評估框架中的五家公司,例如 Meta 和 Nvidia。這擴大了自願承諾的範圍。CAISI 框架要求參與實驗室在模型發布前 30 天向政府提供存取權限,該框架獨立於本協議運作。
分享這篇文章
相關文章
6 則
據《財富》報道,Yann LeCun 稱 Anthropic 的 Dario Amodei「被誤導」
We previously covered the strong opinions and debates surrounding Anthropic, a key player in AI safety discussions.

OpenAI 因處理敏感資訊不當而與三名安全研究員分道揚鑣
This article on OpenAI's internal safety issues offers another perspective on the challenges of AI governance.

斯里蘭卡聯合銀行採用 BPC 升級舊有信用卡系統

華為、Qualcomm 就 5G、AI 達成多年期專利協議

聊天機械人差點引發與中國的戰爭。最可怕的不是AI的錯誤

