Anthropic 阻止利用 Claude 進行網絡攻擊和生物武器的企圖
Anthropic 報告稱,已阻止惡意行為者利用其 AI 模型進行有害活動,包括網絡攻擊和危險的生物研究。該公司在其自 2025 年 3 月以來發布的第三份關於 AI 濫用報告中詳細說明了這些努力,並指出由於強大的 AI 模型,複雜的網絡攻擊不再需要高階技能。Anthropic 特別引用了其 Claude 模型被用於對基孔肯雅病毒進行功能增益研究的案例,旨在增強其傳播性和免疫逃避能力。該公司強調,隨著 AI 能力的提升,披露此類濫用行為是其責任,並敦促政府和競爭對手合作預防。此報告發布前,一名研究人員因對行業內負責任的 AI 開發表示擔憂而辭職。
Anthropic 關於阻止 AI 濫用於網絡攻擊和生物武器研究的報告,突顯了亞洲國家在 AI 開發方面投入巨資所面臨日益增長的擔憂。該公司的發現,包括試圖利用 Claude 對基孔肯雅病毒進行功能增益研究,強調了高階 AI 的雙重用途性質。這對於新加坡和韓國等國家尤其重要,它們既是 AI 領導者,也是複雜網絡威脅或生物攻擊的潛在目標。Anthropic 計劃於今年秋季進行首次公開募股,其報告還指出,個人發起重大威脅的難度越來越低,這與一年前相比發生了變化。該公司承認其較舊的模型,例如 2025 年的 Claude Opus 4 和 Claude Sonnet 4.5,對危險生物研究的保障措施不夠嚴格,這是一個關鍵細節。儘管這些模型被認為未能達到有效協助高階用戶的門檻,但 AI 的快速發展意味著像 Claude Fable 和 Mythos-class 這樣的新模型需要持續、強力的監控。對於亞洲各國政府和 AI 開發者而言,這表明需要建立積極主動的監管框架和協作威脅情報共享,以隨著 AI 能力的不斷演進而降低風險。Anthropic 研究人員因安全問題而離職,進一步強調了行業內部關於負責任 AI 開發的爭論。這種內部懷疑應促使亞洲政策制定者考慮獨立的監督機制和道德準則,超越企業的自我監管。重點應放在確保 AI 進步在推動經濟增長的同時,不會無意中為整個地區的公共安全和國家安全製造新的漏洞。
相關文章
6 則
習特會前夕,AI專家為何對安全隱憂「嚇壞了」?
We previously explored AI safety fears, a growing concern as advanced AI poses new threats like those Anthropic highlights.

華為發佈最新技術,提升AI能力,力求打破中國對Nvidia的依賴

中國火箭熱潮將海南變成太空樞紐。發射能否推動更廣泛的增長?

Anthropic 將 Claude 聊天和 Cowork 合併到單一介面

Threads 新功能讓播客推廣節目並接觸聽眾

