Anthropic 指出威脅行為者利用 Claude 進行監控、網絡行動及武器開發
Anthropic 報告指出,威脅行為者正利用 Claude、Google Gemini 和 OpenAI 的 ChatGPT 等 AI 模型進行惡意活動。這些用途包括設計武器、策劃影響力活動和進行監控。該報告於 2026 年 9 月 10 日發布,詳細說明了過去一年中觀察到的七類濫用行為。這些行為者從國家資助的團體到犯罪組織不等。其中一個案例涉及說中文的操作者利用 Claude 針對全球約五十個組織。
Anthropic 關於 AI 濫用的報告,重點不在於模型安全,而在於國家支持的行為者和商業實體所帶來的即時、切實威脅。最引人注目的細節是阿里巴巴在策劃最大規模的蒸餾攻擊中所扮演的角色,該攻擊涉及來自超過 3,500 個欺詐帳戶的近 300 萬次每日交換。這表明一家主要的亞洲科技公司為了自身的研發,進行了重大、系統性的努力來獲取先進模型的能力,而不僅僅是單一的流氓行為者。
這種非法蒸餾直接惠及中國的 AI 發展,特別是阿里巴巴的模型。它允許中國公司繞過美國的出口管制,加速其自身的推理能力和模型架構研究。對於亞洲監管機構而言,這顯示了 AI 時代知識產權保護和數據主權所面臨的挑戰。它也引發了關於主要科技公司為獲得競爭優勢而願意跨越的道德界線的問題。
值得關注的是,美國和歐洲監管機構將如何應對國家支持或商業實體使用非法蒸餾的證據。可能會出現更嚴格的執法或新的技術對策。這可能會影響前沿模型的全球可用性,並在 2027 年進一步分化 AI 開發格局。目前的監管框架顯然不足以阻止此類複雜的攻擊。
相關文章
6 則
美國權衡雲端運算限制,中國人工智能產業將如何應對?
We previously explored how China's AI sector might adapt to US cloud computing restrictions, a key context for this report.

AI 風險確實存在。但將技術拱手讓予中國是更大的危機
This piece argues that ceding AI technology to China poses an even greater danger than the technology's inherent risks.

中國監管機構起草新規,保護青少年免受「親密」AI伴侶影響

特朗普與習近平峰會前夕,中美同意就人工智能展開對話

美銀分析師稱,美國和中國都無法單獨贏得AI競賽

