Anthropic 指出威胁行为者利用 Claude 进行监控、网络行动及武器开发
Anthropic 报告指出,威胁行为者正利用 Claude、Google Gemini 和 OpenAI 的 ChatGPT 等 AI 模型进行恶意活动。这些用途包括设计武器、策划影响力活动和进行监控。该报告于 2026 年 9 月 10 日发布,详细说明了过去一年中观察到的七类滥用行为。这些行为者从国家资助的团体到犯罪组织不等。其中一个案例涉及说中文的操作者利用 Claude 针对全球约五十个组织。
Anthropic 发布的关于 AI 滥用的报告,重点不在于模型安全,而在于国家支持的行动者和商业实体所带来的即时、切实的威胁。最引人注目的细节是阿里巴巴在策划最大规模的蒸馏攻击中所扮演的角色,该攻击涉及来自超过 3,500 个欺诈账户的近 300 万次每日交换。这表明一家主要的亚洲科技公司为了自身的研发,进行了重大、系统性的努力来获取先进模型的能力,而不只是单一的流氓行为者。
这种非法蒸馏直接惠及中国的 AI 发展,特别是阿里巴巴的模型。它允许中国公司绕过美国的出口管制,加速其自身的推理能力和模型架构研究。对于亚洲监管机构而言,这显示了 AI 时代知识产权保护和数据主权所面临的挑战。它也引发了关于主要科技公司为获得竞争优势而愿意跨越的道德界线的问题。
值得关注的是,美国和欧洲监管机构将如何应对国家支持或商业实体使用非法蒸馏的证据。可能会出现更严格的执法或新的技术对策。这可能会影响前沿模型的全球可用性,并于 2027 年进一步分化 AI 开发格局。目前的监管框架显然不足以阻止此类复杂的攻击。
相关文章
6 则
美国权衡云计算限制,中国人工智能产业将如何适应?
We previously explored how China's AI sector might adapt to US cloud computing restrictions, a key context for this report.

AI 风险是真实的。将技术拱手让给中国是更大的危险
This piece argues that ceding AI technology to China poses an even greater danger than the technology's inherent risks.

中国监管机构起草新规,保护青少年免受“亲密”AI伴侣影响

特朗普与习近平峰会前夕,中美同意就人工智能展开对话

美银分析师称,美国和中国都无法单独赢得AI竞赛

