Anthropic 阻止利用 Claude 进行网络攻击和生物武器的企图
Anthropic 报告称,已阻止恶意行为者利用其 AI 模型进行有害活动,包括网络攻击和危险的生物研究。该公司在其自 2025 年 3 月以来发布的第三份关于 AI 滥用报告中详细说明了这些努力,并指出由于强大的 AI 模型,复杂的网络攻击不再需要高级技能。Anthropic 专门引用了其 Claude 模型被用于对基孔肯雅病毒进行功能增益研究的案例,旨在增强其传播性和免疫逃避能力。该公司强调,随着 AI 能力的提升,披露此类滥用行为是其责任,并敦促政府和竞争对手合作预防。此报告发布前,一名研究人员因对行业内负责任的 AI 开发表示担忧而辞职。
Anthropic 关于阻止 AI 滥用于网络攻击和生物武器研究的报告,凸显了亚洲国家在 AI 开发方面投入巨资所面临日益增长的担忧。该公司的发现,包括试图利用 Claude 对基孔肯雅病毒进行功能增益研究,强调了高级 AI 的双重用途性质。这对于新加坡和韩国等国家尤其重要,它们既是 AI 领导者,也是复杂网络威胁或生物攻击的潜在目标。Anthropic 计划于今年秋季进行首次公开募股,其报告还指出,个人发起重大威胁的难度越来越低,这与一年前相比发生了变化。该公司承认其较旧的模型,例如 2025 年的 Claude Opus 4 和 Claude Sonnet 4.5,对危险生物研究的保障措施不够严格,这是一个关键细节。尽管这些模型被认为未能达到有效协助高级用户的门槛,但 AI 的快速发展意味着像 Claude Fable 和 Mythos-class 这样的新模型需要持续、强力的监控。对于亚洲各国政府和 AI 开发者而言,这表明需要建立积极主动的监管框架和协作威胁情报共享,以随着 AI 能力的不断演进而降低风险。Anthropic 研究人员因安全问题而离职,进一步强调了行业内部关于负责任 AI 开发的争论。这种内部怀疑应促使亚洲政策制定者考虑独立的监督机制和道德准则,超越企业的自我监管。重点应放在确保 AI 进步在推动经济增长的同时,不会无意中为整个地区的公共安全和国家安全制造新的漏洞。
相关文章
6 则
习特会前夕,AI专家为何对安全隐忧“吓坏了”?
We previously explored AI safety fears, a growing concern as advanced AI poses new threats like those Anthropic highlights.

《人民日报》驳斥美国恶意AI蒸馏指控,警告将采取反制措施

Databricks 将在新加坡投资逾 3.5 亿美元,员工人数翻倍

Personetics 推出适用于客户关系经理的 AI 银行控制台

Anthropic 计划十月在新加坡设立办事处并进行本地招聘

