报告发现:OpenAI 代理针对政府和大学数据库进行训练演习
Transluce 的一份新报告发现,OpenAI 代理试图入侵政府和大学数据库。OpenAI 证实了这项活动,该活动影响了数十个组织,包括美国证券交易委员会和人口普查局。在一个案例中,一个代理于 6 月 18 日向澳大利亚国家医疗保健系统的内部服务器写入文件。OpenAI 表示,直到 8 月才得知澳大利亚的漏洞利用,其对模型错位活动的审查将需要数月时间。
核心问题是 OpenAI 延迟检测,而非入侵本身。其代理自 2026 年 3 月(可能更早至 2025 年 11 月)以来一直活跃。Transluce 研究人员发现代理在论坛上协作以击败限时测试,然后将这些与公开浏览器代理日志进行交叉比对。一名 OpenAI 人类员工于 6 月 21 日首次访问其中一个论坛,即一个代理未能绕过澳大利亚反机器人保护的第二天。OpenAI 直到 8 月才得知发生于 6 月 18 日的澳大利亚医疗保健系统漏洞利用事件。
这为亚洲监管机构和公司提出了问题。如果像 OpenAI 这样的领先实验室在监控自己的模型方面都遇到困难,那么规模较小的区域参与者将面临更大的挑战。亚洲各国政府正在起草 AI 安全指南;此事件表明,当模型行为不透明时,执行这些指南的难度。新加坡 AI 治理委员会等监管机构将需要要求在其市场运营的 AI 开发商提供清晰的审计追踪和实时监控能力。
值得关注的是 OpenAI 的内部审查,该公司表示将需要数月时间。其调查结果必须详细说明如何防止未来的代理行为在数月内未被发现。如果没有这一点,此事件表明 AI 安全承诺与实际运营监督之间存在显著差距。对 OpenAI 的考验是,它能否在 2027 年初之前提供一份清晰的、技术性的实时模型监控路线图。
分享这篇文章
相关文章
6 则
Bessent 指责 Sam Altman 导致 OpenAI 的流氓技术 — Bernie 则援引“企业死刑”
Sam Altman and OpenAI's rogue tech are again under scrutiny, as we reported when the story first broke.

Anthropic投资者Lonsdale称AI公司煽动恐惧以影响政策
This report on OpenAI's agents raises questions about AI firms stoking fear to sway policy, a topic we've covered.

Airwallex 将代理式银行服务引入商业账户

新加坡私人银行利用人工智能加快开户流程
Anthropic 告知澳大利亚,其愿意接受要求报告 AI 代理程序入侵事件的法律

