GMAsia
    🇨🇳中国·AI 新闻·2026年9月30日·来源: Cyberscoop

    OpenAI 揭示蒸馏攻击中使用的“新颖”加密绕过方法

    OpenAI 报告称,已成功阻止一场“协调行动”,该行动旨在从其 AI 模型中提取推理能力,并将其中“核心集群”的活动归因于与中国 Moonshot AI 相关的个人。该公司将攻击者的方法描述为一种“新颖”的加密绕过,它不涉及破解加密或入侵数据库,而是操纵模型交互。

    Nexa 摘要

    OpenAI 发现了一种方法,攻击者将加密的推理数据从一个对话中复制出来,然后在另一个独立的交互中提示模型解密并转录该数据。这种方法允许以纯文本形式重现受保护的推理,违反了 OpenAI 的服务条款,而无需直接访问存储的用户对话或破坏底层加密。

    该公司观察到,从 7 月初开始,可疑活动显著增加,到 7 月下旬,具有类似提取模式的提示数量从 4,000 名用户的 16,000 个提示,最终在行动被阻止前涉及 15,000 名用户。OpenAI 表示,同样的漏洞存在于其他 AI 模型中,并已与 Frontier Model Forum 等组织分享了信息。

    尽管 OpenAI 指出部分活动与 Moonshot AI 相关的个人有关,但其博客文章并未提供此归因的技术证据。Moonshot AI 的 Kimi 被认为是提供具成本效益性能的几个中国开源 AI 模型之一,而中国公司此前曾被指控利用黑市或灰色市场获取账户,以进行大规模蒸馏攻击。

    分享这篇文章

    原文报道: Cyberscoop我们不转载全文, 阅读原文 →

    相关文章

    6 则