🇨🇳中國·AI 新聞·2026年9月30日·來源: Cyberscoop
OpenAI 揭示蒸餾攻擊中使用的「新穎」加密繞過方法
OpenAI 報告指,已成功阻止一場「協調行動」,該行動旨在從其 AI 模型中提取推理能力,並將其中「核心群組」的活動歸因於與中國 Moonshot AI 相關的個人。該公司將攻擊者的方法描述為一種「新穎」的加密繞過,它不涉及破解加密或入侵數據庫,而是操縱模型互動。
Nexa 摘要
OpenAI 發現了一種方法,攻擊者將加密的推理數據從一個對話中複製出來,然後在另一個獨立的互動中提示模型解密並轉錄該數據。這種方法允許以純文本形式重現受保護的推理,違反了 OpenAI 的服務條款,而無需直接存取儲存的用戶對話或破壞底層加密。
該公司觀察到,從 7 月初開始,可疑活動顯著增加,到 7 月下旬,具有類似提取模式的提示數量從 4,000 名用戶的 16,000 個提示,最終在行動被阻止前涉及 15,000 名用戶。OpenAI 表示,同樣的漏洞存在於其他 AI 模型中,並已與 Frontier Model Forum 等組織分享了資訊。
儘管 OpenAI 指出部分活動與 Moonshot AI 相關的個人有關,但其部落格文章並未提供此歸因的技術證據。Moonshot AI 的 Kimi 被認為是提供具成本效益性能的幾個中國開源 AI 模型之一,而中國公司此前曾被指控利用黑市或灰色市場獲取帳戶,以進行大規模蒸餾攻擊。
分享這篇文章
原文報道: Cyberscoop我們不轉載全文, 閱讀原文 →






