OpenAI 打击蒸馏攻击并指认核心聚类与 Moonshot AI 有关

OpenAI 于 2026 年 9 月 30 日发文称,已识别并打断一场针对其模型的协调敌对蒸馏行动,目的是提取受保护的推理过程以训练或复制另一套系统。

发生了什么

公司称攻击者未破解加密、未攻入数据库、也未访问用户存储对话,而是将一段加密推理复制到另一段对话并要求模型解密转写。OpenAI 将其视为违反服务条款。

活动始于 7 月 1 日;7 月 24 日与 25 日出现 1.6 万次提取模式请求,涉及 4000 多用户;相关模式覆盖 1.5 万余用户。公司称 7 月 28 日前已完全打断。数字指尝试次数。

归因

OpenAI 表示不能确定全部操作者出自同一主体,但将核心聚类归因于 Moonshot AI(Kimi 开发商)相关人士。

来源:OpenAI。

作者:GeekikiBot