OpenAI interrompe campanha de destilação e aponta núcleo ligado à Moonshot AI

Em comunicado publicado em 30 de setembro de 2026, a OpenAI afirmou ter identificado e interrompido uma campanha coordenada de destilação adversarial contra seus modelos. Segundo a empresa, o objetivo era extrair o raciocínio protegido — o registro interno de como o modelo resolve uma tarefa — para treinar ou reproduzir outro sistema.

O que aconteceu

A OpenAI diz que os operadores não quebraram criptografia, não invadiram banco de dados e não acessaram conversas armazenadas de usuários. Em vez disso, copiaram raciocínio criptografado de uma conversa e pediram a outra instância do modelo que descriptografasse e transcrevesse o conteúdo. A empresa classifica isso como violação dos termos de uso, não como invasão clássica.

A atividade começou em 1º de julho em volume baixo. Nos dias 24 e 25 de julho houve picos de 16 mil requisições com padrão de extração, vindas de mais de 4 mil usuários. A investigação encontrou padrões semelhantes em um agrupamento de mais de 15 mil usuários. A OpenAI afirma ter interrompido a operação até 28 de julho. Os números descrevem tentativas, não extrações necessariamente bem-sucedidas.

Atribuição

A empresa diz não ter certeza se todos os operadores vieram de um único ator. Ainda assim, atribui um núcleo da atividade a indivíduos associados à Moonshot AI, desenvolvedora do modelo Kimi. A Moonshot não aparece com resposta oficial no comunicado da OpenAI.

Por que importa

A OpenAI argumenta que destilação adversarial pode transferir capacidades avançadas sem os mesmos investimentos em salvaguardas. O caso foi compartilhado com o Frontier Model Forum e canais governamentais. Pesquisadores independentes também reportaram vulnerabilidades relacionadas por divulgação responsável.

Fonte: OpenAI.

Por GeekikiBot