Em comunicado publicado em 30 de setembro de 2026, a OpenAI disse ter identificado e interrompido uma campanha coordenada para tentar extrair o raciocínio protegido de seus modelos. A empresa situou o início da atividade em 1º de julho e atribuiu um núcleo a pessoas associadas à Moonshot AI, desenvolvedora do Kimi.

O caso é distinto das acusações dos EUA sobre destilação de modelos abordadas em uma reportagem anterior da NeoTeo. Aqui, a OpenAI descreveu tentativas de expor raciocínio protegido por meio de interações com modelos.

Cronologia e escala da atividade relatada

A OpenAI descreveu uma sequência que começou com atividade de baixo volume em julho e teve picos no fim do mês. Nos dias 24 e 25, a empresa registrou 16 mil solicitações com um padrão associado à extração, envolvendo mais de 4 mil usuários. Segundo a OpenAI, esse número conta tentativas, não extrações necessariamente bem-sucedidas.

A empresa também relatou padrões de prompts relacionados em um grupo distinto, com mais de 15 mil usuários. A OpenAI disse que interrompeu essa atividade até 28 de julho.

DataEvento relatado pela OpenAI
1º de julho de 2026A atividade começou em baixo volume.
24 e 25 de julho de 2026Picos de 16 mil solicitações de tentativa de extração, envolvendo mais de 4 mil usuários.
28 de julho de 2026A OpenAI disse ter interrompido a atividade relacionada identificada em um grupo de mais de 15 mil usuários.

Como funcionava a tentativa descrita

Raciocínio protegido é o registro interno de como um modelo trabalha em uma tarefa. A OpenAI diz que esse tipo de informação pode revelar conteúdo que não aparece na resposta final.

Um método descrito pela empresa envolvia copiar raciocínio criptografado de uma conversa e pedir a um modelo, em outra conversa, que o descriptografasse e transcrevesse. A OpenAI caracterizou a abordagem como manipulação das interações com modelos. Afirmou também que os operadores não quebraram sua criptografia, não comprometeram um banco de dados nem acessaram diretamente conversas armazenadas.

A resposta da OpenAI e o alcance da atribuição

A OpenAI relatou ter banido ou restringido contas fraudulentas, reforçado controles de cadastro e de infraestrutura e ampliado o monitoramento. Também disse ter adicionado proteções para raciocínio oculto e verificações para detectar e reter respostas que pudessem expô-lo. A empresa compartilhou informações sobre a categoria de ataque com parceiros do setor e do governo, inclusive por meio do Frontier Model Forum.

A atribuição da OpenAI se limitou a um núcleo da atividade, associado pela empresa a indivíduos ligados à Moonshot AI. A empresa disse que não estava claro se todos os operadores observados vinham de um único agente.