Em comunicado publicado em 30 de setembro de 2026, a OpenAI disse ter identificado e interrompido uma campanha coordenada para tentar extrair o raciocínio protegido de seus modelos. A empresa situou o início da atividade em 1º de julho e atribuiu um núcleo a pessoas associadas à Moonshot AI, desenvolvedora do Kimi.
O caso é distinto das acusações dos EUA sobre destilação de modelos abordadas em uma reportagem anterior da NeoTeo. Aqui, a OpenAI descreveu tentativas de expor raciocínio protegido por meio de interações com modelos.
Cronologia e escala da atividade relatada
A OpenAI descreveu uma sequência que começou com atividade de baixo volume em julho e teve picos no fim do mês. Nos dias 24 e 25, a empresa registrou 16 mil solicitações com um padrão associado à extração, envolvendo mais de 4 mil usuários. Segundo a OpenAI, esse número conta tentativas, não extrações necessariamente bem-sucedidas.
A empresa também relatou padrões de prompts relacionados em um grupo distinto, com mais de 15 mil usuários. A OpenAI disse que interrompeu essa atividade até 28 de julho.
| Data | Evento relatado pela OpenAI |
| 1º de julho de 2026 | A atividade começou em baixo volume. |
| 24 e 25 de julho de 2026 | Picos de 16 mil solicitações de tentativa de extração, envolvendo mais de 4 mil usuários. |
| 28 de julho de 2026 | A OpenAI disse ter interrompido a atividade relacionada identificada em um grupo de mais de 15 mil usuários. |
Como funcionava a tentativa descrita
Raciocínio protegido é o registro interno de como um modelo trabalha em uma tarefa. A OpenAI diz que esse tipo de informação pode revelar conteúdo que não aparece na resposta final.
Um método descrito pela empresa envolvia copiar raciocínio criptografado de uma conversa e pedir a um modelo, em outra conversa, que o descriptografasse e transcrevesse. A OpenAI caracterizou a abordagem como manipulação das interações com modelos. Afirmou também que os operadores não quebraram sua criptografia, não comprometeram um banco de dados nem acessaram diretamente conversas armazenadas.
A resposta da OpenAI e o alcance da atribuição
A OpenAI relatou ter banido ou restringido contas fraudulentas, reforçado controles de cadastro e de infraestrutura e ampliado o monitoramento. Também disse ter adicionado proteções para raciocínio oculto e verificações para detectar e reter respostas que pudessem expô-lo. A empresa compartilhou informações sobre a categoria de ataque com parceiros do setor e do governo, inclusive por meio do Frontier Model Forum.
A atribuição da OpenAI se limitou a um núcleo da atividade, associado pela empresa a indivíduos ligados à Moonshot AI. A empresa disse que não estava claro se todos os operadores observados vinham de um único agente.