OpenAI acusa chinesa Moonshot de distilar suas IAs

A OpenAI afirma ter identificado e interrompido uma campanha coordenada de distilação de modelos de inteligência artificial (IA) que teria como objetivo extrair capacidades de raciocínio protegidas de seus sistemas. Segundo a empresa, uma parte central da atividade foi atribuída a indivíduos associados à chinesa Moonshot AI, desenvolvedora do chatbot Kimi.

A atividade teria começado no início de julho e atingido pico entre os dias 24 e 25 daquele mês, quando a OpenAI identificou 16 mil solicitações feitas por mais de quatro mil usuários, seguindo padrão de extração semelhante. A investigação posteriormente encontrou atividades relacionadas em conjunto de mais de 15 mil usuários. A empresa afirma que interrompeu completamente a campanha em 28 de julho.

Como funcionava a tentativa de extração

  • Segundo a OpenAI, os operadores não invadiram seus bancos de dados nem quebraram diretamente a criptografia utilizada para proteger o raciocínio dos modelos;
  • O método identificado explorava a forma como os modelos processavam informações entre diferentes conversas. Usuários copiavam dados de raciocínio criptografados de uma conversa e, em uma segunda interação, solicitavam ao modelo que descriptografasse e transcrevesse o conteúdo oculto em texto visível;
  • “Os operadores não quebraram nossa criptografia, comprometeram um banco de dados nem obtiveram acesso direto às conversas armazenadas dos usuários. Em vez disso, manipularam as interações com o modelo para que o raciocínio protegido pudesse ser reproduzido em formas visíveis ao solicitante, de maneira coordenada e em escala, violando nossos termos de serviço”, afirmou a OpenAI;
  • A empresa classificou a técnica como nova forma de ataque de distilação. De acordo com a companhia, não está claro se toda a atividade partiu de um único operador utilizando milhares de contas ou se envolveu diferentes grupos;
  • A OpenAI, contudo, afirma que um núcleo da atividade pode ser associado a pessoas ligadas à Moonshot AI. A empresa não apresentou publicamente evidências técnicas detalhadas que sustentem essa atribuição.

O que é distilação de IA?

A distilação de modelos é uma técnica legítima de treinamento na qual um sistema mais poderoso, chamado de “professor”, produz respostas que podem ser utilizadas para treinar um modelo menor, o “aluno”.

O objetivo pode ser criar sistemas mais baratos e eficientes, capazes de reproduzir determinadas capacidades do modelo maior sem exigir a mesma quantidade de processamento. A prática é utilizada normalmente no desenvolvimento de modelos de IA.

A controvérsia surge quando empresas utilizam modelos proprietários de terceiros para coletar grandes volumes de respostas sem autorização e reproduzir capacidades consideradas protegidas. Nesse contexto, empresas estadunidenses de IA passaram a chamar determinadas operações de distilação ilícita.

O raciocínio intermediário dos modelos se tornou especialmente relevante nesse processo. Em vez de utilizar apenas respostas finais, uma operação de distilação pode tentar coletar informações sobre como um sistema resolve problemas complexos, fornecendo ao modelo que está sendo treinado exemplos mais detalhados de como chegar a determinada conclusão.

Moonshot já havia sido acusada pela Anthropic

A acusação da OpenAI ocorre em meio a uma disputa mais ampla envolvendo empresas chinesas e laboratórios estadunidenses de IA.

Em fevereiro, a Anthropic afirmou ter identificado campanhas de distilação envolvendo três laboratórios chineses, incluindo a Moonshot. Na ocasião, a empresa disse ter identificado mais de 16 milhões de interações com o Claude associadas a aproximadamente 24 mil contas fraudulentas. A Moonshot teria sido responsável por mais de 3,4 milhões dessas interações, segundo a Anthropic.

Em setembro, a Anthropic voltou a acusar a Moonshot de utilizar seus modelos para treinamento. Segundo um relatório da empresa, a startup teria encaminhado silenciosamente solicitações de seus próprios clientes para o Claude, fazendo com que usuários que acreditavam estar utilizando o Kimi recebessem respostas do modelo da Anthropic.

A empresa afirma ter identificado quase 300 mil solicitações encaminhadas ao Claude durante um período de dez dias, principalmente para o modelo Opus, utilizando uma rede de 5.380 contas fraudulentas. A Anthropic também afirmou ter identificado mecanismos destinados a extrair registros de raciocínio das respostas obtidas.

Ainda segundo a Anthropic, a Moonshot teria observado mais de 23 milhões de interações relacionadas a campanhas de distilação entre maio e julho de 2026. Esses números se referem às investigações da própria Anthropic e não à campanha descrita agora pela OpenAI.

Moonshot nega as acusações – Imagem: gguy/Shutterstock

Leia mais:

  • Rival do Muse: OpenAI lança Dots, agentes de IA que trabalham sozinhos
  • OpenAI negocia rodada de R$ 156,1 bi e pode atingir valuation de R$ 7,3 tri
  • EUA investigam OpenAI e Anthropic após incidentes com agentes de IA

EUA já ameaçaram sanções

A discussão também chegou ao governo dos Estados Unidos. Em julho, o secretário do Tesouro, Scott Bessent, afirmou que o governo poderia aplicar sanções contra modelos chineses de pesos abertos caso fossem confirmadas evidências de distilação de modelos estadunidenses.

Na ocasião, Bessent disse que autoridades estadunidenses estavam encontrando marcas associadas a grandes modelos de linguagem dos EUA em diversos modelos chineses e classificou a situação como inaceitável.

A possibilidade de sanções surgiu em meio às acusações de que empresas chinesas estariam utilizando modelos estadunidenses para acelerar o desenvolvimento de seus próprios sistemas. A Reuters informou na época que autoridades dos EUA também avaliavam possíveis restrições contra empresas chinesas, enquanto Pequim rejeitou as acusações de apropriação indevida de tecnologia.

A Moonshot, por sua vez, já havia rejeitado anteriormente a alegação de que o desempenho de seu modelo Kimi K3 fosse resultado de distilação. Segundo a Reuters, a empresa afirmou que os ganhos de desempenho vieram de mudanças próprias na arquitetura do sistema.

OpenAI promete reforçar as defesas

A OpenAI afirma que o episódio não representa uma vulnerabilidade exclusiva de seus modelos. A empresa compartilhou informações sobre a campanha com parceiros do setor por meio do Frontier Model Forum, com o objetivo de melhorar as defesas contra tentativas semelhantes.

Além de bloquear as contas envolvidas, a companhia afirma ter reforçado os controles de criação de contas e infraestrutura, ampliado o monitoramento de redes e corrigido o mecanismo que permitia transportar dados de raciocínio criptografados de uma conversa para outra e tentar convertê-los novamente em texto legível.

A empresa espera que esse tipo de operação fique mais sofisticado à medida que os modelos de fronteira avancem.

“Esperamos que as tentativas de distilação adversarial se tornem mais sofisticadas à medida que os modelos de fronteira melhorem e os agentes busquem maneiras mais baratas de reproduzir suas capacidades. A defesa contra essa atividade exige controles em várias camadas e adaptação contínua”, afirmou a OpenAI.

O post OpenAI acusa chinesa Moonshot de distilar suas IAs apareceu primeiro em Olhar Digital.

Relacionados

Receba atualizações na palma de sua mão e fique bem informado Siga o Canal do portal Ibotirama Notícias no WhatsApp

2025 | Ibotirama Notícias Todos os direitos reservados  Por DaQui Agência Digital

Rolar para cima