Dark Side of the Moon é acusado de extrair em larga escala conteúdo de raciocínio protegido por OpenAI, fazendo 16 mil solicitações em um único dia

📅 2026-10-01

Resumo:

Kimi K3, uma subsidiária da empresa chinesa de IA Dark Side of the Moon, esteve recentemente envolvida novamente na controvérsia do modelo de destilação. Uma investigação publicada pela OpenAI revelou que uma campanha de extração coordenada visando o conteúdo de inferência protegido de seus modelos estava ligada a indivíduos associados ao Dark Side of the Moon. As atividades relacionadas geraram aproximadamente 16 mil solicitações em um único dia e envolveram mais de 15 mil usuários.

A OpenAI afirmou que essas operações não quebraram seu sistema de criptografia, invadiram o banco de dados ou obtiveram diretamente o histórico de conversas do usuário, mas por meio de interações de modelo multi-rodadas cuidadosamente projetadas, elas tentaram regenerar o processo de raciocínio originalmente oculto em uma forma visível para o solicitante.

A OpenAI chamou o incidente de "evento de destilação de modelo coordenado". A chamada destilação de modelo refere-se ao uso de um modelo de professor mais capaz para gerar uma grande quantidade de resultados e, em seguida, usar esses resultados para treinar um modelo de aluno menor ou de menor custo, para que este último possa aprender os padrões de comportamento e capacidades do modelo de professor. A destilação em si é uma técnica comum no campo da aprendizagem automática, mas se o resultado do modelo comercial for extraído em escala sem autorização e utilizado para treinar modelos concorrentes, pode violar os termos de serviço e até levar a disputas de propriedade intelectual.

De acordo com os resultados da investigação divulgados pela OpenAI, as atividades relacionadas apareceram pela primeira vez em 1º de julho de 2026, quando o número de solicitações ainda era relativamente baixo. Depois, a atividade expandiu-se gradualmente, com picos óbvios nos dias 24 e 25 de julho. Só nesses dois dias, a OpenAI detectou aproximadamente 16.000 solicitações usando padrões de extração específicos de mais de 4.000 usuários.

A OpenAI afirmou ainda que palavras de prompt e modos de operação semelhantes não aparecem apenas entre os mais de 4.000 usuários mencionados acima, mas são distribuídos entre um grupo maior de usuários que consiste em mais de 15.000 usuários. Ao analisar os padrões e correlações entre essas solicitações, a empresa determina que não são comportamentos comuns de usuários completamente independentes, mas pertencem a uma atividade com características coordenadas.

Uma operação chave é de particular interesse. A OpenAI disse que o pessoal relevante primeiro copiou o conteúdo de inferência criptografado retornado pelo modelo de uma conversa e, em seguida, pediu ao modelo para descriptografar e transcrever o conteúdo oculto em uma conversa separada. Em outras palavras, eles não quebraram diretamente o mecanismo de criptografia usado pela OpenAI para proteger o processo de raciocínio, mas tentaram usar os próprios recursos do modelo para permitir que o modelo processasse outra parte do conteúdo protegido, recuperando assim indiretamente as informações.

A OpenAI enfatizou que esta atividade não "quebrou a criptografia" com sucesso, nem quebrou o banco de dados da OpenAI, nem obteve registros de bate-papo do usuário armazenados no servidor. Seu sucesso reside principalmente na manipulação das interações entre modelos para que informações de inferência protegidas que de outra forma não seriam exibidas diretamente ao usuário reapareçam em outra forma.

A OpenAI finalmente bloqueou completamente esse tipo de atividade por volta de 28 de julho. A empresa disse que durante sua investigação descobriu que um dos principais grupos de atividade estava ligado a pessoas associadas ao Dark Side of the Moon. A OpenAI disse em uma declaração pública que foi capaz de atribuir o cluster principal a “indivíduos associados ao desenvolvedor Kimi, Dark Side of the Moon”.

Dark Side of the Moon é uma empresa chinesa de IA cuja série de modelos Kimi se desenvolveu rapidamente nos últimos anos. Em julho de 2026, a empresa lançou o Kimi K3, um modelo de peso aberto com aproximadamente 2,8 trilhões de parâmetros, e o posicionou como um modelo de nova geração para programação de código, raciocínio complexo e tarefas de agente de IA. Kimi K3 rapidamente atraiu a atenção de desenvolvedores globais de IA após seu lançamento, e seu desempenho ficou próximo do modelo de código fechado líder nos Estados Unidos em alguns testes de terceiros.

Esta investigação da OpenAI também chamou a atenção para as dúvidas anteriores levantadas pelo governo dos EUA sobre a origem do modelo Kimi. Michael Kratzios, diretor do Escritório de Política Científica e Tecnológica da Casa Branca e conselheiro-chefe de ciência e tecnologia, disse no final de julho deste ano que o governo dos EUA tinha informações relevantes e acreditava que Dark Side of the Moon havia usado o modelo da Antrópico para destilar Kimi K3. Dark Side of the Moon não reconheceu a acusação.

Além da declaração do governo, outros pesquisadores analisaram recentemente as fontes de treinamento do modelo Kimi K3. Um estudo descobriu que apenas inserir parte do conteúdo de raciocínio decodificado de Claude Opus 4.8 no Kimi K3 pode mudar significativamente o processo de pensamento subsequente e a resposta final de Kimi K3, fazendo com que pareça uma expressão mais próxima da de Claude. Com base nisso, os pesquisadores acreditam que a dificuldade de extrair determinados conteúdos de raciocínio de Claude e GPT no Kimi K3 é significativamente menor do que em outros modelos.

No entanto, estes estudos não provam por si só que o Kimi K3 como um todo foi destilado de outros modelos através de meios não autorizados. Métodos de resposta, estruturas de raciocínio e expressões de conhecimento semelhantes aparecem entre grandes modelos de linguagem, que também podem vir de vários fatores, como dados públicos, objetivos de treinamento semelhantes, métodos de aprendizagem por reforço e arquitetura de modelo. Portanto, a existência de semelhanças comportamentais parciais entre os modelos não equivale a irregularidades comprovadas na fonte dos seus dados de treinamento.

O próprio Kimi K3 também contém tecnologia desenvolvida pela Dark Side of the Moon. O modelo foi projetado usando arquiteturas como Kimi Delta Attention e é otimizado para tarefas de inferência em larga escala. Dark Side of the Moon também reduz os custos de inferência, reduzindo o cache KV e otimizando o consumo de memória de cada token. Essas tecnologias permitem que o Kimi K3 seja executado em hardware de data center de grande escala.

O que há de especial nesta controvérsia é que o comportamento alegado pela própria OpenAI não é simplesmente copiar a resposta do modelo, mas uma tentativa de obter ativamente "raciocínio protegido" que o modelo geralmente não exibe diretamente. À medida que mais e mais empresas de IA adotam mecanismos de raciocínio oculto ou criptografado, esse tipo de informação se tornou uma parte importante da proteção da capacidade do modelo. Se os modelos concorrentes forem capazes de restaurar o seu conteúdo através de pedidos automatizados em grande escala, os mecanismos utilizados pelos fornecedores de modelos para proteger os resultados da formação e as capacidades de inferência poderão enfrentar novos desafios.

A OpenAI tomou medidas contra comportamentos de destilação de modelos semelhantes muitas vezes nos últimos anos. A empresa acredita que a automatização em grande escala da invocação de modelos de negócio, da recolha dos seus resultados e da sua utilização para treinar modelos concorrentes permitirá que uma parte com grandes quantidades de recursos informáticos replique a um custo menor as capacidades que outros modelos desenvolveram através de investigação e desenvolvimento a longo prazo.

Ao mesmo tempo, este incidente também mostra que a destilação do modelo de IA está se tornando uma questão delicada na competição de inteligência artificial entre a China e os Estados Unidos. O governo dos EUA alertou repetidamente que as empresas chinesas de IA podem usar o resultado do modelo das empresas dos EUA para acelerar o desenvolvimento do seu próprio modelo, enquanto as empresas chinesas continuam a enfatizar a importância das capacidades independentes de pesquisa e desenvolvimento e dos modelos de peso aberto. Em relação às informações públicas atuais, a OpenAI confirmou a descoberta de atividades de extração em grande escala e disse que o seu cluster de atividade principal está relacionado com pessoas relacionadas com o Lado Escuro da Lua. No entanto, esta atribuição e se as atividades relacionadas são, em última instância, utilizadas para treinar o Kimi K3 ainda requerem mais evidências públicas para serem comprovadas.

Saiba mais:

https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign/

Tags relacionadas

Artigos relacionados

Comentários

0/500
Captcha (click to refresh)
Sem comentários