Resumo:
As empresas americanas de tecnologia Microsoft e OpenAI estão mais uma vez enfrentando novos processos judiciais de direitos autorais. Várias organizações de notícias locais, lideradas pela Emmerich Newspapers, entraram recentemente com uma ação judicial, acusando as duas empresas de uso não autorizado sistemático e de longo prazo de seu conteúdo noticioso protegido por direitos autorais para treinar modelos de inteligência artificial e lucrar com isso no processo de comercialização.

O autor afirmou que a Microsoft e a OpenAI obtiveram dezenas de milhares de artigos de notícias sem permissão ou pagamento de qualquer compensação e usaram o conteúdo para treinar grandes modelos de linguagem. As agências relevantes acreditam que as duas empresas acabaram por criar um enorme valor comercial através destes produtos de IA, enquanto os fornecedores de conteúdo originais não conseguiram obter qualquer receita.
Na verdade, controvérsias semelhantes continuaram a surgir nos últimos anos. Anteriormente, grandes organizações de mídia como o New York Times haviam entrado com ações judiciais contra a Microsoft e a OpenAI por motivos semelhantes, acusando-as de usar conteúdo protegido por direitos autorais para treinar sistemas de inteligência artificial.
De acordo com a denúncia, o autor apontou que a Microsoft e a OpenAI criaram e continuam a gerar bilhões de dólares em receitas, mas os produtores de conteúdo “não receberam um centavo”. Alegaram também que alguns conteúdos que originalmente tinham restrições de acesso, como acesso pago, foram obtidos e utilizados para treinamento sem autorização.
Os documentos do processo mencionavam especificamente que os artigos envolvidos foram originalmente incorporados com informações de gerenciamento de direitos autorais, incluindo a assinatura do autor, nome da instituição editora, declaração de direitos autorais, termos de uso, etc. Os demandantes alegam que a Microsoft e a OpenAI removeram essas informações de direitos autorais antes de treinar o modelo, enfraquecendo assim a identificação dos direitos autorais da obra.
Além disso, o autor também alegou que seu conteúdo de notícias foi produzido pelo sistema de IA em uma forma de repetição quase literal muitas vezes nos últimos anos, indicando que materiais relevantes foram profundamente incorporados aos dados de treinamento do modelo.
Essas publicações locais acreditam que o fracasso das empresas de tecnologia em pagar adequadamente às organizações de notícias pode se tornar a “sentença de morte para o jornalismo local”. Nos últimos anos, os meios de comunicação locais nos Estados Unidos enfrentaram desafios como o declínio das vendas de jornais impressos e a redução das receitas publicitárias. A capacidade da inteligência artificial de fornecer respostas diretamente aos utilizadores exacerbou ainda mais a pressão operacional enfrentada pelas organizações noticiosas tradicionais.
As principais partes envolvidas no processo são editoras independentes de jornais e revistas. Entre eles, o Emmerich Newspaper Group é um grande grupo jornalístico privado no Mississippi, EUA, com seu escopo de negócios cobrindo partes da Louisiana e Arkansas. Em muitos dos mercados que atende, o grupo é o único fornecedor de notícias local. O queixoso acredita que se meios de comunicação semelhantes forem forçados a reduzir ou mesmo fechar, o acesso dos residentes locais às informações noticiosas será significativamente afectado.
Além do Emmerich Newspaper Group, as organizações envolvidas no processo também incluem Ojai Media, Coopwood Publishing, Coopwood Magazine, Coopwood Media Group e Coopwood Newspapers e outras organizações de mídia.
O autor acredita que as ações da Microsoft e da OpenAI violaram a Lei de Direitos Autorais dos EUA e a Lei de Direitos Autorais do Milênio Digital (DMCA), constituindo violação de direitos autorais e atividades ilegais relacionadas.
A denúncia também aponta que, por um lado, as duas empresas são acusadas de negligenciar os direitos autorais dos editores e, por outro lado, usam ativamente os direitos autorais e meios legais para proteger seus produtos, inclusive por meio de acordos de licenciamento, serviços pagos e medidas legais para proteger seus códigos, modelos e sistemas de serem usados à vontade por terceiros.
O autor mencionou especificamente que, há pouco tempo, a OpenAI reclamou publicamente de concorrentes que usavam seu conteúdo gerado para treinar modelos, acreditando que isso prejudicava seus próprios interesses. Os litigantes argumentam que esta abordagem contrasta fortemente com a conduta pela qual são acusados.
Em termos de demandas, essas organizações de mídia locais esperam que o tribunal ordene que a Microsoft e a OpenAI paguem indenizações e compensações relacionadas, e também solicitem ao tribunal que emita uma liminar para forçar as duas empresas a excluir todo o conteúdo envolvendo as obras protegidas por direitos autorais do reclamante dos dados de treinamento do modelo.
À medida que mais e mais organizações de notícias, editores e criadores de conteúdo lançam desafios legais contra a inteligência artificial generativa, as disputas em torno da legalidade dos dados de treinamento de IA, dos mecanismos de autorização de conteúdo e dos modelos de compensação de direitos autorais continuam a se tornar uma das questões jurídicas mais preocupantes no desenvolvimento da indústria global de inteligência artificial.
Comentários