Os jornais Seattle Times e Newsday entraram com uma ação judicial contra a OpenAI e a Microsoft, alegando que as gigantes da tecnologia copiaram sem autorização conteúdos jornalísticos para treinar seus sistemas de inteligência artificial. A denúncia foi protocolada no Tribunal Distrital dos Estados Unidos para o Distrito Sul de Nova York na última sexta-feira (4). Segundo os jornais, a OpenAI e a Microsoft teriam utilizado técnicas de raspagem de dados para extrair informações de seus sites, incluindo conteúdos protegidos por paywall, e incorporado esses materiais em conjuntos de dados usados para desenvolver produtos como ChatGPT, Microsoft Copilot e as funcionalidades de IA do Bing. Os veículos de comunicação, que operam em Seattle e Long Island, Nova York, afirmam que as ferramentas de IA conseguem reproduzir trechos de suas reportagens e parafrasear artigos de maneira muito similar ao original, o que diminui a necessidade dos usuários de acessar seus sites ou assinar seus serviços. Alan Fisco, presidente e CEO do Seattle Times, expressou a importância de proteger o conteúdo produzido pela empresa, que requer um investimento significativo. “Acreditamos firmemente que precisamos defender nosso conteúdo —no qual gastamos milhões de dólares por ano para produzir— contra o uso sem nosso consentimento ou compensação”, afirmou Fisco em comunicado aos funcionários. A OpenAI, com sede em São Francisco, respondeu que seus modelos são treinados com dados disponíveis publicamente e se baseiam no princípio do uso justo, embora não tenha comentado especificamente sobre o processo. A Microsoft, também se manifestou, afirmando que está disposta a buscar soluções e reconhecendo a relevância do jornalismo local. A ação judicial dos jornais pede a destruição das cópias de suas obras, além dos conjuntos de dados de treinamento ou modelos de IA que as incluam. Este processo se assemelha a uma ação anterior movida pelo New York Times em 2023, que acusou as mesmas empresas de usar milhões de artigos sem autorização para treinar o ChatGPT. O caso é um dos muitos que estão sendo movidos por detentores de direitos autorais contra empresas de tecnologia, que são acusadas de uso indevido de material para treinar suas tecnologias. O desfecho dessa disputa poderá ter implicações significativas sobre o futuro do jornalismo e do uso de inteligência artificial, especialmente em relação à propriedade intelectual e aos direitos autorais.



