O criador do YouTube, David Millette (via Legal Dive), processou a gigante da IA Nvidia por usar seus vídeos para treinar seus modelos de IA. Esta ação ocorre semanas após ele processar a OpenAI pelo mesmo motivo. No entanto, Millette não alega violação de direitos autorais contra as empresas de IA — algo que muitas publicações, incluindo o New York Times, acusaram a OpenAI e a Microsoft no ano passado.
Em vez disso, Millette acusou a Nvidia de “enriquecimento injusto e competição”, dizendo que a prática de coletar dados da internet para treinar sua IA era “injusta, imoral, antiética, opressiva, inescrupulosa ou prejudicial aos consumidores”, de acordo com o processo. Esta ação foi movida após a Nvidia ser acusada de coletar mais de 400.000 horas de vídeo por dia para treinar seu próprio modelo de IA, com um e-mail vazado supostamente mostrando que a empresa planeja usar os dados coletados como um pipeline acelerado para clientes que desejam construir e treinar seus próprios modelos de IA.
A Nvidia respondeu ao processo: “Qualquer pessoa é livre para aprender fatos e ideias de fontes publicamente disponíveis. Criar obras novas e transformadoras não é apenas justo e correto, mas exatamente o que nosso sistema legal incentiva.” É por isso que casos que acusam empresas de IA de violação de direitos autorais frequentemente precisam passar por muitos obstáculos, especialmente quando o Google afirma que a coleta de dados por IA é ‘Uso Justo.’
Por outro lado, Millette alega ‘enriquecimento injusto’ contra a Nvidia e a OpenAI, o que é diferente de violação de direitos autorais. Mandarin Trading Ltd. v. Wildenstein (2011) afirma: “A doutrina do enriquecimento injusto permite que um autor recupere de um réu, sem o benefício de uma obrigação contratual executável, quando o réu se beneficiou injustamente dos esforços do autor sem compensação.” O caso acrescenta ainda: “Os elementos de uma reivindicação de enriquecimento injusto são ‘que (1) a outra parte foi enriquecida, (2) às custas dessa parte, e (3) que é contra a equidade e a boa consciência permitir que a outra parte retenha o que se busca recuperar.’”
A coleta de dados muitas vezes é controversa, seja para IA ou outros usos. Agora que está sendo usada para treinar grandes modelos de linguagem de IA (LLMs) que poderiam potencialmente substituir a criatividade humana, muitos criadores estão se levantando contra o uso não autorizado de sua produção para treiná-los.
Infelizmente, a lei sobre a coleta de dados online para uso em treinamento de IA ainda é incerta. Enquanto não for contra a lei, as empresas aproveitarão essa área cinzenta legal para obter vantagem.
Fonte: Tom’s Hardware


