Meta baixou 81,7 TB de torrents ilegais para treinar modelos de IA

A Meta está sendo acusada de utilizar livros protegidos por direitos autorais para treinar modelos de inteligência artificial, sem a devida autorização. Um detalhe surpreendente nessa história é como os materiais foram acessados: por meio de torrents que, somados, chegam a pelo menos 81,7 TB de dados.
O assunto ganhou o noticiário em janeiro de 2025, quando veio à tona a informação de que detentores de direitos autorais nos Estados Unidos estavam processando a companhia liderada por Mark Zuckerberg.
A acusação principal é a de que a Meta teria acessado a LibGen (uma biblioteca online de obras frequentemente associada à pirataria) e outras fontes ilegais de distribuição de conteúdo com o intuito de obter livros para treinar a Llama, sua tecnologia de IA generativa.
E-mails de funcionários da companhia, que foram anexados ao processo judicial, indicam que milhões de livros foram baixados ilegalmente pela Meta a partir da LibGen por meio de um serviço de nome LibTorrent. Plataformas como Z-Library também teriam sido usadas.
Em linhas gerais, a Meta é acusada de baixar pelo menos 81,7 TB de dados ilegalmente em várias bibliotecas usando o site Anna’s Archive como ponto de partida. Desse total, ao menos 35,7 TB teriam origem na Z-Library (outro serviço associado a downloads ilegais) e na LibGen.
Além disso, a Meta teria baixado outros 80,6 TB de dados da LibGen em uma ocasião anterior.
Fonte: Tecnoblog
Entre para comentar.