A Anthropic, empresa por trás do modelo de IA Claude, concordou com um acordo coletivo de US$ 1,5 bilhão após ser pega usando livros piratas para treinar seu produto principal. O caso, conhecido como Bartz v. Anthropic, abrange aproximadamente 500.000 obras protegidas por direitos autorais e pagará aos titulares de direitos elegíveis registrados nos EUA cerca de US$ 3.000 por título.
A União dos Escritores Irlandeses agora entrou em cena, chegando a seu próprio acordo com a Anthropic e aconselhando ativamente autores irlandeses sobre como apresentar reivindicações. A união vê o caso como um possível precedente para a aplicação de direitos autorais na Europa contra empresas de IA.
O que realmente aconteceu
A ação judicial alegou que a Anthropic baixou livros do Library Genesis (LibGen) e do Pirate Library Mirror (PiLiMi), duas plataformas conhecidas de pirataria, para alimentar seus modelos de linguagem durante o treinamento.
Um tribunal distrital dos EUA emitiu uma decisão mista que traçou uma linha surpreendentemente clara. Treinar IA com material legalmente adquirido? Isso pode qualificar-se como uso justo. Baixar obras protegidas por direitos autorais de sites piratas para construir seu conjunto de dados? Isso é infração clara.
Como parte do acordo, a Anthropic é obrigada a destruir os conjuntos de dados piratas utilizados no treinamento. A aprovação final do tribunal é esperada por volta de meados de 2026. Os pagamentos serão distribuídos em parcelas após os descontos necessários.
Por que a União dos Escritores Irlandeses importa aqui
A participação da IWU sinaliza que isso não vai permanecer uma história americana. O sindicato está se posicionando como um guia para autores europeus que podem ter reivindicações, e seu apoio público ao framework de acordo sugere que o trabalho organizado nas indústrias criativas vê isso como um modelo.
A Europa já possui regimes mais rigorosos de proteção de dados e direitos autorais do que os EUA. O AI Act da UE, que começou a ser implementado em 2024, exige transparência sobre os dados de treinamento.
O crescente problema de direitos autorais da indústria de IA
A Anthropic está longe de ser a única empresa de IA enfrentando essas questões. A OpenAI foi processada pelo New York Times e por vários autores. A Stability AI já lidou com processos da Getty Images.
O número de indenização de US$ 1,5 bilhão parece enorme, mas a Anthropic foi recentemente avaliada em dezenas de bilhões de dólares. Se cada empresa de IA precisar licenciar seus dados de treinamento ou correr o risco de indenizações de bilhões de dólares, a economia de construção de grandes modelos de linguagem muda fundamentalmente.
