Processo contra a Anthropic reacende debate sobre direitos autorais e treinamento de inteligências artificiais
Ação movida por editoras musicais nos Estados Unidos acusa a empresa responsável pelo Claude de usar obras protegidas sem autorização; caso também chama atenção de autores e editoras de livros
O treinamento de uma inteligência artificial pode começar muito antes de o usuário fazer uma pergunta — e, segundo uma nova ação judicial nos Estados Unidos, pode envolver cópias de obras protegidas obtidas de fontes consideradas ilegais. O processo movido por Sony Music Publishing, Warner Chappell Music e outras editoras musicais contra a Anthropic recoloca no centro do debate uma pergunta que interessa a todo o mercado editorial: quem pode usar livros, letras, partituras e outros conteúdos para desenvolver sistemas de IA?
A ação foi protocolada em 28 de agosto de 2026 no Tribunal Distrital dos Estados Unidos para o Distrito Norte da Califórnia. A cobertura jornalística começou a circular em 29 de agosto. Além da Anthropic, empresa responsável pelo Claude, o processo inclui o CEO Dario Amodei e o cofundador Benjamin Mann como réus.
É importante destacar que as acusações ainda não representam uma decisão judicial definitiva. Os autores da ação apresentam sua versão dos fatos, enquanto a Anthropic afirmou que discorda das alegações e pretende se defender no tribunal.
O que as editoras musicais alegam
Segundo a petição, Anthropic teria realizado uma campanha de torrent, scraping e download de obras protegidas para desenvolver e operar seus modelos de inteligência artificial. As editoras afirmam que milhares de composições musicais, incluindo letras e partituras, teriam sido copiadas e usadas no treinamento do Claude.
A queixa menciona um universo de “dezenas de milhares” de composições supostamente afetadas. O processo também pede indenizações previstas na legislação americana, que podem chegar a US$ 150 mil por obra em casos de violação intencional, além de valores relacionados à remoção ou alteração de informações de gerenciamento de direitos autorais.
Entre os pedidos apresentados estão ainda a destruição de cópias consideradas infratoras e a entrega de informações sobre os dados usados no treinamento dos modelos.
As editoras sustentam que a Anthropic teria obtido conteúdos de diferentes fontes, incluindo bibliotecas digitais não autorizadas, sites de letras e grandes bases de dados utilizadas no desenvolvimento de sistemas de linguagem. Parte das alegações se apoia em informações reveladas durante processos anteriores envolvendo a empresa.
Por que livros e autores aparecem nesse debate
O processo atual é apresentado principalmente como uma disputa envolvendo músicas e composições. Não há, nesta ação específica, uma acusação geral de que livros de autores independentes tenham sido usados de forma irregular como uma categoria autônoma de obras. A conexão com o mercado editorial surge porque a petição menciona milhões de livros e coleções que poderiam conter letras, partituras ou outros materiais protegidos.
Além disso, a Anthropic já enfrentou uma disputa diretamente relacionada a livros. Em 2025, um acordo de US$ 1,5 bilhão foi aprovado em um processo movido por autores e editoras que alegavam que centenas de milhares de livros haviam sido pirateados para treinar sistemas de IA. Na ocasião, o juiz responsável fez uma distinção relevante: considerou que o treinamento com obras protegidas poderia ser tratado como uso transformativo em determinadas circunstâncias, mas entendeu que a obtenção de cópias por meio de pirataria era ilegal.
Essa diferença é fundamental. O debate não envolve apenas se uma obra foi utilizada no treinamento, mas também como ela foi obtida, que cópias foram feitas, qual foi a finalidade do uso e se o sistema consegue reproduzir trechos protegidos quando solicitado.
Treinamento, reprodução e saída gerada: três questões diferentes
Quando uma IA é treinada com grandes volumes de texto, o conteúdo usado como referência pode incluir livros, notícias, páginas da internet, letras, imagens e documentos. O modelo não funciona como uma biblioteca convencional, mas aprende padrões a partir dos dados processados. Mesmo assim, o processo de coleta pode envolver cópias temporárias ou permanentes, e essas cópias podem gerar discussões jurídicas próprias.
Também existe uma segunda questão: o comportamento do sistema depois do treinamento. Se um usuário pede uma letra, um capítulo ou um trecho específico, a resposta pode se aproximar demais de uma obra protegida. Nesse caso, o problema jurídico pode estar relacionado à reprodução ou distribuição do conteúdo na saída do modelo, independentemente da discussão sobre o treinamento.
Uma terceira questão diz respeito à transparência. Autores, compositores e editoras querem saber quais obras foram usadas, de onde vieram os arquivos e se houve autorização ou pagamento. Empresas de IA, por outro lado, defendem que o treinamento de modelos exige grandes conjuntos de dados e que algumas formas de uso podem ser protegidas por exceções previstas na legislação.
O impacto potencial para escritores e editoras
Para escritores, o caso reforça a importância de acompanhar não apenas a publicação tradicional, mas também a circulação digital de seus trabalhos. Um livro pode aparecer em catálogos, plataformas de leitura, bases de dados, arquivos digitalizados, sites de compartilhamento ou conjuntos de treinamento sem que o autor saiba exatamente onde sua obra foi parar.
Para editoras, a discussão envolve contratos, licenças, controle de acervos e rastreabilidade. Cláusulas que tratam de reprodução digital, mineração de texto e dados, usos tecnológicos e sublicenciamento podem ganhar ainda mais relevância nas negociações com autores e parceiros.
O processo também pode acelerar a criação de novos modelos de licenciamento. Em vez de presumir que todo conteúdo disponível na internet pode ser coletado, empresas de tecnologia podem ser pressionadas a negociar acesso a catálogos autorizados, estabelecer mecanismos de exclusão e informar quais obras integram seus conjuntos de dados.
Para autores independentes, a assimetria de informação é um dos principais problemas. Grandes grupos editoriais conseguem contratar equipes jurídicas e monitorar disputas internacionais. Já escritores que publicam por conta própria precisam buscar formas acessíveis de documentar a autoria, preservar versões de seus arquivos e compreender os termos de uso das plataformas onde disponibilizam seus livros.
O que ainda não está decidido
A ação contra a Anthropic está em fase inicial. Ainda será necessário verificar quais alegações serão aceitas pelo tribunal, quais provas serão apresentadas e como a empresa responderá a cada acusação. O processo não estabeleceu, por si só, uma regra definitiva para todo treinamento de IA com obras protegidas.
O que já está claro é que o tema deixou de ser uma discussão exclusivamente técnica. Escritórios de advocacia, associações de autores, editoras, empresas de tecnologia e órgãos públicos estão tentando definir os limites entre inovação, cópia, licenciamento e exploração comercial.
Nos Estados Unidos, o Escritório de Direitos Autorais vem estudando desde 2023 os impactos da inteligência artificial sobre obras criativas, incluindo o uso de materiais protegidos no treinamento de modelos. O órgão já publicou partes de um relatório sobre IA e direitos autorais e trata o licenciamento, a responsabilidade e a transparência como temas centrais para a formulação de políticas.
Um alerta para o futuro do mercado editorial
O conflito entre grandes editoras musicais e a Anthropic não resolve a disputa, mas ajuda a revelar o tamanho do problema. A tecnologia avança em velocidade maior do que os contratos e as regras capazes de organizar o uso de obras criativas.
Para autores e editoras de livros, a principal lição é que a proteção de uma obra não termina quando ela é publicada. Também será necessário acompanhar sua presença em ambientes digitais, entender as permissões concedidas a plataformas e participar do debate sobre modelos de licenciamento para inteligência artificial.
Enquanto a Justiça analisa as acusações, uma expectativa se fortalece em todo o setor criativo: ferramentas de IA poderão continuar sendo desenvolvidas, mas o acesso às obras que alimentam esses sistemas deverá ser cada vez mais transparente, rastreável e compatível com os direitos de quem criou o conteúdo.
Fontes consultadas
- Sony Music Publishing (US) LLC et al v. Anthropic PBC et al — processo nº 5:2026cv09217 — U.S. District Court for the Northern District of California / Justia Dockets (28 de agosto de 2026)
- Sony Music Publishing and Warner Chappell sue Anthropic in multi-billion dollar lawsuit — Music Business Worldwide (29 de agosto de 2026)
- Sony, Warner sue Anthropic, alleging “blatant theft” of intellectual property — Axios (29 de agosto de 2026)
- Sony Music, Warner sue Anthropic, alleging a “brazen campaign” of intellectual property theft — TechCrunch (29 de agosto de 2026)
- Copyright and Artificial Intelligence — U.S. Copyright Office (Atualizado até 2026)
- Judge approves $1.5 billion copyright settlement between AI company Anthropic and authors — Associated Press (25 de setembro de 2025)