Briefs Deslacrados no Caso dos Autores v. Microsoft/OpenAI
Documentos judiciais deslacrados na ação dos Authors Guild contra OpenAI e Microsoft alegam que as empresas usaram conscientemente conjuntos de dados de livros pirateados, como o LibGen, para treinar modelos de linguagem grandes, enquanto internamente se preocupavam mais com a “aparência” em sites como Hacker News e Twitter do que com a legalidade. Comentadores debatem se esse scraping em larga escala e o treinamento de IA são protegidos por fair use ou constituem uma violação sem precedentes de direitos autorais e “roubo de trabalho”, destacando padrões duplos percebidos entre como indivíduos e gigantes de tecnologia são tratados sob a lei de propriedade intelectual. A discussão também levanta preocupações mais amplas sobre o impacto da IA nos meios de vida criativos, o cercamento dos bens culturais comuns, a enxurrada de “slop” de IA de baixa qualidade e a perda de controle e de poder de barganha humano numa economia cada vez mais mediada por modelos proprietários poderosos.
Uso do LibGen e “aparência”
- Documentos deslacrados mostram funcionários discutindo o uso do grande corpus de livros pirateados do LibGen e se preocupando principalmente com a má “aparência” caso o HN/Twitter notasse, e não com a legalidade.
- Alguns veem a citação do “site russo suspeito” como hipócrita, dado o scraping/pirataria em escala muito maior por parte dos laboratórios; outros dizem que a preocupação era de relações públicas (Rússia, associações com fazendas de trolls), não de direitos autorais ou da ética do LibGen.
- Há discordância sobre a forma de enquadrar o LibGen: um site pirata cheio de livros didáticos protegidos por direitos autorais vs. uma biblioteca de pesquisa de fato em países pobres.
Pirataria vs. treinamento e fair use
- Há amplo consenso de que baixar livros do LibGen/Anna’s Archive constitui violação de direitos autorais.
- A principal disputa: treinar sobre obras protegidas por direitos autorais adquiridas legalmente é fair use?
- Um lado cita casos recentes nos EUA (por exemplo, Anthropic) que consideraram o treinamento sobre livros adquiridos legalmente como “transformador” e fair use, mas não o treinamento sobre cópias pirateadas.
- Outros argumentam que os modelos podem reproduzir texto protegido por direitos autorais, então treinamento+uso deveria ser tratado como cópia, e não como mera “leitura”.
- Debate sobre se as evidências atuais mostram regurgitação literal rotineira; alguns dizem que isso é raro e bloqueado, outros apontam processos (notícias, letras) e saídas “slop”.
Empregos, poder e capitalismo
- Um grupo vê a IA como apenas outra onda de automação (carros vs cavalos, calculadoras vs humanos “computadores”); perda de empregos é uma disrupção normal.
- Outro argumenta que a IA é diferente: ela apropria trabalho criativo humano em escala, mina o poder de barganha dos trabalhadores e arrisca uma concentração extrema de poder (“feudalismo” pós-trabalho / “reis-deus”).
- Há uma divisão entre quem quer desacelerar/parar a IA e quem quer aceitar o progresso tecnológico e focar em redes de proteção, requalificação ou economia pós-trabalho (UBI, “luxury space communism”).
Cultura, atribuição e “slop”
- Forte preocupação de que os modelos apaguem a autoria, inundem os mercados com livros/imagens de IA de baixa qualidade e corroam o sinal cultural, a veracidade e o ofício.
- Outros contrapõem que a saída da IA atualmente não consegue igualar a escrita longa especializada e é usada principalmente para texto de baixo custo e preenchimento de gênero.
- Alguns argumentam que o copyright deveria ser encurtado ou abolido; opositores observam que ele também sustenta o copyleft (por exemplo, GPL).
Desigualdade e aplicação da lei
- Comparação recorrente entre o tratamento duro dado a piratas individuais e laboratórios bilionários que pagam acordos manejáveis; sensação de que a lei principalmente protege o capital.
- Alguns veem o descumprimento por grandes laboratórios como uma alavanca para reformar o copyright; outros temem que isso apenas consolide uma exceção corporativa.
O papel do Hacker News e meta
- Funcionários estavam explicitamente preocupados com cobertura negativa no HN, sugerindo que o HN ainda importa para a “aparência” entre elites de tecnologia.
- A discussão também debate astroturfing, moderação e se empresas de IA tentam ativamente moldar a opinião no HN.