À medida que a IA devora a web, a memória coletiva da internet está desaparecendo
À medida que o Google aposta em respostas geradas por IA e o spam de SEO prolifera, muitos usuários relatam que a qualidade da busca na web caiu drasticamente, tornando mais difícil encontrar informações de nicho, arquivísticas ou tecnicamente precisas. Os comentaristas temem que sistemas de IA treinados na web aberta agora resumam e remisturem conteúdo escrito por humanos sem devolver tráfego, enfraquecendo os incentivos econômicos e sociais para publicar material original e acelerando uma mudança para “slop” gerado por IA. Alguns veem isso como uma ameaça à memória coletiva da internet e à futura criação de conhecimento, enquanto outros argumentam que isso pode empurrar as pessoas para índices menores e curados, arquivos pessoais e ferramentas de busca alternativas.
Qualidade da busca e resumos de IA
- Muitos veem a busca do Google como tendo se deteriorado continuamente desde o fim dos anos 2000: sinonimização agressiva, recusa em retornar verdadeiros “0 resultados”, interfaces cheias de anúncios e preferência por grandes marcas e páginas “de intenção/comerciais”.
- Os resumos de IA no Google são amplamente criticados por estarem confiantemente errados, fora do alvo e por empurrarem os resultados reais para abaixo da dobra. Alguns dizem que agora usam IA por padrão apenas porque os resultados clássicos estão piores.
- Outros relatam que o “modo IA” (Gemini, busca integrada do ChatGPT, etc.) atualmente é mais útil do que o Google bruto para muitas tarefas, mas observam que isso provavelmente é uma “idade de ouro” temporária antes da monetização/enshittification.
Impacto da IA na criação de conteúdo e nos incentivos
- Há forte preocupação de que assistentes de IA respondam a partir de conteúdo raspado sem enviar tráfego de volta, destruindo os incentivos baseados em anúncios ou reputação para escrever documentação, tutoriais e blogs.
- Vários criadores dizem que deixaram de compartilhar publicamente ou reduziram o compartilhamento (código, posts de blog) ou retiraram repositórios porque não querem “treinar seu substituto” nem perder crédito.
- Contraponto: alguns participantes dizem que continuarão publicando porque valorizam compartilhar ideias, independentemente de humanos ou LLMs lerem; outros acham que manuais e docs oficiais ainda serão produzidos para suporte de produtos.
Slop de IA, dados de treinamento e “devorando a web”
- Muitos observam uma explosão de fazendas de conteúdo gerado por IA: artigos superficiais, plausíveis mas errados, agora dominam resultados em áreas como saúde, cuidados com pets, receitas e tecnologia de nicho.
- Há preocupação de que futuros modelos sejam treinados com saídas de IA anteriores, amplificando erros e padrões de baixa qualidade; algumas comunidades estão tentando envenenar explicitamente os dados de treinamento.
- Há apelos por “corpora confiáveis” cuidadosamente curados e arquivos privados; o temor é de que a internet pública se torne inutilizável para treinamento ou referência.
Preservação e “memória coletiva”
- Debate sobre o que merece preservação: alguns descartam stories do Instagram e posts casuais como lixo; outros observam que efêmeros ao nível de grafite são inestimáveis para historiadores.
- Há amplo consenso de que link rot, paywalls, DRM, processos judiciais (por exemplo, contra a Internet Archive) e a rotatividade de plataformas já estão apagando o registro, independentemente da IA.
- Vários defendem o arquivamento pessoal: PDFs em discos locais, ferramentas como Zotero, Hister, Kiwix/OpenZIM e até “redes fechadas” privadas ou baseadas em VPN.
Alternativas e o futuro da busca
- Usuários relatam experiências mistas com DuckDuckGo, Brave Search, Kagi, Yandex e meta-buscas (SearXNG, EXA, Tavily). Não há consenso claro sobre um vencedor; há trade-offs entre completude do índice, filtragem de spam e modelos de negócio.
- A busca paga (por exemplo, Kagi) é vista por alguns como alinhando incentivos aos usuários em vez dos anunciantes, mas ela não pode corrigir a degradação subjacente da própria web.
- Alguns preveem uma divisão entre uma “web de IA” e uma web humana menor e semioculta (blogs pessoais, pequenos fóruns, redes mesh/overlay).