¿Adónde se fue la web antigua? Seguimos 657.607 enlaces para averiguarlo
Un análisis de 657.607 URL de un acortador de enlaces resucitado de 2009–2014 descubre que aproximadamente tres cuartas partes de las páginas compartidas alguna vez a través del servicio ya no cargan, subrayando cuán frágil es la memoria de la web. Los comentaristas debaten qué época cuenta realmente como la “web antigua”, contrastando sitios personales, foros y blogs tempranos con las plataformas actuales centralizadas, de pago, pesadas en JavaScript y el contenido generado por IA. Muchos ven la rotura de enlaces, los jardines amurallados corporativos y los incentivos cambiantes como fuerzas clave que erosionan la web abierta y curada por humanos, incluso cuando proyectos como archive.org y nuevas herramientas como el mantenimiento impulsado por IA intentan mantener vivas partes de ella.
Rotura de enlaces y fugacidad de la web
- Muchos ven la alta proporción de enlaces rotos como evidencia de que la impermanencia de la web es un grave defecto de diseño.
- Otros sostienen que todos los medios son impermanentes (los libros se queman, la piedra se erosiona); la web no es singularmente frágil.
- Varios señalan la ironía de que un acortador de enlaces que estuvo fuera de línea durante una década ahora analice las caídas de otros.
- Un matiz clave: “seguir sirviendo HTTP” ≠ “el contenido original sigue existiendo” (dominios aparcados, muros de pago, muros de inicio de sesión, avisos de contenido eliminado).
Archivado, almacenamiento y soluciones técnicas
- Archive.org es ampliamente elogiado, pero también criticado por ser incompleto en sitios complejos.
- La gente habla de bit rot, ECC, almacenamiento basado en contenido y torrents como formas de hacer que la pérdida de datos sea “astronómicamente” improbable, pero señala que los sistemas de consumo rara vez usan protecciones robustas.
- Los sistemas peer-to-peer y direccionados por contenido (IPFS, Freenet/Hyphanet) se citan como prometedores, pero aún limitados y dependientes de que alguien siga alojando los datos.
Definiendo la “web antigua”
- Hay un fuerte desacuerdo sobre qué significa “web antigua”:
- Va desde pre-Google / pre-SEO / pre-redes sociales (principios–mediados de los 2000)
- Hasta la “web Cretácica” (gopher, Usenet, pre-WWW)
- Algunos consideran 2009–2014 como web “intermedia” o “tardía intermedia”, no “antigua”.
- La nostalgia se centra en: páginas personales, webrings, libros de visitas, directorios tilde, foros phpBB, Geocities/Angelfire, blogs tempranos, menos monetización y menos fuentes algorítmicas.
- Los críticos dicen que la web antigua también estaba saturada, era fea y estaba llena de basura; argumentan que hoy sigue existiendo creatividad similar, pero ahora vive en grandes plataformas.
Centralización, jardines amurallados y cultura
- Muchos culpan a las redes sociales y a las mega-plataformas de sacar el contenido de la web abierta y llevarlo a silos impulsados por anuncios y llenos de reglas.
- Se lamenta la pérdida de pequeños foros y comunidades locales (p. ej., tableros de juegos, espacios al estilo LiveJournal); algunos ven sitios como HN, listas de correo, gopher/gemini como reductos de la “web antigua”.
- Hay preocupación de que la moderación corporativa, la presión de los anunciantes y las reglas de las plataformas obliguen a la autocensura y reduzcan la cultura aceptable.
IA, spam y el futuro
- El relanzamiento de 0.mk como servicio asistido por IA plantea preguntas sobre costos y riesgos (p. ej., inyección de prompt que lleve a acciones destructivas).
- Algunos esperan que la búsqueda basada en IA mate el spam de SEO; otros temen una nueva ola de spam generado por IA optimizado para LLM en lugar de humanos.
- Una visión: el público masivo puede retirarse a plataformas aún más cerradas, dejando una web abierta más pequeña y más “friki”, parecida a épocas anteriores.