Una simulación de mí: afinar un LLM con 240k mensajes de texto
Afinar modelos de lenguaje grandes con historiales personales de chat, correos y diarios está surgiendo como una forma de crear “dobles” de IA que imitan el tono, las preferencias e incluso partes de la vida interior de una persona. Los comentaristas ponderan posibles usos que van desde hablar con seres queridos fallecidos y preservar la historia familiar hasta servicios póstumos y marketing, junto con preocupaciones sobre el duelo, la obsesión, el consentimiento, el copyright y el riesgo de confundir rastros textuales curados con una persona real. Los detalles técnicos, como la elección del modelo, los métodos de entrenamiento y los límites de hardware, aparecen junto con referencias a la ciencia ficción, que desde hace mucho explora fantasmas digitales y conciencias subidas a la red.
Preguntas terapéuticas y emocionales
- Algunos piensan que hablar con un “fantasma” de IA de un ser querido podría ser reconfortante o terapéutico; otros argumentan que corre el riesgo de prolongar el duelo, crear dependencia poco saludable u obsesión con “mejorar” la simulación.
- Se hacen comparaciones con buzones de voz guardados, psíquicos y sistemas de vídeo conmemorativos que responden preguntas después de la muerte; no está claro si realmente ayudan a las personas a sanar.
- Entre las preocupaciones están las “revelaciones” alucinadas (por ejemplo, supuestas aventuras o favoritismos) y el riesgo de que la gente elija simulaciones de parejas fallecidas en lugar de procesar rupturas.
- Unos pocos sugieren que la forma más sana de enfocar esto es como un recuerdo digital, no como un reemplazo.
Ética, consentimiento y uso de datos
- Algunos participantes consideran poco ético entrenar con los mensajes de otra persona sin permiso explícito; otros creen que no es peor que un humano leyendo e interiorizando texto.
- Debate sobre si entrenar con texto con copyright equivale a copiar un libro; existe un fuerte desacuerdo sobre si los modelos son “compresiones” de conjuntos de datos y qué implica eso legal y moralmente.
Enfoques técnicos y limitaciones
- La gente comparte intentos usando modelos más antiguos (GPT-2, GPT-J) con grandes registros de chat, que a menudo producen resultados sobre el tema pero incoherentes. Se informa que modelos más nuevos (p. ej., Mistral) son mucho mejores.
- Discusión sobre fine-tuning frente a embeddings: fine-tuning para estilo/personalidad, embeddings y recuperación para recuerdo factual, a veces combinados con búsqueda directa en cuadernos/correos.
- Se discuten las limitaciones de hardware y la cuantización; el consenso es que modelos grandes muy cuantizados pueden superar a modelos pequeños de alta precisión, incluso para fine-tuning LoRA de baja precisión.
- Consejos prácticos: exportar correos, configurar IMAP local, usar repositorios y tutoriales de fine-tuning existentes.
Aplicaciones potenciales e ideas de negocio
- Entre los servicios imaginados hay chatbots de antepasados, mensajes directos póstumos, mundos “fantasma” en cementerios o MMO, asistentes de sucesiones/historia familiar y ofertas gestionadas de “legado digital”.
- Algunos esperan que las grandes tecnológicas acaben comercializando estos servicios usando historiales de correo y mensajes; otros desconfían por la privacidad y el perfilado de marketing.
Marco cultural, filosófico y de ciencia ficción
- Las actitudes no occidentales hacia los antepasados pueden hacer que estos servicios sean más aceptables en algunas culturas.
- Varios ven el riesgo de que los simulacros idealizados y curados empeoren los sentimientos de insuficiencia, de forma parecida a las identidades en redes sociales.
- Se citan numerosas obras de ciencia ficción que exploran dobles digitales, simulaciones póstumas y sus consecuencias no deseadas, reforzando tanto la fascinación como la inquietud.