El spam de PR hoy se parece al spam de correo de principios de los 2000
Las solicitudes de extracción generadas por IA están inundando los repositorios de código abierto, lo que lleva a muchos mantenedores a verlas como el equivalente moderno del spam de correo electrónico: baratas de producir, masivas y en su mayoría de baja calidad. Los comentaristas debaten si estas contribuciones están impulsadas por un altruismo genuino o por engrosar el currículum, y cómo se está devaluando como resultado la señal de contratación de la “actividad de código abierto”. Las respuestas propuestas van desde prohibiciones directas, límites de PR y vetado de contribuyentes al estilo web of trust, hasta mejores sistemas de reputación y modelos de financiación que apoyen directamente a los mantenedores en lugar de recompensar contribuciones ruidosas.
Motivaciones de las PR generadas por IA
- Muchos creen que el spam de PR de IA está impulsado por incentivos profesionales: engordar perfiles de GitHub, cumplir requisitos de la escuela o el trabajo, o “construcción de marca”, no por ayudar al OSS.
- Otros sostienen que muchos contribuyentes realmente creen que están ayudando o que por fin pueden contribuir usando LLMs, aunque carezcan de habilidades.
- Varios señalan motivos mixtos: el altruismo y el interés propio suelen coexistir; la gente elige actividades útiles que también benefician a su currículum o a su ego.
Impacto en los proyectos de código abierto
- Los mantenedores informan que están desbordados por PR de baja calidad, “slop” autorado por IA, a menudo de personas que no entienden el código.
- Algunos ahora cierran las PR generadas por IA en cuanto las ven, desactivan las PR públicas o solo aceptan contribuciones de personas conocidas o de confianza.
- Los contribuyentes que se esfuerzan por enviar correcciones de alta calidad se sienten desalentados cuando se les trata como ruido y se les ignora.
Altruismo, reputación e incentivos
- La discusión explora si alguna contribución presentada como altruista es realmente interesada (sentirse bien, estatus social, “hacer algo visible”).
- Ejemplos como los bancos de alimentos ineficientes se usan para argumentar que a menudo la gente prefiere una “ayuda” visible y práctica en lugar de una ayuda realmente eficaz.
- La contribución de código abierto como señal de contratación se considera víctima de la Ley de Goodhart: una vez que se convirtió en objetivo, las contribuciones de spam erosionaron su valor.
Mitigaciones técnicas y sociales propuestas
- Ideas: donar dinero o créditos simbólicos en lugar de PR de IA “de paso”; dejar que los mantenedores decidan cómo usar los recursos.
- Algunos abogan por prohibiciones generales de las PR generadas por IA e incluso por plataformas de alojamiento libres de IA.
- Otros prefieren filtros en lugar de prohibiciones, comparándolo con el spam de correo y favoreciendo la triage automatizada sobre el rechazo tajante.
- Filtros sociales: exigir a los contribuyentes primerizos un breve audio/video o, al menos, responder “¿qué problema estabas encontrando?” antes de la revisión.
Ideas a nivel de GitHub y del ecosistema
- Se menciona los límites de PR de GitHub y la desactivación de PR; hay escepticismo de que los límites de frecuencia por sí solos reduzcan significativamente el spam.
- Sugerencias de sistemas de reputación basados en el historial de PR, confianza basada en organizaciones, “guilds” que avalen a sus miembros o modelos estilo web of trust.
- Preocupación de que la confianza basada en organizaciones pueda derivar en privilegiar grandes cuentas corporativas y excluir a individuos.
Reflexiones más amplias
- Comparaciones con el spam de correo de principios de los 2000: acciones baratas a gran escala que convierten canales antes íntimos y de alta señal en canales ruidosos.
- Algunos ven esto como una contribución a la sensación de que “el OSS está muerto”; otros creen que nuevos ecosistemas y proyectos alternativos pueden beneficiarse.