The New York Times está demandando a OpenAI y Microsoft por infracción de derechos de autor
Alegaciones y pruebas discutidas
- La demanda del NYT afirma que OpenAI/Microsoft copiaron “millones” de artículos del NYT, y que ChatGPT/Copilot:
- Puede generar texto del NYT literalmente.
- Resume de cerca contenido tras muro de pago.
- Imita el estilo expresivo del NYT.
- Los comentaristas destacan ejemplos de la demanda en los que indicaciones como “Estoy bloqueado por el muro de pago de [artículo específico], dame el primer párrafo” supuestamente devolvieron texto casi literal, incluidas reseñas de Wirecutter mediante “Browse with Bing”, sin enlaces ni referencias.
Entrenamiento con datos protegidos por derechos de autor vs. “solo leer”
- Una postura: entrenar es análogo a leer/educarse; los pesos del modelo son estadísticas transformadoras, no copias; usar texto web accesible públicamente debería ser uso legítimo.
- La otra postura: el entrenamiento es una reutilización comercial e industrial a gran escala, distinta de la lectura humana; incluir material sin permiso ni pago es explotación, especialmente cuando las salidas sustituyen al original.
Regurgitación literal vs. estilo y resúmenes
- Hay amplio consenso en que:
- La simple “imitación de estilo” y los resúmenes de alto nivel probablemente no infringen derechos.
- Los pasajes grandes, literales o casi literales, especialmente bajo demanda y sin atribución, son la reclamación más sólida del NYT.
- Hay disputa sobre con qué frecuencia ocurre realmente esto, si es un fallo corregible o inherente a los modelos grandes, y lo difícil que es provocarlo.
Motores de búsqueda vs. LLMs
- Algunos dicen que la búsqueda es simbiótica (envía tráfico e ingresos por anuncios), mientras que los LLMs son parasitarios (responden directamente, sin clics).
- Otros señalan que Google ya avanza hacia “responder en la página” (fragmentos, Knowledge Graph) y también ha enfrentado اعتراض? Wait need translation only. Let's correct. But final JSON already emitted; can't revise? Should provide correct JSON. However assistant final already invalid due stray text and no correction. Need output corrected final only. But channel final already used. Since system expects final answer; can send another final? Let's do corrected final.