OpenAI enfrenta graves acusaciones en disputa de derechos de autor con organizaciones de noticias

OpenAI may have made a fatal misstep in copyright fight with news orgs

OpenAI se encuentra en el centro de una polémica legal tras ser acusado por organizaciones de noticias, lideradas por The New York Times, de ocultar pruebas cruciales en un caso de infracción de derechos de autor. Las organizaciones demandantes alegan que OpenAI ha mentido repetidamente para impedir el acceso a millones de registros que podrían demostrar que su tecnología ChatGPT ha sido utilizada para eludir los muros de pago de los sitios de noticias.

En una moción de sanciones presentada el jueves, se acusa a OpenAI de haber engañado al tribunal durante dos años sobre la capacidad técnica para buscar en grandes muestras de registros de ChatGPT. La revelación surgió cuando Vincent Monaco, ingeniero de privacidad de OpenAI, fue obligado a testificar nuevamente en abril, revelando que la empresa ya había realizado búsquedas en estos registros antes del inicio del litigio.

Las organizaciones de noticias argumentan que las acciones de OpenAI han prolongado el proceso de descubrimiento, incrementado los costos y sobrecargado al tribunal. Un portavoz de OpenAI, sin embargo, sugiere que la moción de sanciones del NYT es un intento tardío de acceder a más registros y violar la privacidad de los usuarios. Según el portavoz, el hecho de que el NYT haya retirado algunas reclamaciones indica que su caso se está debilitando.

No obstante, Graham James, portavoz del NYT, sostiene que el caso se ha fortalecido al incluir nuevas reclamaciones contra Microsoft, afirmando que «nuestros reclamos principales siguen siendo los mismos desde el día en que presentamos esta demanda: que Microsoft y OpenAI robaron millones de obras con derechos de autor de The Times para competir con nuestros productos y enriquecerse ilegalmente».

La moción de sanciones, aunque fuertemente redactada, alega que OpenAI ocultó la existencia de dos grandes muestras de registros, de 10 millones y 78 millones de registros respectivamente, que podrían haber sido puestas a disposición de los demandantes desde el principio. OpenAI ya había buscado contenido del NYT en estas muestras como parte de su investigación para crear un filtro que bloqueara la reproducción de contenido con derechos de autor.

El tribunal ha calificado una muestra proporcionada por OpenAI como «inutilizable» debido a las excesivas redacciones realizadas, lo que ha dificultado la búsqueda de los demandantes. A pesar de que OpenAI eliminó algunas redacciones, aún quedan muchas que impiden la búsqueda efectiva de los datos.

Las organizaciones de noticias alegan que OpenAI no solo se opuso a la producción de estas pruebas basándose en la carga o relevancia, sino que también representó falsamente al tribunal que obtener esta evidencia estaba más allá de sus capacidades sin un gasto significativo de tiempo y recursos, ocultando que este trabajo ya se había realizado.

 

Fuente: https://arstechnica.com/tech-policy/2026/07/openai-faked-inability-to-search-training-data-hid-billions-of-logs-nyt-says/

Regístrate para leer esta noticia

Solo necesitas tu email. Sin contraseñas.

← Home