Reddit avanza en su batalla legal contra el scraping de contenido

Reddit keeps its strange DMCA fight over Google search results alive

El pasado viernes, un juez en Estados Unidos rechazó en gran medida una moción para desestimar presentada por SerpApi, un agregador web acusado de conspirar con Perplexity AI para extraer ilegalmente contenido protegido por derechos de autor de Reddit desde los resultados de búsqueda de Google.

El juez de distrito Paul A. Engelmayer determinó que, en esta etapa inicial, Reddit ha presentado de manera plausible que existió una conspiración, con SerpApi proporcionando un producto para eludir los controles de acceso de Google y Perplexity AI pagando por ello.

Esta decisión llega menos de dos semanas después de que otro tribunal desestimara una acción similar presentada por Google, al no poder demostrar que los titulares de derechos, como Reddit, hubieran autorizado al motor de búsqueda para evitar la extracción de contenido protegido. Google ha manifestado su intención de enmendar su demanda para mantenerla viva, mientras que SerpApi ha declarado que tanto Google como Reddit intentan «usar el DMCA para aislar Internet abierto reclamando retroactivamente el control sobre contenido que no han creado ni poseen».

Para Google y Reddit, el objetivo es demostrar que SerpApi y Perplexity AI conspiraron para acceder a fragmentos de obras cubiertas por la Ley de Derechos de Autor, que estaban protegidas por una medida tecnológica que controla efectivamente el acceso, y que los acusados eludieron esa tecnología.

Google fracasó en el primer punto, otorgando a SerpApi una rara victoria en esta etapa temprana, pero puede fortalecer los argumentos de Google que Engelmayer coincidió con Reddit en que era plausible que la compañía hubiera autorizado a Google a usar tecnología anti-elusión para bloquear el scraping malicioso. Esto probablemente resulta molesto para los agregadores web como SerpApi, ya que Engelmayer cree que Reddit puede argumentar su caso, a pesar de que la tecnología de Google fue inventada más de un año después de que Google y Reddit firmaran su acuerdo de licencia.

Según Engelmayer, sería poco práctico esperar que los socios actualicen los acuerdos de licencia cada vez que una empresa implemente nuevos métodos de seguridad. Además, Engelmayer encontró que «la decisión de Google no es contraria» al caso de Reddit porque, a diferencia de Google, Reddit fue «más allá de la mera alegación» de que Google usó para afirmar que generalmente «tiene licencias para mostrar contenido protegido por derechos de autor». En cambio, Reddit argumentó que su acuerdo de licencia con Google prohíbe directamente ciertos usos de los datos de Reddit que ahora están siendo accedidos debido a los métodos de elusión empleados por agregadores web maliciosos.

Específicamente, Reddit argumentó que cuando licencia contenido a socios como Google, sus socios acuerdan eliminar las publicaciones que Reddit marca cuando los usuarios eliminan contenido. Según Reddit, «millones de publicaciones» se eliminan mensualmente, y los esfuerzos no autorizados como la asociación de SerpApi con Perplexity AI hacen imposible para Reddit proteger su promesa a los usuarios de honrar las eliminaciones de contenido. Y permitir que las publicaciones eliminadas persistan en el motor de respuestas de Perplexity AI supuestamente perjudica la reputación de Reddit, así como sus ganancias, argumentó con éxito Reddit.

Si Reddit gana la pelea, el popular foro de discusión en línea podría estar en una mejor posición para obligar a todos los agregadores de IA a firmar acuerdos de licencia. Reddit ha solicitado al tribunal una orden judicial que bloquee el acceso de SerpApi y Perplexity AI tanto a los sitios web de Reddit como de Google, otra orden que detenga la elusión de Google SearchGuard, y una tercera que impida a SerpApi y Reddit usar datos previamente extraídos.

Un portavoz de Reddit celebró el fallo contra la moción para desestimar en una declaración proporcionada a Ars. «El fallo de hoy nos acerca un paso más a responsabilizar a los malos actores», dijo el portavoz de Reddit. «Reddit apoya el acceso responsable al contenido público, pero nos oponemos a las empresas que eluden nuestras protecciones, ignoran nuestras reglas y se benefician de nuestras comunidades sin permiso. Los redditors crean algunas de las conversaciones humanas más valiosas en Internet. Tenemos la intención de protegerlas».

La lucha parece estar lejos de terminar, sin embargo, con Engelmayer señalando que SerpApi y Perplexity AI pueden demostrar a través del descubrimiento que Reddit nunca autorizó a Google a proteger su contenido en los resultados de búsqueda. SerpApi también puede fortalecer su defensa si puede probar que todo el contenido accesible públicamente en los resultados de búsqueda de Google no está protegido por la Ley de Derechos de Autor, sugirió una nota al pie de la opinión de Engelmayer.

La semana pasada, un experto en DMCA de Public Knowledge, Meredith Rose, dijo a Ars que Google y Reddit parecían estar «agarrándose a cualquier herramienta disponible» ante el repentino y continuo auge del scraping de IA en los últimos tres años. Y Reddit en particular parecía estar en una posición extraña en su reclamo bajo el DMCA porque «el juez en el caso de Google dijo: ‘Bueno, para tener legitimación para presentar una demanda bajo el DMCA, puedes ser el propietario de los derechos de autor o el licenciatario exclusivo o la persona que está desplegando y fabricando la medida de protección tecnológica en cuestión,'» dijo Rose a Ars.

Y confusamente, «Reddit no es ninguna de esas cosas.» Pero Rose reconoció que los fallos del DMCA parecían ser más sobre «vibras», lo que sugiere que puede ser difícil predecir un ganador o perdedor en esta pelea todavía.

Esta semana no fue una pérdida total para SerpApi y Perplexity AI, que lograron que se desestimaran las reclamaciones de enriquecimiento injusto y competencia desleal de Reddit, ya que ambas fueron preemptadas por la Ley de Derechos de Autor.

Consultado para hacer comentarios, Jeff Homrig, abogado de SerpApi, dijo a Ars que «seguimos confiando en nuestra posición. El tribunal ha decidido escuchar los hechos; los hechos están de nuestro lado. SerpApi accede a resultados de búsqueda públicos, no a la plataforma de Reddit, y la información pública no se vuelve protegida porque una plataforma quiera cobrar por ella. Esperamos con interés presentar ese caso.»

Fuente: https://arstechnica.com/tech-policy/2026/07/reddit-keeps-weird-dmca-lawsuit-against-web-scraper-alive-despite-googles-loss/

Regístrate para leer esta noticia

Solo necesitas tu email. Sin contraseñas.

← Home