Por Canuto  

El juez Paul A. Engelmayer mantiene viva la demanda de Reddit contra SerpApi y Perplexity AI por elusión de las protecciones de Google para raspar contenido protegido. La decisión contradice un fallo similar que favoreció a Google, y podría redefinir los límites del raspado de datos para IA.
***

  • Reddit logra que un juez mantenga viva su demanda por infracción de DMCA contra SerpApi y Perplexity AI.
  • El fallo distingue el caso del de Google, al considerar que Reddit tiene acuerdos de licencia específicos con Google que prohíben ciertos usos de contenido.
  • La decisión podría afectar a las empresas de IA que dependen del raspado de contenido público, al sentar un precedente legal para el control de datos.


Introducción: la batalla legal por el contenido raspado

La demanda de Reddit contra SerpApi y Perplexity AI, reportada por Ars Technica, ha dado un paso importante. El juez Paul A. Engelmayer del Tribunal de Distrito de EE. UU. negó en gran medida la moción de desestimación presentada por SerpApi.

La decisión mantiene vivo el caso, que acusa a ambas empresas de conspirar para eludir los controles de acceso de Google y raspar contenido protegido de Reddit de los resultados de búsqueda.

Reddit alega que SerpApi proporcionó un producto para eludir Google SearchGuard, y que Perplexity AI pagó por ese servicio. El juez consideró plausible la conspiración en esta etapa temprana.

Este fallo contrasta con una decisión reciente que desestimó una demanda similar presentada por Google. En ese caso, el tribunal encontró que Google no había probado que los titulares de derechos hubieran autorizado el bloqueo de raspado.

El caso de Reddit se distingue porque la empresa argumenta que su acuerdo de licencia con Google prohíbe ciertos usos de sus datos. Según Reddit, sus socios deben eliminar publicaciones cuando los usuarios las eliminan.

La decisión judicial: un giro frente al caso de Google

El juez Engelmayer señaló que Reddit ha alegado de manera plausible que hubo una conspiración. La empresa afirmó que SerpApi y Perplexity AI colaboraron para acceder a fragmentos de obras protegidas por la Ley de Derechos de Autor.

Además, el juez encontró que la tecnología SearchGuard de Google constituye una medida tecnológica que controla efectivamente el acceso. La elusión de esa medida es el núcleo de la reclamación bajo la DMCA.

El juez también razonó que, aunque la tecnología fue inventada después del acuerdo entre Google y Reddit, sería poco práctico exigir actualizaciones constantes de los acuerdos de licencia. “La decisión de Google no es contraria al caso de Reddit”, según la opinión.

En el caso de Google, el tribunal determinó que no se había probado que los titulares de derechos autorizaran a Google a usar tecnología anti-elusión. Pero Reddit fue más allá, presentando su acuerdo de licencia específico que prohíbe ciertos usos de datos.

La decisión no fue una victoria total para Reddit. El juez desestimó las reclamaciones de enriquecimiento injusto y competencia desleal, citando que estaban preemptadas por la Ley de Derechos de Autor.

La argumentación de Reddit: el acuerdo de licencia y las eliminaciones

Reddit argumenta que cuando licencia contenido a socios como Google, sus socios deben eliminar publicaciones que Reddit marca cuando los usuarios eliminan su contenido. Esto es crucial para honrar la promesa de privacidad a los usuarios.

Según Reddit, “millones de publicaciones” son eliminadas mensualmente. Los esfuerzos no autorizados como la asociación de SerpApi con Perplexity AI dificultan que Reddit cumpla con esa promesa.

La acumulación de publicaciones eliminadas en el motor de respuestas de Perplexity AI dañaría la reputación de Reddit, así como sus ganancias. Esta afirmación fue considerada plausible por el juez.

Reddit ha solicitado una orden judicial que bloquee el acceso de SerpApi y Perplexity AI tanto a Reddit como a Google. También pide detener la elusión de SearchGuard y prohibir el uso de datos raspados anteriormente.

Un portavoz de Reddit celebró la decisión, afirmando: “Reddit apoya el acceso responsable al contenido público, pero nos oponemos a empresas que eluden nuestras protecciones, ignoran nuestras reglas y se benefician de nuestras comunidades sin permiso.”

La defensa de SerpApi y Perplexity AI: hechos y derecho

SerpApi y Perplexity AI lograron desestimar algunas reclamaciones, pero la mayor parte de la demanda continúa. El abogado de SerpApi, Jeff Homrig, declaró: “Seguimos confiando en nuestra posición. El tribunal ha decidido escuchar los hechos; los hechos están de nuestro lado.”

Homrig afirmó que SerpApi accede a resultados de búsqueda públicos, no a la plataforma de Reddit. “La información pública no se vuelve protegida porque una plataforma quiere cobrar por ella”, agregó.

El juez señaló que SerpApi y Perplexity AI podrían demostrar en el descubrimiento que Reddit nunca autorizó a Google a proteger su contenido en los resultados de búsqueda. También podrían argumentar que el contenido accesible públicamente no está protegido por la Ley de Derechos de Autor.

Perplexity AI no respondió de inmediato a la solicitud de comentarios de Ars Technica. El caso aún está en etapas tempranas y el descubrimiento será clave para determinar los hechos.

El caso ha llamado la atención por su uso de la DMCA en el contexto del scraping de IA. Expertos como Meredith Rose, de Public Knowledge, opinaron que Google y Reddit parecen estar “aferrándose a cualquier herramienta disponible” ante el aumento del raspado de IA.

Implicaciones para la industria de la IA y el scraping

Si Reddit gana esta batalla, podría estar en una mejor posición para obligar a los raspadores de IA a entrar en acuerdos de licencia. Esto tendría un impacto significativo en el ecosistema de la inteligencia artificial.

Muchas empresas de IA dependen del raspado de contenido público para entrenar sus modelos. Una victoria de Reddit podría sentar precedentes sobre cómo se manejan los datos protegidos por derechos de autor en línea.

Sin embargo, la decisión del juez no resuelve el fondo del asunto. SerpApi y Perplexity AI aún pueden demostrar que no hay conspiración o que el contenido es de dominio público.

La controversia subraya la tensión entre la apertura de internet y la protección de la propiedad intelectual. Empresas como Reddit buscan controlar cómo se utiliza su contenido, mientras que los raspadores abogan por el acceso libre a la información pública.

El caso podría tardar meses o años en resolverse. Mientras tanto, otras plataformas observan de cerca cómo se desarrollan estos argumentos legales, que podrían cambiar las reglas del juego para la IA.


ADVERTENCIA: DiarioBitcoin ofrece contenido informativo y educativo sobre diversos temas, incluyendo criptomonedas, IA, tecnología y regulaciones. No brindamos asesoramiento financiero. Las inversiones en criptoactivos son de alto riesgo y pueden no ser adecuadas para todos. Investigue, consulte a un experto y verifique la legislación aplicable antes de invertir. Podría perder todo su capital.

Suscríbete a nuestro boletín