Por Canuto  

Google planea enmendar su demanda contra SerpApi después de que un tribunal rechazara su estrategia basada en la DMCA. La disputa enfrenta a las grandes plataformas con quienes defienden el acceso automatizado a la web abierta en medio del auge del scraping de IA.
***

  • Un tribunal desestimó tempranamente la demanda de Google contra SerpApi porque la empresa no demostró ser dueña del contenido de sus resultados de búsqueda.
  • Google tendrá 21 días para presentar una demanda enmendada y limitar su argumento a ciertos contenidos licenciados en los paneles de conocimiento.
  • SerpApi sostiene que Google y Reddit intentan controlar o cobrar por información pública, mientras expertos advierten sobre un nuevo cierre de la web.


Google insiste en bloquear el scraping de IA pese a su derrota judicial

Google confirmó que continuará su ofensiva contra los bots de inteligencia artificial que recopilan información de sus resultados de búsqueda. La decisión llega después de que un tribunal rechazara tempranamente una demanda presentada contra SerpApi, proveedor de acceso estructurado a datos de búsqueda.

La disputa también involucra a Reddit, que presentó una demanda similar contra SerpApi y Perplexity. Ambas plataformas sostienen que los servicios automatizados eluden sus controles de seguridad y aprovechan contenido sin autorización.

Una estrategia legal basada en la DMCA

Google demandó a SerpApi en diciembre pasado bajo la Ley de Derechos de Autor del Milenio Digital, conocida como DMCA. La compañía acusó al raspador web de eludir su tecnología anti scraping y vender resultados mediante un servicio no autorizado llamado Google Search API.

El argumento generó dudas porque los resultados de búsqueda de Google, por sí mismos, no pueden ser objeto de derechos de autor. La empresa alegó, sin embargo, que algunos paneles de conocimiento incluyen materiales protegidos que Google licencia de titulares de derechos.

Google afirmó que sus controles anti scraping protegen esas relaciones comerciales. Según la compañía, SerpApi amenaza acuerdos con propietarios de contenido que autorizan la aparición de información en paneles dedicados a personas o entidades conocidas.

La empresa también sostuvo que la elusión de sus medidas viola sus términos de servicio. En su demanda, argumentó que el acceso automatizado impide obtener ingresos o compensar el costo asociado con miles de millones de búsquedas realizadas por bots.

La demanda llegó después de que Reddit iniciara una acción similar en octubre. Reddit acusó a SerpApi y Perplexity de recopilar contenido de su plataforma cuando ese material aparecía dentro de los resultados de búsqueda de Google.

La compañía añadió que SerpApi eludía dos capas de protección. La primera correspondía a los controles de Reddit para bloquear el scraping directo y la segunda, a las defensas de Google contra la extracción de contenido de Reddit desde sus resultados.

Meredith Rose, asesora jurídica sénior de políticas en Public Knowledge, describió la estrategia como una búsqueda de cualquier herramienta disponible frente al aumento sostenido del scraping de IA durante los últimos tres años.

Rose calificó de extraña la aplicación de la DMCA, porque ese no era el caso de uso contemplado originalmente por la ley. También consideró comprensible que las plataformas recurran a ella, ya que históricamente ha servido para detener rápidamente usos no deseados y abrir negociaciones sobre licencias.

El tribunal limita la demanda de Google

La semana pasada, un tribunal concedió la moción de desestimación presentada por SerpApi al comienzo de la demanda. El juez concluyó que Google no tenía legitimidad suficiente bajo la DMCA porque no demostró ser propietario del contenido mostrado en sus resultados.

La decisión también señaló que Google no había probado que actuara en nombre de los titulares de derechos. Rose explicó que este tipo de desestimación temprana es poco frecuente, pues el problema se redujo a que Google no describió adecuadamente qué obra protegida intentaba defender.

El fallo tuvo consecuencias potenciales para el caso de Reddit. La empresa enfrentó una audiencia sobre la moción de desestimación de SerpApi el jueves pasado, aunque todavía no se conoce qué dirección tomará el tribunal.

Rose consideró que la derrota de Google no favorece a Reddit. Según su análisis, Reddit tampoco puede afirmar que sea propietario o licenciatario exclusivo de todo el contenido que aparece en los resultados de búsqueda.

La experta señaló que el juez de Google identificó tres posibles bases para presentar una demanda bajo la DMCA. Podrían hacerlo el propietario de los derechos, el licenciatario exclusivo o quien despliega y fabrica la medida tecnológica de protección en cuestión.

En opinión de Rose, Reddit no encaja claramente en ninguna de esas categorías. La plataforma alberga publicaciones de sus usuarios, pero esa relación no convierte automáticamente a Reddit en dueño de todo el material que aparece posteriormente en una búsqueda de Google.

SerpApi describió el fallo como una victoria importante para la web abierta. La compañía sostuvo que Google y Reddit intentan utilizar la DMCA para reclamar control retroactivo sobre contenidos que no poseen ni autorizaron originalmente.

El proveedor añadió que su negocio siguió creciendo durante las demandas. También advirtió que sus clientes, entre ellos Nvidia, Uber y Adobe, enfrentan incertidumbre porque dependen diariamente de un acceso estructurado a datos de búsqueda.

Google aún puede modificar su demanda

La resolución no cerró por completo el litigio. Google dispone de 21 días para presentar una demanda enmendada, luego de que el tribunal le permitiera intentar corregir las deficiencias de su planteamiento.

La compañía podría concentrarse en los paneles de conocimiento que contienen materiales protegidos y licenciados directamente por titulares de derechos. Si demuestra que esos titulares autorizaron a Google a aplicar controles tecnológicos contra accesos no autorizados, su reclamación podría continuar de forma limitada.

José Castañeda, portavoz de Google, afirmó que la compañía está satisfecha porque el tribunal rechazó casi todos los argumentos legales de SerpApi. También confirmó que Google espera presentar una nueva demanda y que seguirá protegiendo sus servicios y socios frente a accesos no autorizados.

La estrategia plantea un riesgo adicional para Google. Rose advirtió que la empresa podría complicar su propia posición si sostiene que los paneles de conocimiento están llenos de material protegido, porque no licencia cada elemento que aparece en ellos.

Google tendría que distinguir entre reproducciones de contenido protegido que fueron licenciadas y otros elementos generados o seleccionados algorítmicamente. Si presenta el panel completo como material protegido, podría exponerse a futuras acusaciones de reproducción sin licencia.

Ese escenario abriría una discusión diferente sobre el uso justo. Rose sugirió que Google intentará afirmar que solo ciertas partes de los paneles son reproducciones de obras licenciadas, para evitar una disputa más amplia sobre el contenido que organiza o genera mediante sus sistemas.

Mientras tanto, SerpApi espera que el conflicto termine pronto. La empresa afirmó que podría tener poco sentido continuar discutiendo fragmentos de texto de los paneles de conocimiento después de que Google presentara su ofensiva como una defensa de cientos de miles de editores.

La compañía también cuestionó la posición de Reddit. SerpApi acusó a la plataforma de querer convertirse en un cobrador de peaje por el scraping, pese a que no posee necesariamente todo el contenido publicado por sus usuarios.

Según SerpApi, Reddit busca consolidar el control sobre las publicaciones de sus usuarios para cobrar por el acceso. La empresa afirmó que esa estrategia no protege a los usuarios, sino que crea una vía para explotar económicamente sus contenidos.

El impacto sobre la web abierta

El caso excede la disputa comercial entre empresas tecnológicas. La decisión podría influir en la manera en que buscadores, plataformas, investigadores y desarrolladores interpretan los límites del acceso automatizado a información disponible públicamente.

Rose explicó que muchos editores comenzaron a cerrar el acceso a la web abierta desde el verano de 2023. La reacción respondió al crecimiento del scraping de IA, pero también produjo una especie de nuevo encerramiento de grandes partes de Internet.

Ese cierre no solo afecta el entrenamiento de sistemas de inteligencia artificial. También puede dificultar la investigación académica, el archivado, el periodismo, los informes de salud pública y otros trabajos que dependen de exploración anónima y recopilación automatizada a gran escala.

El problema surge porque el scraping puede tener finalidades muy distintas. Algunas empresas lo utilizan para desarrollar productos comerciales, mientras investigadores, periodistas y organizaciones públicas pueden emplearlo para estudiar tendencias o preservar información.

Google y Reddit, por su parte, enfrentan incentivos financieros y operativos para restringir el acceso. Google busca proteger sus servicios y acuerdos con socios, mientras Reddit intenta controlar el uso de publicaciones que generan valor dentro de su plataforma.

SerpApi sostiene que la información mostrada en los resultados de búsqueda es pública. Su argumento central es que una plataforma no debería convertir controles técnicos internos en una propiedad legal general sobre todos los datos que indexa o presenta.

La empresa también acusó a Google de pedir al tribunal que ignore su propio papel como el mayor raspador del planeta. Según SerpApi, Google recopila información de Internet a gran escala, pero pretende impedir que otros accedan a datos públicos mediante servicios automatizados.

Rose reconoció que SerpApi no necesariamente cuenta con el apoyo de todos los actores de la industria. Aun así, consideró que la compañía tiene razón desde una perspectiva de políticas públicas al defender el acceso abierto a información disponible en línea.

La asesora advirtió que no existe una ganancia clara para los usuarios si el resultado final consiste en eliminar el acceso público a los datos. También señaló que algunos editores actúan por motivos financieros, mientras otros intentan proteger su infraestructura o expresar una posición ética frente a la IA.

El resultado del caso de Reddit sigue siendo incierto. Rose dijo que los litigios de derechos de autor pueden ser difíciles de predecir, porque los jueces pueden interpretar de manera distinta conceptos como protección tecnológica, titularidad y acceso público.

SerpApi espera que el tribunal desestime también la demanda de Reddit. La compañía asegura que sus clientes, investigadores y proveedores de servicios de optimización para buscadores han expresado un respaldo amplio a su defensa.

El caso de Google continuará, aunque posiblemente con un alcance mucho más estrecho. La nueva demanda permitirá conocer si la empresa puede vincular sus controles anti scraping con contenido protegido que haya sido licenciado directamente por sus propietarios.

La disputa también conserva una dimensión corporativa relevante. Advance Publications, empresa matriz de Ars Technica, es el mayor accionista de Reddit, una relación que debe tenerse presente al evaluar la cobertura del caso.

Por ahora, la batalla enfrenta dos visiones sobre Internet. Una considera que las plataformas deben controlar el acceso automatizado para proteger ingresos, infraestructura y acuerdos; la otra sostiene que los intermediarios no pueden reclamar la propiedad de una web pública que no crearon por completo.


Imagen original de DiarioBitcoin, creada con inteligencia artificial, de uso libre, licenciada bajo Dominio Público.

Este artículo fue escrito por un redactor de contenido de IA y revisado por un editor humano para garantizar calidad y precisión.


ADVERTENCIA: DiarioBitcoin ofrece contenido informativo y educativo sobre diversos temas, incluyendo criptomonedas, IA, tecnología y regulaciones. No brindamos asesoramiento financiero. Las inversiones en criptoactivos son de alto riesgo y pueden no ser adecuadas para todos. Investigue, consulte a un experto y verifique la legislación aplicable antes de invertir. Podría perder todo su capital.

Suscríbete a nuestro boletín