Volver al blog

Google pierde la demanda sobre el scraping de resultados: el caso de SerpApi y su impacto

El 20 de julio de 2026, el tribunal federal de California desestimó la demanda de Google contra SerpApi: el sistema anti-bots SearchGuard no protege los derechos de autor cuando se basa en resultados de búsqueda comunes: URL, fragmentos y hechos de índice. Analizamos los detalles de la decisión, lo que quedó fuera de su alcance y cómo esto afecta la práctica de recolección de datos de SERP.

📅24 de julio de 2026
Google pierde la demanda sobre el scraping de resultados: el caso de SerpApi y su impacto

El 20 de julio de 2026, el tribunal federal del Distrito Norte de California desestimó la demanda de Google contra SerpApi, una empresa que vende acceso a los resultados de búsqueda a través de una API. Google intentó aplicar las normas anti-elusión del DMCA al scraping de SERP, las mismas que se redactaron contra el hackeo de la protección de DVD. El tribunal respondió: las barreras técnicas alrededor de datos que no están protegidos por derechos de autor no están protegidas por la ley de derechos de autor. Analizaremos lo que realmente decidió el tribunal, lo que no decidió y qué implica esto para todos los que recopilan datos de los resultados.

Qué ocurrió: cronología del caso

Google presentó la demanda el 19 de diciembre de 2025 (caso 25-cv-10826-YGR, Distrito Norte de California). El demandado es SerpApi, un servicio que proporciona resultados de búsqueda de Google en un formato estructurado a través de una API. Sus datos son utilizados por una parte significativa de la industria SEO: rastreadores de posiciones, herramientas de selección de palabras clave, paneles de inteligencia competitiva.

Hechos clave del caso:

  • SearchGuard — un sistema anti-scraping lanzado por Google en enero de 2025. Envía desafíos de JavaScript a solicitudes de fuentes no identificadas y requiere confirmar que hay una persona detrás del navegador. La automatización generalmente no supera tales verificaciones y recibe un rechazo.
  • Según Google, SerpApi generaba “cientos de millones de solicitudes de búsqueda artificiales al día”, y el volumen de solicitudes creció aproximadamente un 25,000% en dos años.
  • Google exigía daños estatutarios — de $200 a $2500 por cada acto de elusión. Con millones de solicitudes, la suma superaba con creces los ingresos anuales de SerpApi, que se miden en millones de dólares. En otras palabras, si la demanda tenía éxito, simplemente cerraría la empresa.
  • SerpApi presentó una moción para desestimar en febrero de 2026. La decisión fue emitida por la jueza principal del distrito Yvonne Gonzalez Rogers el 20 de julio de 2026.

Por qué el DMCA no funcionó

La sección 1201 del DMCA prohíbe eludir medios técnicos que “controlan efectivamente el acceso a una obra protegida por derechos de autor”. La lógica de Google: SearchGuard es un medio de protección técnica, SerpApi lo elude, por lo tanto, hay una violación.

El tribunal desglosó la construcción en partes. La entrega normal — URLs, snippets, datos reales del índice, posiciones — son hechos de dominio público, no “obras protegidas por derechos de autor”. Por lo tanto, SearchGuard en este aspecto “no puede considerarse como controlando efectivamente el acceso a una obra protegida”. Las reclamaciones basadas en resultados no protegidos por derechos de autor fueron desestimadas con prejuicio — sin derecho a re-presentación.

Google argumentó que la página de resultados es una “mezcla” de contenido protegido y no protegido, y citó como ejemplo las imágenes con licencia en el Knowledge Panel. Aquí, el tribunal adoptó una posición más suave: estas reclamaciones fueron desestimadas con derecho a corregir la demanda. Pero con la condición de que Google debe mostrar hechos que demuestren que SearchGuard protege elementos con derechos de autor con el consentimiento de los propios titulares de derechos. Simplemente colocar una imagen licenciada ajena en su página y declarar que su anti-bot es su protección no será suficiente. Google tiene 21 días para presentar una demanda corregida.

La formulación del blog de SerpApi al final: el tribunal “desestimó los intentos de Google de ampliar el DMCA para controlar el acceso a páginas públicas”. El CEO de la empresa, Julien Halégu, llama a la decisión una protección “del acceso abierto a datos públicos”.

Por qué este caso es más grande que la disputa entre dos empresas

El contexto de los últimos año y medio explica por qué Google decidió ir a los tribunales. Técnicamente, ya había presionado el mercado de datos SERP antes:

  • En septiembre de 2025, Google eliminó el parámetro num=100, que permitía obtener cien resultados en una sola solicitud. El costo de la extracción completa de resultados para las herramientas aumentó aproximadamente diez veces.
  • Cuando DataForSEO lanzó una solución alternativa que reducía costos en aproximadamente un 80%, Google la bloqueó en cinco días.

Es decir, en términos técnicos, Google ya estaba ganando. La demanda fue un intento de agregar un palanca legal a esto: convertir la elusión del anti-bot en un delito con multas fijas por cada solicitud. Esto es lo que el tribunal no permitió. Si hubiera pasado, cualquier CAPTCHA o desafío JS en una página pública se convertiría automáticamente en “protección técnica de una obra” — y cualquier parser de datos públicos se convertiría en un infractor del DMCA por defecto.

La economía del asunto: por qué hay una guerra por los datos SERP

Los resultados de búsqueda no son solo “otra fuente de datos”. Se ha construido toda una industria sobre ellos: seguimiento de posiciones, análisis de competidores, monitoreo de precios, conjuntos de datos de entrenamiento para modelos de IA. Google, al mismo tiempo, se encuentra en una posición ambivalente: la propia empresa construyó la búsqueda sobre la recopilación masiva de contenido ajeno, pero quiere controlar completamente el acceso al resultado agregado.

Un nivel separado es la inteligencia artificial. La entrega de búsqueda se ha convertido para los modelos de lenguaje en una forma rápida de obtener una imagen actualizada de Internet sin su propio crawler. Es por eso que en las demandas del último año, junto a los servicios de scraping clásicos, cada vez más aparecen empresas de IA. El argumento “simplemente leemos páginas públicas” suena igual tanto para la herramienta SEO como para el asistente de IA, y los tribunales apenas comienzan a discernir dónde se encuentra la frontera entre ellos. El caso de SerpApi ofrece una respuesta clara al menos sobre una cuestión: los derechos de autor no se extienden a los hechos solo porque estén detrás de un captcha.

La decisión continúa la línea familiar del caso hiQ Labs contra LinkedIn: la recopilación de datos de dominio público no se convierte en un delito solo porque al propietario de la plataforma no le guste. La diferencia es que hiQ se refería al CFAA (acceso no autorizado), mientras que aquí se ha cerrado otro camino de elusión — el de derechos de autor.

Qué NO anula esta decisión

Aquí es importante no confundir la victoria en un episodio con una indulgencia. Lo que permanece en su lugar:

  1. Las bloqueos técnicos no han desaparecido. SearchGuard funciona exactamente como lo hacía el 19 de julio. La decisión judicial no abre acceso — solo elimina un tipo específico de responsabilidad legal. Parsear resultados sigue siendo técnicamente complicado y costoso.
  2. Reclamaciones contractuales y ToS. La violación del acuerdo de usuario es un plano legal separado, la decisión del DMCA no la afecta.
  3. Derechos de autor sobre elementos específicos. Precisamente esa puerta quedó entreabierta por el tribunal. La entrega real — hechos; imágenes en el Knowledge Panel, contenido con licencia, fotografías, reseñas de usuarios — ya no. Recopilar “todo lo que hay en la página” y recopilar posiciones y snippets son acciones legalmente diferentes.
  4. Procesos paralelos. En octubre de 2025, Reddit presentó una demanda en el Distrito Sur de Nueva York contra Perplexity AI, SerpApi, Oxylabs y AWMProxy, acusándolos de eludir la protección y recopilar datos para IA; una queja revisada fue presentada el 6 de febrero de 2026, el caso está en la etapa de consideración de mociones para desestimar. Además, SerpApi se defiende de la demanda de SearchApi en Texas. El paisaje legal sigue siendo controvertido.

Y lo más importante: esta es una decisión de un tribunal de primera instancia, no un precedente de apelación. Google puede corregir la demanda en lo que respecta al contenido con licencia y luego apelar. Es prematuro asumir que la cuestión está cerrada para siempre.

Qué implica esto prácticamente

Si usted recopila datos de los resultados de búsqueda o planea hacerlo, la reacción razonable a la decisión no es “ahora se puede hacer todo”, sino aclarar las reglas de trabajo.

  1. Separe los hechos y el contenido protegido a nivel de parser. URLs, títulos, snippets, posiciones, presencia de bloques — este es el nivel fáctico, alrededor del cual la posición del tribunal es más fuerte. Imágenes, materiales con licencia integrados, textos completos de reseñas — son zonas de riesgo. Técnicamente, esto significa una lista blanca de campos en el extractor, y no “guardamos todo el HTML por si acaso”.
  2. No confunda el riesgo legal con el operativo. Su principal problema al extraer SERP no es el tribunal, sino los bloqueos, captchas y la calidad de IP. El mercado se ha endurecido: tras la eliminación de num=100, el mismo volumen de datos cuesta mucho más en solicitudes. La parte práctica — qué bloques extraer y por qué las sesiones se rompen — la hemos analizado en la guía sobre scraping de Google SERP y AI Overviews.
  3. Mantenga una carga adecuada. La cifra “25,000% de aumento en solicitudes” no se mencionó por casualidad en la demanda: un volumen agresivo se convierte en un argumento en su contra — tanto en el tribunal como ante el anti-bot. Intervalos razonables, solicitudes prioritarias en lugar de una extracción total y almacenamiento en caché de resultados reducen ambos tipos de riesgo al mismo tiempo.
  4. Mantenga el geo y el tipo de IP según la tarea. La entrega se personaliza según la región, y los datos extraídos “de cualquier lugar” son simplemente incorrectos. Para sesiones geo-precisas y estables, a menudo se utilizan proxies residenciales; para grandes volúmenes de solicitudes técnicas homogéneas, donde la sensibilidad a la detección es menor, los proxies de centro de datos son más económicos.
  5. Documente qué y por qué está recopilando. Un documento interno de media página — fuentes, campos, frecuencia, tiempo de almacenamiento — no cuesta mucho, y en cualquier disputa distingue la recopilación investigativa de la extracción descontrolada. Los matices legales relacionados se han analizado en el material sobre uso legal de proxies.

Conclusión

La decisión del 20 de julio de 2026 es un punto notable en la disputa sobre qué es el scraping de resultados públicos. El tribunal se negó a considerar el sistema anti-bot como “protección de una obra”, cuando detrás de él hay hechos y no contenido creativo, y cerró esta reclamación de manera definitiva. Al mismo tiempo, dejó a Google 21 días para intentar abordar los elementos con licencia de la página.

El sentido práctico para el mercado de datos es simple: la presión legal sobre la recopilación de hechos de los resultados se ha debilitado, pero la presión técnica no y no tiene intención de hacerlo. Las herramientas de análisis SEO, inteligencia competitiva y monitoreo de precios continúan operando en el mismo modo que antes: infraestructura de acceso de calidad, carga cuidadosa y una comprensión clara de qué campos específicos está extrayendo de la página.