Blog

Últimos artículos e información sobre proxies, web scraping e infraestructura de Internet

Firecrawl, Crawl4AI y Crawlee por defecto funcionan con la IP de tu servidor y cargan la página completa — con imágenes que en markdown de todos modos no aparecerán. Analizamos dónde en cada herramienta se configura el proxy, cómo activar la escalación multinivel (solicitud directa → centro de datos → residenciales) y cómo cortar el tráfico multimedia, para que la recolección de datos para RAG no se convierta en una factura por gigabytes.

📅 22 de agosto de 2026
Leer artículo

El 4 de agosto de 2026, en Rusia, dejaron de funcionar simultáneamente más de 20 servicios de elusión de bloqueos. La razón no está en el protocolo: se filtraron direcciones IP y subredes enteras de proveedores de alojamiento. Analizamos en qué se diferencia el bloqueo por espacio de direcciones del DPI, qué propone el Ministerio de Digitalización sobre las "listas blancas" y por qué los proxies residenciales y móviles tienen una superficie de bloqueo diferente.

📅 21 de agosto de 2026
Leer artículo

Los API oficiales han aumentado de precio considerablemente, algunos se han cerrado para nuevos clientes, y los tribunales se han pronunciado por primera vez sobre el acceso de agentes de IA. Comparamos el API oficial, la compra de conjuntos de datos y el propio scraping a través de proxies según siete criterios y ofrecemos una matriz de selección para cinco escenarios típicos.

📅 20 de agosto de 2026
Leer artículo