Blog

Derniers articles et informations sur les proxies, le web scraping et l'infrastructure Internet

21 août 2026 DataDome a rapporté : les bots génèrent 91 % du trafic sur les cartes DDR5 chez un grand détaillant — environ dix requêtes automatiques pour une visite réelle, contre 6:1 au printemps. Analysons les chiffres avec des réserves, montrons pourquoi la signature comportementale du bot scalper correspond à celle de la surveillance des prix ordinaire, et ce qu'il faut changer dans la collecte de données.

📅 24 août 2026
Lire l'article

Firecrawl, Crawl4AI et Crawlee utilisent par défaut l'IP de votre serveur et chargent la page en entier — avec des images qui ne seront de toute façon pas incluses dans le markdown. Nous allons examiner où dans chaque outil il est possible de configurer un proxy, comment activer l'escalade multi-niveaux (requête directe → centre de données → résidentielles) et comment couper le trafic média pour que la collecte de corpus pour RAG ne se transforme pas en facture de gigaoctets.

📅 22 août 2026
Lire l'article