Blog

Derniers articles et informations sur les proxies, le web scraping et l'infrastructure Internet

7,3 millions de profils Chess.com, 4,6 millions d'emails et des segments publicitaires cachés ont été rendus accessibles au public — sans aucun piratage. Les données ont été collectées pendant neuf jours consécutifs, en utilisant des bases d'emails étrangères dans la fonction de recherche d'amis. Nous analysons comment distinguer le scraping du piratage par UUID et le rythme de l'extraction, et où se situe la frontière entre la collecte de données publiques et le déchiffrement des identifiants personnels.

📅 14 septembre 2026
Lire l'article

HTTP 200 ne signifie plus « données collectées ». Nepenthes, Iocaine et Cloudflare AI Labyrinth alimentent les crawlers avec un texte généré sans fin, et les pages empoisonnées poussent les agents IA à recommander des marques inexistantes dans 27–73,8 % des cas. Nous examinons trois mécanismes de corruption silencieuse des données et sept vérifications qui attrapent les déchets avant l'enregistrement dans la base.

📅 13 septembre 2026
Lire l'article