Blog

Artikel dan wawasan terbaru tentang proxy, web scraping, dan infrastruktur internet

7,3 juta profil Chess.com, 4,6 juta email dan segmen iklan tersembunyi telah tersedia untuk umum — tanpa satu pun peretasan. Data dikumpulkan selama sembilan hari berturut-turut, dengan memasukkan basis email orang lain ke dalam fungsi pencarian teman. Kami membahas bagaimana membedakan scraping dari peretasan berdasarkan UUID dan ritme pengunduhan, serta di mana batas antara pengumpulan data publik dan pencarian pengenal pribadi.

📅 14 September 2026
Baca artikel

HTTP 200 tidak lagi berarti "data dikumpulkan". Nepenthes, Iocaine, dan Cloudflare AI Labyrinth memberi makan perayap dengan teks yang dihasilkan tanpa henti, sementara halaman yang terinfeksi membuat agen AI merekomendasikan merek yang tidak ada dalam 27–73,8% kasus. Mari kita bahas tiga mekanisme kerusakan data yang diam-diam dan tujuh pemeriksaan yang menangkap sampah sebelum dicatat ke dalam basis data.

📅 13 September 2026
Baca artikel