Blog

Ultimi articoli e intuizioni sui proxy, web scraping e infrastruttura Internet

Firecrawl, Crawl4AI e Crawlee per impostazione predefinita operano con l'IP del tuo server e caricano la pagina interamente — con le immagini che comunque non verranno incluse nel markdown. Analizziamo dove in ogni strumento si imposta il proxy, come attivare l'escalation multilivello (richiesta diretta → data center → residenziale) e come limitare il traffico multimediale, affinché la raccolta del corpus per RAG non si trasformi in una bolletta per gigabyte.

📅 22 agosto 2026
Leggi articolo

Il 4 agosto 2026 in Russia hanno smesso di funzionare contemporaneamente oltre 20 servizi di bypass delle restrizioni. La ragione non è nel protocollo: sono stati filtrati indirizzi IP e intere sottoreti dei fornitori di hosting. Analizziamo in cosa la restrizione per spazio indirizzi differisce dal DPI, cosa propone il Ministero della Digitalizzazione riguardo ai "whitelist" e perché i proxy residenziali e mobili hanno una superficie di blocco diversa.

📅 21 agosto 2026
Leggi articolo