Tutto l'open source
Open SourceScraping17k

Crawlee

Libreria di crawling in produzione con code, rotazione dei proxy e gestione delle sessioni.

Crawlee è una libreria per il web scraping e l'automazione del browser sviluppata da Apify per la creazione di crawler affidabili in Node.js/TypeScript e Python. Fornisce crawler HTTP e headless unificati (Playwright, Puppeteer), accodamento automatico delle richieste, rotazione dei proxy e funzionalità anti-blocco. Si distingue per la gestione out-of-the-box dello stato del crawl, del scaling e dei retry.

Repository

apify/crawlee

Linguaggio

TypeScript

Cosa ci costruiresti

  • Costruire crawler su larga scala con accodamento automatico e retry
  • Ruotare i proxy e gestire le sessioni per evitare il blocco
  • Effettuare il crawl di siti JavaScript-heavy con browser headless gestiti

Tag

crawlingscrapingproxy