Open SourceScraping17k
Crawlee
Libreria di crawling in produzione con code, rotazione dei proxy e gestione delle sessioni.
Crawlee è una libreria per il web scraping e l'automazione del browser sviluppata da Apify per la creazione di crawler affidabili in Node.js/TypeScript e Python. Fornisce crawler HTTP e headless unificati (Playwright, Puppeteer), accodamento automatico delle richieste, rotazione dei proxy e funzionalità anti-blocco. Si distingue per la gestione out-of-the-box dello stato del crawl, del scaling e dei retry.
Repository
apify/crawleeLinguaggio
TypeScriptCosa ci costruiresti
- Costruire crawler su larga scala con accodamento automatico e retry
- Ruotare i proxy e gestire le sessioni per evitare il blocco
- Effettuare il crawl di siti JavaScript-heavy con browser headless gestiti
Tag
crawlingscrapingproxy