Öppen källkodScraping17k
Crawlee
Produktionsklar crawlingbibliotek med köhantering, proxirotation och sessioner.
Crawlee är ett webbskrapnings- och webbläsarautomatiseringsbibliotek från Apify för att bygga tillförlitliga crawlers i Node.js/TypeScript och Python. Det tillhandahåller enhetliga HTTP- och headless-webbläsarcrawlers (Playwright, Puppeteer), automatisk köhantering för förfrågningar, proxirotation och anti-blockingfunktioner. Det är anmärkningsvärt för att hantera crawl-tillståndshantering, skalning och återförsök direkt ur lådan.
Kodförråd
apify/crawleeSpråk
TypeScriptVad du kan bygga med det
- Bygga storskaliga crawlers med automatisk köhantering och återförsök
- Rotera proxies och hantera sessioner för att undvika blockering
- Crawla JavaScript-tunga sajter med hanterade headless-webbläsare
Taggar
crawlingscrapingproxy