Código abiertoScraping17k
Crawlee
Librería de crawling para producción con colas, rotación de proxies y sesiones.
Crawlee es una librería de web scraping y automatización de navegadores desarrollada por Apify para construir crawlers fiables en Node.js/TypeScript y Python. Proporciona crawlers HTTP y de navegador headless unificados (Playwright, Puppeteer), encolado automático de peticiones, rotación de proxies y características anti-bloqueo. Destaca por gestionar el estado del crawl, el escalado y los reintentos de forma nativa.
Repositorio
apify/crawleeLenguaje
TypeScriptLo que construirías con esto
- Construir crawlers a gran escala con encolado automático y reintentos
- Rotar proxies y gestionar sesiones para evitar bloqueos
- Rastrear sitios con mucho JavaScript con navegadores headless gestionados
Etiquetas
crawlingscrapingproxy