Todo el código abierto
Código abiertoScraping17k

Crawlee

Librería de crawling para producción con colas, rotación de proxies y sesiones.

Crawlee es una librería de web scraping y automatización de navegadores desarrollada por Apify para construir crawlers fiables en Node.js/TypeScript y Python. Proporciona crawlers HTTP y de navegador headless unificados (Playwright, Puppeteer), encolado automático de peticiones, rotación de proxies y características anti-bloqueo. Destaca por gestionar el estado del crawl, el escalado y los reintentos de forma nativa.

Repositorio

apify/crawlee

Lenguaje

TypeScript

Lo que construirías con esto

  • Construir crawlers a gran escala con encolado automático y reintentos
  • Rotar proxies y gestionar sesiones para evitar bloqueos
  • Rastrear sitios con mucho JavaScript con navegadores headless gestionados

Etiquetas

crawlingscrapingproxy