Open SourceScraping65k
Scrapling
Scraper Python adaptatif avec des sélecteurs auto-réparants et un MCP intégré.
Scrapling est une bibliothèque Python de web scraping axée sur le parsing adaptatif et haute performance, capable de relocaliser des éléments lorsque la structure d'un site change. Elle offre un parsing HTML rapide, un suivi d'éléments basé sur la similarité et des options de récupération furtive pour gérer les pages dynamiques protégées contre les bots. Elle se distingue par ses sélecteurs auto-réparants qui réduisent les pannes de scraper dans le temps.
Dépôt
D4Vinci/ScraplingLangage
PythonCe que vous pourriez construire avec
- Scraper des sites dont la structure HTML change fréquemment sans réécrire les sélecteurs
- Récupérer des pages utilisant une protection anti-bot avec des options furtives
- Alimenter du contenu web extrait dans des pipelines LLM ou RAG
Tags
scrapingstealthmcp