Open SourceScraping22k
GPT Crawler
Crawl et nettsted og produser en kunnskapsfil for en tilpasset GPT.
GPT Crawler er et Node.js-verktøy som crawler et nettsted fra en start-URL og samler det uttrakte innholdet til én enkelt kunnskapsfil klar til å drive en tilpasset GPT eller assistent. Det bruker Playwright under panseret med konfigurerbare selektorer, matchmønstre og sidegrenser. Det er kjent for å forenkle veien fra offentlig dokumentasjon til en fungerende RAG-klar kunnskapsbase.
Repository
BuilderIO/gpt-crawlerLinguaggio
TypeScriptCosa ci costruiresti
- Bygge en tilpasset GPT eller assistent forankret i et produkts dokumentasjonsside
- Generere en samlet kunnskapsfil for RAG-innlasting
- Scrape dokumentasjon til rene tekstfragmenter for embeddings
Tag
crawlingragknowledge-basellm