Todas las etiquetas
Etiqueta del catálogo

#crawlers

Todos los repositorios del registro público que llevan esta etiqueta, procedente de sus topics de GitHub o de las palabras clave que publican sus registros de paquetes. La salud se mide con la misma metodología versionada que el resto del registro.

3 registros
Con la etiqueta «crawlers»Ordenado por índice de salud
npm
98Excepcionalíndice de salud
apify/crawlee
Crawlee—A web scraping and browser automation library for Node.js to build reliable crawlers. In JavaScript and TypeScript. Extract data for AI, LLMs, RAG, or GPTs. Download HTML, PDF, JPG, PNG, and other files from websites. Works with Puppeteer, Playwright, Cheerio, JSDOM, and raw HTTP. Both headful and headless mode. With proxy rotation.
TypeScript · MDX★ 25.2K↓ 6M/mes5 ago 2026
Apache-2.05 ago 2026 · métricas 2.10.0
npm
83Excelenteíndice de salud
omrilotan/isbot
🤖/👨‍🦰 Detect bots/crawlers/spiders using the user agent string
TypeScript · JavaScript★ 1155↓ 102M/mes4 ago 2026
Unlicense4 ago 2026 · métricas 2.10.0
Maven
78Buenoíndice de salud
Norconex/crawler
Norconex Crawlers (or spiders) are flexible web and filesystem crawlers for collecting, parsing, and manipulating data from the web or filesystem to various data repositories such as search engines.
Java★ 2045 sept 2026
Apache-2.05 sept 2026 · métricas 2.10.0