Усі теги
Тег каталогу

#pdf-extractor-rag

Усі репозиторії публічного реєстру з цим тегом — із тем GitHub або ключових слів, які публікують їхні реєстри пакетів. Здоров'я вимірюється за тією ж версіонованою методологією, що й решта реєстру.

2 записи
З тегом «pdf-extractor-rag»Упорядковано за індексом здоров'я
npm · PyPI
82Добрийіндекс здоров'я
PaddlePaddle/PaddleOCR
Turn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100+ languages.
Python★ 85.3K↓ 2.6M/міс13 лип. 2026 р.
Apache-2.013 лип. 2026 р. · метрики 1.13.0
PyPI
75Добрийіндекс здоров'я
opendatalab/MinerU
Transforms complex documents like PDFs and Office docs into LLM-ready markdown/JSON for your Agentic workflows.
Python★ 74.4K↓ 344K/міс13 лип. 2026 р.
Власна ліцензія13 лип. 2026 р. · метрики 1.13.0