Усі теги
Тег каталогу

#pdf-extractor-rag

Усі репозиторії публічного реєстру з цим тегом — із тем GitHub або ключових слів, які публікують їхні реєстри пакетів. Здоров'я вимірюється за тією ж версіонованою методологією, що й решта реєстру.

2 записи
З тегом «pdf-extractor-rag»Упорядковано за індексом здоров'я
PyPI · npm
96Винятковийіндекс здоров'я
PaddlePaddle/PaddleOCR
Turn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100+ languages.
Python · C++★ 87K4 серп. 2026 р.
Apache-2.04 серп. 2026 р. · метрики 2.10.0
PyPI
89Відміннийіндекс здоров'я
opendatalab/MinerU
Transforms complex documents like PDFs and Office docs into LLM-ready markdown/JSON for your Agentic workflows.
Python★ 76.8K↓ 313.3K/міс4 серп. 2026 р.
Власна ліцензія4 серп. 2026 р. · метрики 2.10.0