Усі теги
Тег каталогу

#table-extraction

Усі репозиторії публічного реєстру з цим тегом — із тем GitHub або ключових слів, які публікують їхні реєстри пакетів. Здоров'я вимірюється за тією ж версіонованою методологією, що й решта реєстру.

4 записи
З тегом «table-extraction»Упорядковано за індексом здоров'я
PyPI
76Добрийіндекс здоров'я
pymupdf/pymupdf
PyMuPDF is a high performance Python library for data extraction, analysis, conversion & manipulation of PDF (and other) documents.
Python · SWIG★ 10.2K17 лип. 2026 р.
AGPL-3.017 лип. 2026 р. · метрики 1.13.0
Packagist · crates.io · npm +1
73Добрийіндекс здоров'я
xberg-io/xberg
A polyglot document intelligence framework with a Rust core. Extract text, metadata, images, and structured information from PDFs, Office documents, images, and 97+ formats. Available for Rust, Python, Ruby, Java, Go, PHP, Elixir, C#, R, C, TypeScript (Node/Bun/Wasm/Deno)- or use via CLI, REST API, or MCP server.
Rust★ 8 675↓ 40/міс20 лип. 2026 р.
MIT20 лип. 2026 р. · метрики 1.13.0
crates.io
69Помірнийіндекс здоров'я
bzsanti/oxidizePdf
Pure Rust PDF library for AI/RAG: structure-aware chunking, no ML, no C deps.
Rust★ 182↓ 6 045/міс13 лип. 2026 р.
MIT13 лип. 2026 р. · метрики 1.13.0
PyPI
63Помірнийіндекс здоров'я
jsvine/pdfplumber
Plumb a PDF for detailed information about each char, rectangle, line, et cetera — and easily extract text and tables.
Python★ 10.6K17 лип. 2026 р.
MIT17 лип. 2026 р. · метрики 1.13.0