Todas las etiquetas
Etiqueta del catálogo

#pdf-parsing

Todos los repositorios del registro público que llevan esta etiqueta, procedente de sus topics de GitHub o de las palabras clave que publican sus registros de paquetes. La salud se mide con la misma metodología versionada que el resto del registro.

5 registros
Con la etiqueta «pdf-parsing»Ordenado por índice de salud
PyPI
98Excepcionalíndice de salud
py-pdf/pypdf
A pure-python PDF library capable of splitting, merging, cropping, and transforming the pages of PDF files
Python★ 10.2K28 ago 2026
Licencia propia28 ago 2026 · métricas 2.10.0
npm · Maven · PyPI
95Excepcionalíndice de salud
opendataloader-project/opendataloader-pdf
PDF Parser for AI-ready data. Automate PDF accessibility. Open-source.
Java · Python★ 28.2K↓ 54.5K/mes5 ago 2026
Apache-2.05 ago 2026 · métricas 2.10.0
crates.io · PyPI · npm +5
93Excepcionalíndice de salud
yfedoseev/pdf_oxide
The fastest PDF library for Python and Rust. Text extraction, image extraction, markdown conversion, PDF creation & editing. 0.8ms mean, 5× faster than industry leaders, 100% pass rate on 3,830 PDFs. MIT/Apache-2.0.
Rust★ 1015↓ 391.7K/mes5 sept 2026
Apache-2.05 sept 2026 · métricas 2.10.0
npm
80Excelenteíndice de salud
LibPDF-js/core
A modern PDF library for TypeScript. Parse, modify, and generate PDFs with a clean, intuitive API.
TypeScript★ 1771↓ 352.6K/mes28 jul 2026
MIT28 jul 2026 · métricas 2.10.0
PyPI
77Buenoíndice de salud
jsvine/pdfplumber
Plumb a PDF for detailed information about each char, rectangle, line, et cetera — and easily extract text and tables.
Python★ 10.7K28 ago 2026
MIT28 ago 2026 · métricas 2.10.0