Kymata Labs/The Living IndexesBuilt by tekvisions ↗
The Document Index / PDF Extraction / #44
ispras

ispras/dedoc

by ispras · PDF Extraction · updated 1d ago

Dedoc is a library (service) for automate documents parsing and bringing to a uniform format. It automatically extracts content, logical structure, tables, and meta information from textual electronic documents. (Parse document; Document content extraction; Logical structure extraction; PDF parser; Scanned document parser; DOCX parser; HTML parser

64
momentum
734
stars
64
forks
#44
rank
docdocument-analysisdocument-content-extractiondocumentsdocxdocx-parserexcelhtmlhtml-parserlogical-structure-extractionocrodt
View on GitHub →