Extract text and data from PDF files programmatically.
PDF parser and analyzer
pdf2txt.pydumppdf.pypdf2json.py$ pdf2txt.py document.pdf$ pdf2txt.py -o output.txt document.pdf$ pdf2txt.py -t xml document.pdf$ dumppdf.py document.pdf$ pdf2json.py document.pdf