Metadata-Version: 2.1
Name: pdf2textlib
Version: 1.0.4
Summary: A package to extract text from PDF
Home-page: https://github.com/FSOCIETY06/pdf2textlib
Author: Vedant Khairnar
Author-email: vedron007@gmail.com
License: UNKNOWN
Platform: UNKNOWN
Classifier: Programming Language :: Python :: 3
Classifier: License :: OSI Approved :: MIT License
Classifier: Operating System :: OS Independent
Requires-Python: >=3.5
Description-Content-Type: text/markdown

# pdf2textlib

## pip install pdf2textlib


[![PyPI Status](https://img.shields.io/pypi/v/pdf2textlib.svg)](https://pypi.org/project/pdf2textlib/)
[![Downloads](https://img.shields.io/pypi/dm/pdf2textlib.svg)](https://pypistats.org/packages/pdf2textlib)


Simple Multilingual PDF text extraction, Also extracts from images

```python
import pdf2textlib

print(pdf2textlib.getText("Demo.pdf","eng+tel+urd"))  
# parameter 1 : Path to the PDF file
# parameter 2 : string of language codes separated by '+' sign

```


## OS Dependencies

### Debian, Ubuntu, and friends

```
sudo apt-get install build-essential libpoppler-cpp-dev pkg-config python-dev
```

### Fedora, Red Hat, and friends

```
sudo yum install gcc-c++ pkgconfig poppler-cpp-devel python-devel redhat-rpm-config
```

### macOS

```
brew install pkg-config poppler
```

Conda users may also need `libgcc`:

```
conda install -c anaconda libgcc
```

### Windows

Currently tested only when using conda:

 - Install the Microsoft Visual C++ Build Tools
 - Install poppler through conda:
   ```
   conda install -c conda-forge poppler
   ```


## Install

```
pip install pdf2textlib
```


