text_demo / document_processing.py
Ahmed12322's picture
Update document_processing.py
64295e3 verified
Raw
History Blame Contribute Delete
184 Bytes
import pdfplumber
def extract_text_from_pdf(pdf_path):
with pdfplumber.open(pdf_path) as pdf:
text = "\n".join([page.extract_text() for page in pdf.pages])
return text