ojas121 commited on
Commit
07c9a4a
·
verified ·
1 Parent(s): 3e76364

Update app.py

Browse files
Files changed (1) hide show
  1. app.py +7 -5
app.py CHANGED
@@ -3,12 +3,14 @@ from sentence_transformers import SentenceTransformer, util
3
  import PyPDF2
4
  import nltk
5
  from nltk.tokenize import sent_tokenize
6
- from pathlib import Path
7
 
8
- # Ensure NLTK resources are downloaded
9
- nltk_data_path = Path(nltk.data.find("tokenizers/punkt").path) if nltk.data.find("tokenizers/punkt") else None
10
- if not nltk_data_path:
11
- nltk.download("punkt", quiet=True)
 
 
12
 
13
  # Function to extract text from the uploaded PDF
14
  def extract_text_from_pdf(pdf_file):
 
3
  import PyPDF2
4
  import nltk
5
  from nltk.tokenize import sent_tokenize
6
+ import os
7
 
8
+ # Ensure NLTK 'punkt' resource is available
9
+ try:
10
+ nltk.data.find('tokenizers/punkt')
11
+ except LookupError:
12
+ nltk.download('punkt', quiet=True, download_dir=os.path.expanduser('~/nltk_data'))
13
+ nltk.data.path.append(os.path.expanduser('~/nltk_data'))
14
 
15
  # Function to extract text from the uploaded PDF
16
  def extract_text_from_pdf(pdf_file):