imravi commited on
Commit
7b0d01d
·
verified ·
1 Parent(s): 5d63abc

Update main.py

Browse files
Files changed (1) hide show
  1. main.py +15 -6
main.py CHANGED
@@ -19,26 +19,35 @@ class PlantChatbot:
19
  def __init__(self, preprocessed_data_path: str):
20
  self.device = "cuda" if torch.cuda.is_available() else "cpu"
21
 
 
22
  self.embedding_model = SentenceTransformer(
23
- model_name_or_path="all-mpnet-base-v2",
24
  device=self.device
25
  )
26
 
 
27
  self.load_data(preprocessed_data_path)
28
 
 
29
  self.tokenizer = AutoTokenizer.from_pretrained(
30
- "Qwen/Qwen2.5-0.5B-Instruct",
31
- trust_remote_code=True
 
32
  )
 
 
33
  self.model = AutoModelForCausalLM.from_pretrained(
34
- "Qwen/Qwen2.5-0.5B-Instruct",
35
- device_map="auto",
36
  trust_remote_code=True,
37
- torch_dtype=torch.float16
 
38
  )
39
 
40
  if self.tokenizer.pad_token is None:
41
  self.tokenizer.pad_token = self.tokenizer.eos_token
 
 
42
 
43
  def load_data(self, preprocessed_data_path: str):
44
  df = pd.read_csv(preprocessed_data_path)
 
19
  def __init__(self, preprocessed_data_path: str):
20
  self.device = "cuda" if torch.cuda.is_available() else "cpu"
21
 
22
+ print("Loading sentence transformer model...")
23
  self.embedding_model = SentenceTransformer(
24
+ model_name_or_path="/app/models/sentence_transformer",
25
  device=self.device
26
  )
27
 
28
+ print("Loading data...")
29
  self.load_data(preprocessed_data_path)
30
 
31
+ print("Loading Qwen tokenizer...")
32
  self.tokenizer = AutoTokenizer.from_pretrained(
33
+ "/app/models/qwen",
34
+ trust_remote_code=True,
35
+ local_files_only=True
36
  )
37
+
38
+ print("Loading Qwen model...")
39
  self.model = AutoModelForCausalLM.from_pretrained(
40
+ "/app/models/qwen",
41
+ device_map="auto" if torch.cuda.is_available() else None,
42
  trust_remote_code=True,
43
+ torch_dtype=torch.float16 if torch.cuda.is_available() else torch.float32,
44
+ local_files_only=True
45
  )
46
 
47
  if self.tokenizer.pad_token is None:
48
  self.tokenizer.pad_token = self.tokenizer.eos_token
49
+
50
+ print("Initialization complete!")
51
 
52
  def load_data(self, preprocessed_data_path: str):
53
  df = pd.read_csv(preprocessed_data_path)