anirudh248 commited on
Commit
f5a37d9
·
verified ·
1 Parent(s): cda579b

Update app.py

Browse files
Files changed (1) hide show
  1. app.py +2 -3
app.py CHANGED
@@ -22,7 +22,7 @@ vectorstore = FAISS.load_local(
22
  retriever = vectorstore.as_retriever()
23
 
24
  # ==========================================
25
- # 2. Load Model & Tokenizer in 16-bit (ZeroGPU Fix)
26
  # ==========================================
27
  print("Loading Model...")
28
  model_id = "anirudh248/llama3-upf-generator"
@@ -31,8 +31,7 @@ tokenizer = AutoTokenizer.from_pretrained(model_id)
31
 
32
  model = AutoModelForCausalLM.from_pretrained(
33
  model_id,
34
- torch_dtype=torch.bfloat16,
35
- device_map="auto"
36
  )
37
  model.generation_config.pad_token_id = tokenizer.eos_token_id
38
 
 
22
  retriever = vectorstore.as_retriever()
23
 
24
  # ==========================================
25
+ # 2. Load Model & Tokenizer in 16-bit
26
  # ==========================================
27
  print("Loading Model...")
28
  model_id = "anirudh248/llama3-upf-generator"
 
31
 
32
  model = AutoModelForCausalLM.from_pretrained(
33
  model_id,
34
+ torch_dtype=torch.bfloat16
 
35
  )
36
  model.generation_config.pad_token_id = tokenizer.eos_token_id
37