jaydatech commited on
Commit
c47d2c7
·
verified ·
1 Parent(s): 3f72004

Update app.py

Browse files
Files changed (1) hide show
  1. app.py +10 -13
app.py CHANGED
@@ -36,25 +36,22 @@ device = "cuda" if torch.cuda.is_available() else "cpu"
36
  #tokenizer = LlamaTokenizer.from_pretrained(REPO_NAME, use_auth_token=HF_TOKEN)
37
 
38
  #tokenizer = AutoTokenizer.from_pretrained("microsoft/Phi-3-mini-4k-instruct")
39
- tokenizer = AutoTokenizer.from_pretrained(
40
- "microsoft/Phi-3-mini-4k-instruct",
41
- trust_remote_code=True,
42
- use_auth_token=HF_TOKEN
43
- )
 
 
 
44
 
45
  model = AutoModelForCausalLM.from_pretrained(
46
  REPO_NAME,
 
47
  use_auth_token=HF_TOKEN,
48
  torch_dtype=torch.float16 if torch.cuda.is_available() else torch.float32,
49
- device_map="auto",
50
- trust_remote_code=True
51
  )
52
- # model = AutoModelForCausalLM.from_pretrained(
53
- # REPO_NAME,
54
- # use_auth_token=HF_TOKEN,
55
- # torch_dtype=torch.float16 if torch.cuda.is_available() else torch.float32,
56
- # device_map="auto"
57
- # )
58
 
59
  # Message and request models
60
  class ChatMessage(BaseModel):
 
36
  #tokenizer = LlamaTokenizer.from_pretrained(REPO_NAME, use_auth_token=HF_TOKEN)
37
 
38
  #tokenizer = AutoTokenizer.from_pretrained("microsoft/Phi-3-mini-4k-instruct")
39
+ # tokenizer = AutoTokenizer.from_pretrained(
40
+ # "microsoft/Phi-3-mini-4k-instruct",
41
+ # trust_remote_code=True,
42
+ # use_auth_token=HF_TOKEN
43
+ # )
44
+
45
+ config = AutoConfig.from_pretrained(REPO_NAME, use_auth_token=HF_TOKEN)
46
+ tokenizer = AutoTokenizer.from_pretrained(REPO_NAME, use_auth_token=HF_TOKEN)
47
 
48
  model = AutoModelForCausalLM.from_pretrained(
49
  REPO_NAME,
50
+ config = config,
51
  use_auth_token=HF_TOKEN,
52
  torch_dtype=torch.float16 if torch.cuda.is_available() else torch.float32,
53
+ device_map="auto"
 
54
  )
 
 
 
 
 
 
55
 
56
  # Message and request models
57
  class ChatMessage(BaseModel):