Monimoy commited on
Commit
c33e33b
·
verified ·
1 Parent(s): 47efcd7

Upload app.py

Browse files
Files changed (1) hide show
  1. app.py +13 -9
app.py CHANGED
@@ -3,7 +3,7 @@ import os
3
  import gradio as gr
4
  import torch
5
  from PIL import Image
6
- from transformers import AutoTokenizer
7
  import timm
8
  from torchvision import transforms
9
  from llama_cpp import Llama
@@ -62,17 +62,21 @@ image_encoder.eval() # Set to evaluation mode
62
  #)
63
 
64
 
65
- base_model = Llama.from_pretrained(
66
- repo_id="QuantFactory/Phi-3-mini-4k-instruct-GGUF",
67
- #filename="Phi-3-mini-4k-instruct.Q2_K.gguf",
68
- filename="Phi-3-mini-4k-instruct.Q4_K_M.gguf",
69
- n_gpu_layers=0,
70
- n_ctx=2048,
71
- verbose=True
72
- )
 
 
73
 
 
74
 
75
 
 
76
  model = PeftModel.from_pretrained(base_model, peft_model_path, offload_dir='./offload')
77
  model = model.merge_and_unload()
78
  print("phi-3 model loaded sucessfully")
 
3
  import gradio as gr
4
  import torch
5
  from PIL import Image
6
+ from transformers import AutoTokenizer, AutoModelForCausalLM
7
  import timm
8
  from torchvision import transforms
9
  from llama_cpp import Llama
 
62
  #)
63
 
64
 
65
+ #base_model = Llama.from_pretrained(
66
+ # repo_id="QuantFactory/Phi-3-mini-4k-instruct-GGUF",
67
+ # filename="Phi-3-mini-4k-instruct.Q2_K.gguf",
68
+ # n_gpu_layers=0,
69
+ # n_ctx=2048,
70
+ # verbose=True
71
+ #)
72
+
73
+ base_model_name="microsoft/Phi-3-mini-4k-instruct"
74
+ device = "cpu"
75
 
76
+ base_model = AutoModelForCausalLM.from_pretrained(base_model_name, torch_dtype=torch.float32, device_map={"": device})
77
 
78
 
79
+ # Load and merge
80
  model = PeftModel.from_pretrained(base_model, peft_model_path, offload_dir='./offload')
81
  model = model.merge_and_unload()
82
  print("phi-3 model loaded sucessfully")