Tbain20 commited on
Commit
1da8db7
·
1 Parent(s): 31b43d2

Add accelerate, remove device_map for CPU inference

Browse files
Files changed (2) hide show
  1. app.py +2 -2
  2. requirements.txt +1 -0
app.py CHANGED
@@ -15,8 +15,8 @@ tokenizer = AutoTokenizer.from_pretrained("allenai/OLMo-2-1124-7B")
15
  print("Loading model from HuggingFace...")
16
  model = AutoModelForCausalLM.from_pretrained(
17
  REPO_ID,
18
- torch_dtype=torch.float32,
19
- device_map="cpu",
20
  )
21
  model.eval()
22
  print("Model ready")
 
15
  print("Loading model from HuggingFace...")
16
  model = AutoModelForCausalLM.from_pretrained(
17
  REPO_ID,
18
+
19
+
20
  )
21
  model.eval()
22
  print("Model ready")
requirements.txt CHANGED
@@ -2,3 +2,4 @@ torch
2
  transformers>=4.45.0
3
  huggingface_hub
4
  numpy
 
 
2
  transformers>=4.45.0
3
  huggingface_hub
4
  numpy
5
+ accelerate