manishw7 commited on
Commit
795670b
·
1 Parent(s): 4fe11e0

Fix: Upgrade PEFT and use explicit pixel_values for inference

Browse files
Files changed (2) hide show
  1. app.py +3 -3
  2. requirements.txt +1 -1
app.py CHANGED
@@ -35,10 +35,10 @@ def predict(image):
35
  image = image.convert("RGB")
36
  pixel_values = processor(image, return_tensors="pt").pixel_values.to(device)
37
 
38
- # --- ROBUST GENERATE CALL ---
39
- # Using inputs= as a keyword argument fixes the PeftModel positional argument error.
40
  with torch.no_grad():
41
- generated_ids = model.generate(inputs=pixel_values)
42
  generated_text = processor.batch_decode(generated_ids, skip_special_tokens=True)[0]
43
  return generated_text
44
  except Exception as e:
 
35
  image = image.convert("RGB")
36
  pixel_values = processor(image, return_tensors="pt").pixel_values.to(device)
37
 
38
+ # --- VISION-SPECIFIC GENERATE CALL ---
39
+ # Vision models like TrOCR require the 'pixel_values' keyword explicitly
40
  with torch.no_grad():
41
+ generated_ids = model.generate(pixel_values=pixel_values)
42
  generated_text = processor.batch_decode(generated_ids, skip_special_tokens=True)[0]
43
  return generated_text
44
  except Exception as e:
requirements.txt CHANGED
@@ -1,6 +1,6 @@
1
  torch
2
  transformers
3
- peft
4
  huggingface_hub==0.25.2
5
  pillow
6
  safetensors
 
1
  torch
2
  transformers
3
+ peft>=0.10.0
4
  huggingface_hub==0.25.2
5
  pillow
6
  safetensors