PEFT
Safetensors
Russian
russian
gpt
lora
causal-lm
FierceLLM commited on
Commit
8710d32
·
verified ·
1 Parent(s): d9b5305

Delete inference.py

Browse files
Files changed (1) hide show
  1. inference.py +0 -33
inference.py DELETED
@@ -1,33 +0,0 @@
1
- import torch
2
- from transformers import AutoTokenizer, AutoModelForCausalLM
3
- from peft import PeftModel
4
-
5
- # 1. Пути к моделям
6
- base_model_id = "sberbank-ai/rugpt3small_based_on_gpt2"
7
- # Укажите путь к папке, которую вы скачали из Colab (например, checkpoint-1860)
8
- adapter_path = "."
9
-
10
- # 2. Загрузка токенизатора и базовой модели
11
- tokenizer = AutoTokenizer.from_pretrained(base_model_id)
12
- model = AutoModelForCausalLM.from_pretrained(base_model_id, torch_dtype=torch.float16, device_map="auto")
13
-
14
- # 3. Подгрузка LoRA адаптера
15
- model = PeftModel.from_pretrained(model, adapter_path)
16
- model.eval()
17
-
18
- def generate(text):
19
- prompt = f"Пользователь: {text}\nПомощник:"
20
- inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
21
-
22
- with torch.no_grad():
23
- outputs = model.generate(
24
- **inputs,
25
- max_new_tokens=150,
26
- do_sample=True,
27
- top_p=0.9,
28
- repetition_penalty=1.2
29
- )
30
- return tokenizer.decode(outputs[0], skip_special_tokens=True).split("Помощник:")[-1].strip()
31
-
32
- # Тест
33
- print(generate(input('Prompt: ')))