Emalawi19 commited on
Commit
49ea7d7
·
verified ·
1 Parent(s): 3fb2d87

Create app.py

Browse files
Files changed (1) hide show
  1. app.py +43 -0
app.py ADDED
@@ -0,0 +1,43 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ from transformers import AutoTokenizer, AutoModelForCausalLM
2
+ import torch
3
+
4
+ model_name = "deepseek-ai/DeepSeek-R1-Distill-Qwen-7B"
5
+
6
+ print("Loading model... (this may take time)")
7
+
8
+ tokenizer = AutoTokenizer.from_pretrained(model_name)
9
+ model = AutoModelForCausalLM.from_pretrained(
10
+ model_name,
11
+ torch_dtype=torch.float16,
12
+ device_map="auto"
13
+ )
14
+
15
+ print("Model loaded! Start chatting.\n")
16
+
17
+ chat_history = ""
18
+
19
+ while True:
20
+ user_input = input("You: ")
21
+
22
+ if user_input.lower() in ["exit", "quit"]:
23
+ break
24
+
25
+ chat_history += f"User: {user_input}\nAssistant:"
26
+
27
+ inputs = tokenizer(chat_history, return_tensors="pt").to(model.device)
28
+
29
+ outputs = model.generate(
30
+ **inputs,
31
+ max_new_tokens=200,
32
+ temperature=0.7,
33
+ do_sample=True
34
+ )
35
+
36
+ response = tokenizer.decode(outputs[0], skip_special_tokens=True)
37
+
38
+ # Extract only latest response
39
+ response = response.split("Assistant:")[-1].strip()
40
+
41
+ print(f"AI: {response}\n")
42
+
43
+ chat_history += f" {response}\n"