ddfws commited on
Commit
3148133
·
verified ·
1 Parent(s): bff6cc9

Update app.py

Browse files
Files changed (1) hide show
  1. app.py +21 -10
app.py CHANGED
@@ -1,5 +1,7 @@
1
  import gradio as gr
 
2
  import torch
 
3
  from transformers import AutoTokenizer, AutoModelForCausalLM
4
 
5
 
@@ -26,49 +28,58 @@ model.eval()
26
  print("MODEL READY")
27
 
28
 
29
- def chat(message, history):
 
30
 
31
  prompt = ""
32
 
33
  for user, assistant in history:
34
  prompt += f"User: {user}\nAssistant: {assistant}\n"
35
 
 
36
  prompt += f"User: {message}\nAssistant:"
37
 
38
 
39
  inputs = tokenizer(
40
  prompt,
41
  return_tensors="pt"
42
- ).to(model.device)
 
 
 
 
 
 
43
 
44
 
45
  with torch.no_grad():
46
 
47
- result = model.generate(
48
  **inputs,
49
  max_new_tokens=256,
50
  temperature=0.7,
 
51
  do_sample=True
52
  )
53
 
54
 
55
- text = tokenizer.decode(
56
- result[0],
57
  skip_special_tokens=True
58
  )
59
 
60
 
61
- return text.split("Assistant:")[-1]
62
 
63
 
64
 
65
  demo = gr.ChatInterface(
66
- fn=chat,
67
- title="Rezaeian StatsAI"
 
68
  )
69
 
70
 
71
  demo.launch(
72
- server_name="0.0.0.0",
73
- server_port=7860
74
  )
 
1
  import gradio as gr
2
+ import spaces
3
  import torch
4
+
5
  from transformers import AutoTokenizer, AutoModelForCausalLM
6
 
7
 
 
28
  print("MODEL READY")
29
 
30
 
31
+ @spaces.GPU
32
+ def generate(message, history):
33
 
34
  prompt = ""
35
 
36
  for user, assistant in history:
37
  prompt += f"User: {user}\nAssistant: {assistant}\n"
38
 
39
+
40
  prompt += f"User: {message}\nAssistant:"
41
 
42
 
43
  inputs = tokenizer(
44
  prompt,
45
  return_tensors="pt"
46
+ )
47
+
48
+
49
+ inputs = {
50
+ k: v.to(model.device)
51
+ for k, v in inputs.items()
52
+ }
53
 
54
 
55
  with torch.no_grad():
56
 
57
+ output = model.generate(
58
  **inputs,
59
  max_new_tokens=256,
60
  temperature=0.7,
61
+ top_p=0.9,
62
  do_sample=True
63
  )
64
 
65
 
66
+ result = tokenizer.decode(
67
+ output[0],
68
  skip_special_tokens=True
69
  )
70
 
71
 
72
+ return result.split("Assistant:")[-1]
73
 
74
 
75
 
76
  demo = gr.ChatInterface(
77
+ fn=generate,
78
+ title="Rezaeian StatsAI",
79
+ description="ZeroGPU AI Assistant"
80
  )
81
 
82
 
83
  demo.launch(
84
+ server_name="0.0.0.0"
 
85
  )