stanley-00 commited on
Commit
5a22264
·
verified ·
1 Parent(s): 42a9d41

Update app.py

Browse files
Files changed (1) hide show
  1. app.py +4 -4
app.py CHANGED
@@ -102,13 +102,13 @@ def load_new_model(model_id):
102
 
103
  def run_inference(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample, gpu):
104
  if gpu:
105
- return run_inference_gpu(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample)
106
- return run_inference_raw(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample)
107
 
108
 
109
  @spaces.GPU
110
  def run_inference_gpu(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample):
111
- return run_inference_raw(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample)
112
 
113
  def run_inference_raw(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample):
114
  """Generates text via streaming generator."""
@@ -226,7 +226,7 @@ with gr.Blocks(title="Small MF Model Tester", theme=gr.themes.Soft()) as app:
226
  with gr.Row():
227
  model_id_input = gr.Dropdown(choices=MODELS, label="Model", allow_custom_value=True, show_label=False, scale=3)
228
  load_btn = gr.Button("Load", variant="secondary", scale=1)
229
- use_gpu = gr.Checkbox("Use GPU?")
230
  clean_btn = gr.Button("Clean HF Cache", variant="stop", size="sm")
231
 
232
  with gr.Accordion("Generation Configuration", open=False):
 
102
 
103
  def run_inference(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample, gpu):
104
  if gpu:
105
+ yield from run_inference_gpu(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample)
106
+ yield from run_inference_raw(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample)
107
 
108
 
109
  @spaces.GPU
110
  def run_inference_gpu(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample):
111
+ yield from run_inference_raw(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample)
112
 
113
  def run_inference_raw(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample):
114
  """Generates text via streaming generator."""
 
226
  with gr.Row():
227
  model_id_input = gr.Dropdown(choices=MODELS, label="Model", allow_custom_value=True, show_label=False, scale=3)
228
  load_btn = gr.Button("Load", variant="secondary", scale=1)
229
+ use_gpu = gr.Checkbox(label="Use GPU?", value=False)
230
  clean_btn = gr.Button("Clean HF Cache", variant="stop", size="sm")
231
 
232
  with gr.Accordion("Generation Configuration", open=False):