Spaces:
Running on Zero
Running on Zero
Update app.py
Browse files
app.py
CHANGED
|
@@ -102,13 +102,13 @@ def load_new_model(model_id):
|
|
| 102 |
|
| 103 |
def run_inference(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample, gpu):
|
| 104 |
if gpu:
|
| 105 |
-
|
| 106 |
-
|
| 107 |
|
| 108 |
|
| 109 |
@spaces.GPU
|
| 110 |
def run_inference_gpu(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample):
|
| 111 |
-
|
| 112 |
|
| 113 |
def run_inference_raw(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample):
|
| 114 |
"""Generates text via streaming generator."""
|
|
@@ -226,7 +226,7 @@ with gr.Blocks(title="Small MF Model Tester", theme=gr.themes.Soft()) as app:
|
|
| 226 |
with gr.Row():
|
| 227 |
model_id_input = gr.Dropdown(choices=MODELS, label="Model", allow_custom_value=True, show_label=False, scale=3)
|
| 228 |
load_btn = gr.Button("Load", variant="secondary", scale=1)
|
| 229 |
-
use_gpu = gr.Checkbox("Use GPU?")
|
| 230 |
clean_btn = gr.Button("Clean HF Cache", variant="stop", size="sm")
|
| 231 |
|
| 232 |
with gr.Accordion("Generation Configuration", open=False):
|
|
|
|
| 102 |
|
| 103 |
def run_inference(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample, gpu):
|
| 104 |
if gpu:
|
| 105 |
+
yield from run_inference_gpu(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample)
|
| 106 |
+
yield from run_inference_raw(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample)
|
| 107 |
|
| 108 |
|
| 109 |
@spaces.GPU
|
| 110 |
def run_inference_gpu(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample):
|
| 111 |
+
yield from run_inference_raw(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample)
|
| 112 |
|
| 113 |
def run_inference_raw(user_prompt, max_tokens, temperature, top_k, top_p, rep_penalty, ngram_size, do_sample):
|
| 114 |
"""Generates text via streaming generator."""
|
|
|
|
| 226 |
with gr.Row():
|
| 227 |
model_id_input = gr.Dropdown(choices=MODELS, label="Model", allow_custom_value=True, show_label=False, scale=3)
|
| 228 |
load_btn = gr.Button("Load", variant="secondary", scale=1)
|
| 229 |
+
use_gpu = gr.Checkbox(label="Use GPU?", value=False)
|
| 230 |
clean_btn = gr.Button("Clean HF Cache", variant="stop", size="sm")
|
| 231 |
|
| 232 |
with gr.Accordion("Generation Configuration", open=False):
|