Raise max new tokens slider to 7072
Browse files
app.py
CHANGED
|
@@ -20,6 +20,7 @@ MODELS = {
|
|
| 20 |
}
|
| 21 |
|
| 22 |
HF_TOKEN = os.environ.get("HF_TOKEN")
|
|
|
|
| 23 |
|
| 24 |
tokenizers: dict[str, AutoTokenizer] = {}
|
| 25 |
models: dict[str, AutoModelForCausalLM] = {}
|
|
@@ -138,7 +139,7 @@ with gr.Blocks(title="Tiny Aya Compare") as demo:
|
|
| 138 |
|
| 139 |
with gr.Row():
|
| 140 |
max_new_tokens = gr.Slider(
|
| 141 |
-
16,
|
| 142 |
)
|
| 143 |
temperature = gr.Slider(0, 1.5, value=0.7, step=0.05, label="Temperature")
|
| 144 |
top_p = gr.Slider(0.1, 1.0, value=0.9, step=0.05, label="Top-p")
|
|
|
|
| 20 |
}
|
| 21 |
|
| 22 |
HF_TOKEN = os.environ.get("HF_TOKEN")
|
| 23 |
+
MAX_NEW_TOKENS = 8096 - 1024 # leave room for the prompt in ~8k context
|
| 24 |
|
| 25 |
tokenizers: dict[str, AutoTokenizer] = {}
|
| 26 |
models: dict[str, AutoModelForCausalLM] = {}
|
|
|
|
| 139 |
|
| 140 |
with gr.Row():
|
| 141 |
max_new_tokens = gr.Slider(
|
| 142 |
+
16, MAX_NEW_TOKENS, value=256, step=16, label="Max new tokens"
|
| 143 |
)
|
| 144 |
temperature = gr.Slider(0, 1.5, value=0.7, step=0.05, label="Temperature")
|
| 145 |
top_p = gr.Slider(0.1, 1.0, value=0.9, step=0.05, label="Top-p")
|