Spaces:
Sleeping
Sleeping
Upload app.py
Browse files
app.py
CHANGED
|
@@ -257,14 +257,14 @@ def generate_stream(model, tokenizer, prompt, steps=128, max_new_tokens=128, blo
|
|
| 257 |
|
| 258 |
total_step += 1
|
| 259 |
|
| 260 |
-
|
| 261 |
-
|
|
|
|
|
|
|
|
|
|
|
|
|
| 262 |
if finished.all():
|
| 263 |
break
|
| 264 |
-
generated += cur_len
|
| 265 |
-
|
| 266 |
-
if finished.all():
|
| 267 |
-
break
|
| 268 |
|
| 269 |
new_tokens = x[0, prompt_len:prompt_len + max_new_tokens].tolist()
|
| 270 |
final_text = tokenizer.decode(new_tokens, skip_special_tokens=True)
|
|
|
|
| 257 |
|
| 258 |
total_step += 1
|
| 259 |
|
| 260 |
+
if tokenizer.eos_token_id is not None:
|
| 261 |
+
finished |= (x_blk_new == tokenizer.eos_token_id).any(dim=1)
|
| 262 |
+
if finished.all():
|
| 263 |
+
break
|
| 264 |
+
generated += cur_len
|
| 265 |
+
|
| 266 |
if finished.all():
|
| 267 |
break
|
|
|
|
|
|
|
|
|
|
|
|
|
| 268 |
|
| 269 |
new_tokens = x[0, prompt_len:prompt_len + max_new_tokens].tolist()
|
| 270 |
final_text = tokenizer.decode(new_tokens, skip_special_tokens=True)
|