Spaces:
Sleeping
Sleeping
陈浩然 commited on
Commit ·
f332663
1
Parent(s): 190df6d
参数调优:降低采样温度至 0.72(收紧 top_p=0.88,微调 repetition_penalty=1.18),提升文本连贯度与逻辑严谨性,消除离群采样
Browse files
app.py
CHANGED
|
@@ -206,15 +206,15 @@ def background_generation_loop():
|
|
| 206 |
model.to(device)
|
| 207 |
inputs = tokenizer(prompt, return_tensors="pt").to(device)
|
| 208 |
|
| 209 |
-
add_server_log("SmolLM2-360M CPU 自回归推理中 (max_new_tokens=200)...")
|
| 210 |
with torch.no_grad():
|
| 211 |
output_ids = model.generate(
|
| 212 |
**inputs,
|
| 213 |
max_new_tokens=200,
|
| 214 |
do_sample=True,
|
| 215 |
-
temperature=
|
| 216 |
-
top_p=0.
|
| 217 |
-
repetition_penalty=1.
|
| 218 |
bad_words_ids=BAD_WORDS_IDS,
|
| 219 |
pad_token_id=tokenizer.eos_token_id
|
| 220 |
)
|
|
|
|
| 206 |
model.to(device)
|
| 207 |
inputs = tokenizer(prompt, return_tensors="pt").to(device)
|
| 208 |
|
| 209 |
+
add_server_log("SmolLM2-360M CPU 自回归推理中 (max_new_tokens=200, temp=0.72)...")
|
| 210 |
with torch.no_grad():
|
| 211 |
output_ids = model.generate(
|
| 212 |
**inputs,
|
| 213 |
max_new_tokens=200,
|
| 214 |
do_sample=True,
|
| 215 |
+
temperature=0.72,
|
| 216 |
+
top_p=0.88,
|
| 217 |
+
repetition_penalty=1.18,
|
| 218 |
bad_words_ids=BAD_WORDS_IDS,
|
| 219 |
pad_token_id=tokenizer.eos_token_id
|
| 220 |
)
|