陈浩然 commited on
Commit
f332663
·
1 Parent(s): 190df6d

参数调优:降低采样温度至 0.72(收紧 top_p=0.88,微调 repetition_penalty=1.18),提升文本连贯度与逻辑严谨性,消除离群采样

Browse files
Files changed (1) hide show
  1. app.py +4 -4
app.py CHANGED
@@ -206,15 +206,15 @@ def background_generation_loop():
206
  model.to(device)
207
  inputs = tokenizer(prompt, return_tensors="pt").to(device)
208
 
209
- add_server_log("SmolLM2-360M CPU 自回归推理中 (max_new_tokens=200)...")
210
  with torch.no_grad():
211
  output_ids = model.generate(
212
  **inputs,
213
  max_new_tokens=200,
214
  do_sample=True,
215
- temperature=1.02,
216
- top_p=0.92,
217
- repetition_penalty=1.15,
218
  bad_words_ids=BAD_WORDS_IDS,
219
  pad_token_id=tokenizer.eos_token_id
220
  )
 
206
  model.to(device)
207
  inputs = tokenizer(prompt, return_tensors="pt").to(device)
208
 
209
+ add_server_log("SmolLM2-360M CPU 自回归推理中 (max_new_tokens=200, temp=0.72)...")
210
  with torch.no_grad():
211
  output_ids = model.generate(
212
  **inputs,
213
  max_new_tokens=200,
214
  do_sample=True,
215
+ temperature=0.72,
216
+ top_p=0.88,
217
+ repetition_penalty=1.18,
218
  bad_words_ids=BAD_WORDS_IDS,
219
  pad_token_id=tokenizer.eos_token_id
220
  )