Vineet commited on
Commit
64201d1
·
1 Parent(s): 990d2ad

Increase max_tokens for Gemini from 150 to 500 to prevent cut-off sentences

Browse files
ml-service/app/models/llm_detoxifier.py CHANGED
@@ -292,7 +292,7 @@ class LLMDetoxifier:
292
  model=settings.GEMINI_MODEL,
293
  messages=[{"role": "user", "content": prompt}],
294
  temperature=0.3,
295
- max_tokens=150,
296
  )
297
  result = response.choices[0].message.content.strip() if response.choices and response.choices[0].message else None
298
  else:
@@ -334,7 +334,7 @@ class LLMDetoxifier:
334
  model=settings.GEMINI_MODEL,
335
  messages=[{"role": "user", "content": prompt}],
336
  temperature=0.3,
337
- max_tokens=150,
338
  stream=True,
339
  )
340
  full_generated = ""
 
292
  model=settings.GEMINI_MODEL,
293
  messages=[{"role": "user", "content": prompt}],
294
  temperature=0.3,
295
+ max_tokens=500,
296
  )
297
  result = response.choices[0].message.content.strip() if response.choices and response.choices[0].message else None
298
  else:
 
334
  model=settings.GEMINI_MODEL,
335
  messages=[{"role": "user", "content": prompt}],
336
  temperature=0.3,
337
+ max_tokens=500,
338
  stream=True,
339
  )
340
  full_generated = ""