rehan953 commited on
Commit
20e8672
·
verified ·
1 Parent(s): 3c716e3

Update app.py

Browse files
Files changed (1) hide show
  1. app.py +3 -1
app.py CHANGED
@@ -17,7 +17,9 @@ logging.basicConfig(level=logging.INFO)
17
  MODEL_ID = os.getenv("GLMOCR_MODEL_ID", "zai-org/GLM-OCR")
18
  OCR_API_PORT = int(os.getenv("OCR_API_PORT", "8080"))
19
  OCR_API_BASE = f"http://127.0.0.1:{OCR_API_PORT}"
20
- VLLM_MAX_MODEL_LEN = os.getenv("VLLM_MAX_MODEL_LEN", "4096")
 
 
21
  VLLM_GPU_MEMORY_UTIL = os.getenv("VLLM_GPU_MEMORY_UTIL", "0.75")
22
  VLLM_EXTRA_ARGS = os.getenv("VLLM_EXTRA_ARGS", "").strip()
23
 
 
17
  MODEL_ID = os.getenv("GLMOCR_MODEL_ID", "zai-org/GLM-OCR")
18
  OCR_API_PORT = int(os.getenv("OCR_API_PORT", "8080"))
19
  OCR_API_BASE = f"http://127.0.0.1:{OCR_API_PORT}"
20
+ # GLM-OCR self-hosted requests can ask up to 8192 output tokens.
21
+ # Keep server context length aligned unless explicitly overridden by env.
22
+ VLLM_MAX_MODEL_LEN = os.getenv("VLLM_MAX_MODEL_LEN", "8192")
23
  VLLM_GPU_MEMORY_UTIL = os.getenv("VLLM_GPU_MEMORY_UTIL", "0.75")
24
  VLLM_EXTRA_ARGS = os.getenv("VLLM_EXTRA_ARGS", "").strip()
25