Spaces:
Sleeping
Sleeping
Update app.py
Browse files
app.py
CHANGED
|
@@ -14,14 +14,15 @@ import yaml
|
|
| 14 |
log = logging.getLogger("glmocr_selfhosted_space")
|
| 15 |
logging.basicConfig(level=logging.INFO)
|
| 16 |
|
| 17 |
-
MODEL_ID =
|
| 18 |
-
OCR_API_PORT =
|
| 19 |
OCR_API_BASE = f"http://127.0.0.1:{OCR_API_PORT}"
|
| 20 |
-
#
|
| 21 |
-
|
| 22 |
-
|
| 23 |
-
|
| 24 |
-
|
|
|
|
| 25 |
|
| 26 |
_parser = None
|
| 27 |
_vllm_proc = None
|
|
@@ -88,6 +89,8 @@ def _configure_glmocr_to_keep_header_footer() -> None:
|
|
| 88 |
ocr_api["api_path"] = "/v1/chat/completions"
|
| 89 |
ocr_api["api_mode"] = "openai"
|
| 90 |
ocr_api["verify_ssl"] = False
|
|
|
|
|
|
|
| 91 |
|
| 92 |
layout = pipeline.setdefault("layout", {})
|
| 93 |
label_task_mapping = layout.setdefault("label_task_mapping", {})
|
|
|
|
| 14 |
log = logging.getLogger("glmocr_selfhosted_space")
|
| 15 |
logging.basicConfig(level=logging.INFO)
|
| 16 |
|
| 17 |
+
MODEL_ID = "zai-org/GLM-OCR"
|
| 18 |
+
OCR_API_PORT = 8080
|
| 19 |
OCR_API_BASE = f"http://127.0.0.1:{OCR_API_PORT}"
|
| 20 |
+
# Fixed runtime settings (no environment variables required).
|
| 21 |
+
VLLM_MAX_MODEL_LEN = "8192"
|
| 22 |
+
VLLM_GPU_MEMORY_UTIL = "0.75"
|
| 23 |
+
VLLM_EXTRA_ARGS = ""
|
| 24 |
+
# Keep output budget below context length to leave room for prompt tokens.
|
| 25 |
+
GLMOCR_MAX_OUTPUT_TOKENS = 2048
|
| 26 |
|
| 27 |
_parser = None
|
| 28 |
_vllm_proc = None
|
|
|
|
| 89 |
ocr_api["api_path"] = "/v1/chat/completions"
|
| 90 |
ocr_api["api_mode"] = "openai"
|
| 91 |
ocr_api["verify_ssl"] = False
|
| 92 |
+
page_loader = pipeline.setdefault("page_loader", {})
|
| 93 |
+
page_loader["max_tokens"] = GLMOCR_MAX_OUTPUT_TOKENS
|
| 94 |
|
| 95 |
layout = pipeline.setdefault("layout", {})
|
| 96 |
label_task_mapping = layout.setdefault("label_task_mapping", {})
|