PDFTranslator / .env.example
hoang.nguyen6
deploy
f66643d unverified
Raw
History Blame Contribute Delete
851 Bytes
# Thiết bị chạy model: "cuda", "cpu", hoặc "auto" (auto -> cuda nếu có GPU)
DEVICE=auto
# Batch size cho A100 80GB / 142GB RAM — tận dụng VRAM cho Phase 1 (đỉnh ~45-55GB,
# vẫn còn headroom an toàn trong 80GB).
# - OCR (recognition) nặng nhất: 512 ~ 13GB VRAM.
# - layout/detection 64: gấp đôi mặc định, tăng throughput Phase 1 nhờ thừa VRAM.
# - page 32 + table 512: 142GB RAM & 80GB VRAM dư sức.
# GPU nhỏ hơn (T4/16GB): để trống tất cả (None) để Surya tự chọn batch nhỏ, tránh OOM.
PAGE_BATCH_SIZE=32
LAYOUT_BATCH_SIZE=64
DETECTION_BATCH_SIZE=64
OCR_BATCH_SIZE=512
TABLE_BATCH_SIZE=512
# Cấu hình cho OCR (Lưu ý: text threshold > blank threshold) — ảnh hưởng độ chính xác,
# không liên quan VRAM.
DETECTOR_BLANK_THRESHOLD=0.5
DETECTOR_TEXT_THRESHOLD=0.6