Spaces:
Running on Zero
Running on Zero
Upload app.py with huggingface_hub
Browse files
app.py
CHANGED
|
@@ -26,7 +26,9 @@ from transformers import AutoModelForCausalLM, AutoTokenizer, TextIteratorStream
|
|
| 26 |
# โโ Config โโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโ
|
| 27 |
|
| 28 |
MODEL_ID = os.environ.get("MODEL_ID", "oddadmix/Nawah-Reasoning-v1")
|
| 29 |
-
|
|
|
|
|
|
|
| 30 |
|
| 31 |
IM_START, IM_END = "<|im_start|>", "<|im_end|>"
|
| 32 |
THINK_OPEN, THINK_CLOSE = "<think>", "</think>"
|
|
@@ -36,6 +38,8 @@ MAX_NEW_TOKENS_CAP = 512
|
|
| 36 |
|
| 37 |
torch.set_num_threads(os.cpu_count() or 2)
|
| 38 |
|
|
|
|
|
|
|
| 39 |
print(f"[*] Loading {MODEL_ID} ...")
|
| 40 |
tokenizer = AutoTokenizer.from_pretrained(MODEL_ID, token=HF_TOKEN)
|
| 41 |
model = AutoModelForCausalLM.from_pretrained(MODEL_ID, dtype=torch.float32, token=HF_TOKEN)
|
|
|
|
| 26 |
# โโ Config โโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโโ
|
| 27 |
|
| 28 |
MODEL_ID = os.environ.get("MODEL_ID", "oddadmix/Nawah-Reasoning-v1")
|
| 29 |
+
# Only needed while the model repo is private. HF_TOKEN appears to be reserved by Spaces
|
| 30 |
+
# (a secret set under that name does not reach the container), so MODEL_HF_TOKEN is preferred.
|
| 31 |
+
HF_TOKEN = os.environ.get("MODEL_HF_TOKEN") or os.environ.get("HF_TOKEN")
|
| 32 |
|
| 33 |
IM_START, IM_END = "<|im_start|>", "<|im_end|>"
|
| 34 |
THINK_OPEN, THINK_CLOSE = "<think>", "</think>"
|
|
|
|
| 38 |
|
| 39 |
torch.set_num_threads(os.cpu_count() or 2)
|
| 40 |
|
| 41 |
+
print("[*] token env vars present:",
|
| 42 |
+
[k for k in ("MODEL_HF_TOKEN", "HF_TOKEN") if os.environ.get(k)] or "NONE")
|
| 43 |
print(f"[*] Loading {MODEL_ID} ...")
|
| 44 |
tokenizer = AutoTokenizer.from_pretrained(MODEL_ID, token=HF_TOKEN)
|
| 45 |
model = AutoModelForCausalLM.from_pretrained(MODEL_ID, dtype=torch.float32, token=HF_TOKEN)
|