Spaces:
Runtime error
Runtime error
Upload 18 files
Browse files- llm_local.py +7 -8
llm_local.py
CHANGED
|
@@ -25,6 +25,8 @@ from huggingface_hub import hf_hub_download
|
|
| 25 |
|
| 26 |
# name -> (HF repo, gguf filename)
|
| 27 |
MODEL_ZOO = {
|
|
|
|
|
|
|
| 28 |
"Qwen3-1.7B · Tiny Titan (≤4B award class)": (
|
| 29 |
"Qwen/Qwen3-1.7B-GGUF", "Qwen3-1.7B-Q8_0.gguf"),
|
| 30 |
"Qwen3-4B · default — fast + smart, still ≤4B": (
|
|
@@ -33,14 +35,11 @@ MODEL_ZOO = {
|
|
| 33 |
"Qwen/Qwen3-8B-GGUF", "Qwen3-8B-Q4_K_M.gguf"),
|
| 34 |
"Qwen3-14B · max quality (still far under 32B cap)": (
|
| 35 |
"Qwen/Qwen3-14B-GGUF", "Qwen3-14B-Q4_K_M.gguf"),
|
| 36 |
-
# 🎯 Well-Tuned: after you publish your LoRA-merged GGUF, uncomment and edit
|
| 37 |
-
# this line (repo = your HF id, filename = the .gguf you uploaded). It will
|
| 38 |
-
# then appear in the Model tab as the fast Translator sub-agent.
|
| 39 |
-
"Chan-Tuned Qwen3-1.7B · my fine-tune": (
|
| 40 |
-
"ranranrunforit/chan-compass-qwen3-1.7b-gguf", "chan-compass-qwen3-1.7b-gguf.Q8_0.gguf"),
|
| 41 |
}
|
| 42 |
-
#
|
| 43 |
-
|
|
|
|
|
|
|
| 44 |
DEFAULT_MODEL = "Qwen3-4B · default — fast + smart, still ≤4B"
|
| 45 |
|
| 46 |
_THINK_RE = re.compile(r"<think>.*?</think>", re.S)
|
|
@@ -64,7 +63,7 @@ def _mk(model):
|
|
| 64 |
|
| 65 |
|
| 66 |
WORKERS = {
|
| 67 |
-
"translator": _mk(
|
| 68 |
"narrator": _mk(FAST_MODEL),
|
| 69 |
"reporter": _mk(FAST_MODEL),
|
| 70 |
"analyst": _mk(DEFAULT_MODEL),
|
|
|
|
| 25 |
|
| 26 |
# name -> (HF repo, gguf filename)
|
| 27 |
MODEL_ZOO = {
|
| 28 |
+
"Chan-Tuned Qwen3-1.7B · my fine-tune (Well-Tuned)": (
|
| 29 |
+
"ranranrunforit/chan-compass-qwen3-1.7b-gguf", "qwen3-1.7b.Q8_0.gguf"),
|
| 30 |
"Qwen3-1.7B · Tiny Titan (≤4B award class)": (
|
| 31 |
"Qwen/Qwen3-1.7B-GGUF", "Qwen3-1.7B-Q8_0.gguf"),
|
| 32 |
"Qwen3-4B · default — fast + smart, still ≤4B": (
|
|
|
|
| 35 |
"Qwen/Qwen3-8B-GGUF", "Qwen3-8B-Q4_K_M.gguf"),
|
| 36 |
"Qwen3-14B · max quality (still far under 32B cap)": (
|
| 37 |
"Qwen/Qwen3-14B-GGUF", "Qwen3-14B-Q4_K_M.gguf"),
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 38 |
}
|
| 39 |
+
# Only the Translator sub-agent (Signals · Explain) uses the published
|
| 40 |
+
# fine-tune; every other sub-agent stays on the stock models.
|
| 41 |
+
FAST_MODEL = "Qwen3-1.7B · Tiny Titan (≤4B award class)"
|
| 42 |
+
TRANSLATOR_MODEL = "Chan-Tuned Qwen3-1.7B · my fine-tune (Well-Tuned)"
|
| 43 |
DEFAULT_MODEL = "Qwen3-4B · default — fast + smart, still ≤4B"
|
| 44 |
|
| 45 |
_THINK_RE = re.compile(r"<think>.*?</think>", re.S)
|
|
|
|
| 63 |
|
| 64 |
|
| 65 |
WORKERS = {
|
| 66 |
+
"translator": _mk(TRANSLATOR_MODEL),
|
| 67 |
"narrator": _mk(FAST_MODEL),
|
| 68 |
"reporter": _mk(FAST_MODEL),
|
| 69 |
"analyst": _mk(DEFAULT_MODEL),
|