ranranrunforit commited on
Commit
bfeff29
·
verified ·
1 Parent(s): 9c9c9b7

Upload 18 files

Browse files
Files changed (1) hide show
  1. llm_local.py +7 -8
llm_local.py CHANGED
@@ -25,6 +25,8 @@ from huggingface_hub import hf_hub_download
25
 
26
  # name -> (HF repo, gguf filename)
27
  MODEL_ZOO = {
 
 
28
  "Qwen3-1.7B · Tiny Titan (≤4B award class)": (
29
  "Qwen/Qwen3-1.7B-GGUF", "Qwen3-1.7B-Q8_0.gguf"),
30
  "Qwen3-4B · default — fast + smart, still ≤4B": (
@@ -33,14 +35,11 @@ MODEL_ZOO = {
33
  "Qwen/Qwen3-8B-GGUF", "Qwen3-8B-Q4_K_M.gguf"),
34
  "Qwen3-14B · max quality (still far under 32B cap)": (
35
  "Qwen/Qwen3-14B-GGUF", "Qwen3-14B-Q4_K_M.gguf"),
36
- # 🎯 Well-Tuned: after you publish your LoRA-merged GGUF, uncomment and edit
37
- # this line (repo = your HF id, filename = the .gguf you uploaded). It will
38
- # then appear in the Model tab as the fast Translator sub-agent.
39
- "Chan-Tuned Qwen3-1.7B · my fine-tune": (
40
- "ranranrunforit/chan-compass-qwen3-1.7b-gguf", "chan-compass-qwen3-1.7b-gguf.Q8_0.gguf"),
41
  }
42
- # FAST_MODEL = "Qwen3-1.7B · Tiny Titan (≤4B award class)"
43
- FAST_MODEL = "Chan-Tuned Qwen3-1.7B · my fine-tune"
 
 
44
  DEFAULT_MODEL = "Qwen3-4B · default — fast + smart, still ≤4B"
45
 
46
  _THINK_RE = re.compile(r"<think>.*?</think>", re.S)
@@ -64,7 +63,7 @@ def _mk(model):
64
 
65
 
66
  WORKERS = {
67
- "translator": _mk(FAST_MODEL),
68
  "narrator": _mk(FAST_MODEL),
69
  "reporter": _mk(FAST_MODEL),
70
  "analyst": _mk(DEFAULT_MODEL),
 
25
 
26
  # name -> (HF repo, gguf filename)
27
  MODEL_ZOO = {
28
+ "Chan-Tuned Qwen3-1.7B · my fine-tune (Well-Tuned)": (
29
+ "ranranrunforit/chan-compass-qwen3-1.7b-gguf", "qwen3-1.7b.Q8_0.gguf"),
30
  "Qwen3-1.7B · Tiny Titan (≤4B award class)": (
31
  "Qwen/Qwen3-1.7B-GGUF", "Qwen3-1.7B-Q8_0.gguf"),
32
  "Qwen3-4B · default — fast + smart, still ≤4B": (
 
35
  "Qwen/Qwen3-8B-GGUF", "Qwen3-8B-Q4_K_M.gguf"),
36
  "Qwen3-14B · max quality (still far under 32B cap)": (
37
  "Qwen/Qwen3-14B-GGUF", "Qwen3-14B-Q4_K_M.gguf"),
 
 
 
 
 
38
  }
39
+ # Only the Translator sub-agent (Signals · Explain) uses the published
40
+ # fine-tune; every other sub-agent stays on the stock models.
41
+ FAST_MODEL = "Qwen3-1.7B · Tiny Titan (≤4B award class)"
42
+ TRANSLATOR_MODEL = "Chan-Tuned Qwen3-1.7B · my fine-tune (Well-Tuned)"
43
  DEFAULT_MODEL = "Qwen3-4B · default — fast + smart, still ≤4B"
44
 
45
  _THINK_RE = re.compile(r"<think>.*?</think>", re.S)
 
63
 
64
 
65
  WORKERS = {
66
+ "translator": _mk(TRANSLATOR_MODEL),
67
  "narrator": _mk(FAST_MODEL),
68
  "reporter": _mk(FAST_MODEL),
69
  "analyst": _mk(DEFAULT_MODEL),