unity4ar commited on
Commit
e9ef2b5
·
verified ·
1 Parent(s): 50a467b

Default provider to zerogpu_transformers on HF Spaces; drop bogus README env block

Browse files
Files changed (2) hide show
  1. README.md +0 -6
  2. config/settings.py +6 -1
README.md CHANGED
@@ -16,12 +16,6 @@ tags:
16
  - game
17
  - agent
18
  - minicpm
19
- env:
20
- - PHANTOM_GRID_LLM_PROVIDER=zerogpu_transformers
21
- - PHANTOM_GRID_ZEROGPU_MODEL_ID=openbmb/MiniCPM4.1-8B
22
- - PHANTOM_GRID_ZEROGPU_DURATION=90
23
- - PHANTOM_GRID_HOST=0.0.0.0
24
- - PHANTOM_GRID_WITNESS_CHAT_TTS=0
25
  ---
26
 
27
  # 🕵️ Phantom Grid
 
16
  - game
17
  - agent
18
  - minicpm
 
 
 
 
 
 
19
  ---
20
 
21
  # 🕵️ Phantom Grid
config/settings.py CHANGED
@@ -92,9 +92,14 @@ def load_settings() -> Settings:
92
  detected = shutil.which("llama-server") or shutil.which("llama-server.exe")
93
  server_bin = Path(detected) if detected else None
94
 
 
 
 
 
 
95
  return Settings(
96
  games_dir=_env_path("PHANTOM_GRID_GAMES_DIR", PROJECT_ROOT / "data" / "games") or PROJECT_ROOT / "data" / "games",
97
- llm_provider=os.getenv("PHANTOM_GRID_LLM_PROVIDER", "llama_cpp_server"),
98
  llamacpp_server_bin=server_bin,
99
  llamacpp_model_path=_env_path("PHANTOM_GRID_LLAMACPP_MODEL_PATH"),
100
  llamacpp_base_url=os.getenv("PHANTOM_GRID_LLAMACPP_BASE_URL", "http://127.0.0.1:8080/v1"),
 
92
  detected = shutil.which("llama-server") or shutil.which("llama-server.exe")
93
  server_bin = Path(detected) if detected else None
94
 
95
+ # HF Spaces auto-injects SPACE_ID. When present, default to the in-process
96
+ # ZeroGPU transformers backend so the Space never tries to invoke cmake or
97
+ # spawn llama-server. Explicit PHANTOM_GRID_LLM_PROVIDER still wins.
98
+ default_provider = "zerogpu_transformers" if os.getenv("SPACE_ID") else "llama_cpp_server"
99
+
100
  return Settings(
101
  games_dir=_env_path("PHANTOM_GRID_GAMES_DIR", PROJECT_ROOT / "data" / "games") or PROJECT_ROOT / "data" / "games",
102
+ llm_provider=os.getenv("PHANTOM_GRID_LLM_PROVIDER", default_provider),
103
  llamacpp_server_bin=server_bin,
104
  llamacpp_model_path=_env_path("PHANTOM_GRID_LLAMACPP_MODEL_PATH"),
105
  llamacpp_base_url=os.getenv("PHANTOM_GRID_LLAMACPP_BASE_URL", "http://127.0.0.1:8080/v1"),