Default provider to zerogpu_transformers on HF Spaces; drop bogus README env block
Browse files- README.md +0 -6
- config/settings.py +6 -1
README.md
CHANGED
|
@@ -16,12 +16,6 @@ tags:
|
|
| 16 |
- game
|
| 17 |
- agent
|
| 18 |
- minicpm
|
| 19 |
-
env:
|
| 20 |
-
- PHANTOM_GRID_LLM_PROVIDER=zerogpu_transformers
|
| 21 |
-
- PHANTOM_GRID_ZEROGPU_MODEL_ID=openbmb/MiniCPM4.1-8B
|
| 22 |
-
- PHANTOM_GRID_ZEROGPU_DURATION=90
|
| 23 |
-
- PHANTOM_GRID_HOST=0.0.0.0
|
| 24 |
-
- PHANTOM_GRID_WITNESS_CHAT_TTS=0
|
| 25 |
---
|
| 26 |
|
| 27 |
# 🕵️ Phantom Grid
|
|
|
|
| 16 |
- game
|
| 17 |
- agent
|
| 18 |
- minicpm
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 19 |
---
|
| 20 |
|
| 21 |
# 🕵️ Phantom Grid
|
config/settings.py
CHANGED
|
@@ -92,9 +92,14 @@ def load_settings() -> Settings:
|
|
| 92 |
detected = shutil.which("llama-server") or shutil.which("llama-server.exe")
|
| 93 |
server_bin = Path(detected) if detected else None
|
| 94 |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 95 |
return Settings(
|
| 96 |
games_dir=_env_path("PHANTOM_GRID_GAMES_DIR", PROJECT_ROOT / "data" / "games") or PROJECT_ROOT / "data" / "games",
|
| 97 |
-
llm_provider=os.getenv("PHANTOM_GRID_LLM_PROVIDER",
|
| 98 |
llamacpp_server_bin=server_bin,
|
| 99 |
llamacpp_model_path=_env_path("PHANTOM_GRID_LLAMACPP_MODEL_PATH"),
|
| 100 |
llamacpp_base_url=os.getenv("PHANTOM_GRID_LLAMACPP_BASE_URL", "http://127.0.0.1:8080/v1"),
|
|
|
|
| 92 |
detected = shutil.which("llama-server") or shutil.which("llama-server.exe")
|
| 93 |
server_bin = Path(detected) if detected else None
|
| 94 |
|
| 95 |
+
# HF Spaces auto-injects SPACE_ID. When present, default to the in-process
|
| 96 |
+
# ZeroGPU transformers backend so the Space never tries to invoke cmake or
|
| 97 |
+
# spawn llama-server. Explicit PHANTOM_GRID_LLM_PROVIDER still wins.
|
| 98 |
+
default_provider = "zerogpu_transformers" if os.getenv("SPACE_ID") else "llama_cpp_server"
|
| 99 |
+
|
| 100 |
return Settings(
|
| 101 |
games_dir=_env_path("PHANTOM_GRID_GAMES_DIR", PROJECT_ROOT / "data" / "games") or PROJECT_ROOT / "data" / "games",
|
| 102 |
+
llm_provider=os.getenv("PHANTOM_GRID_LLM_PROVIDER", default_provider),
|
| 103 |
llamacpp_server_bin=server_bin,
|
| 104 |
llamacpp_model_path=_env_path("PHANTOM_GRID_LLAMACPP_MODEL_PATH"),
|
| 105 |
llamacpp_base_url=os.getenv("PHANTOM_GRID_LLAMACPP_BASE_URL", "http://127.0.0.1:8080/v1"),
|