Add optional GLM-4.7-Flash Q8 and GPT-OSS-120B MXFP4 aliases 48f42a4 verified ShoaibSSM commited on 11 days ago
Bound llama.cpp HTTP and compute threads; enable four slots d861a68 verified ShoaibSSM commited on 11 days ago
Add lazy two-model router and detached ngrok setup 350d99c verified ShoaibSSM commited on 11 days ago
Add pinned A100 Qwen API runtime and benchmark scripts 42b02cd verified ShoaibSSM commited on 11 days ago