qwen2.5api / server.py

Commit History

Fix: lazy model load on first request, add error handling
d240987

vykanand commited on

Fix: replace llama_cpp.server with custom FastAPI server (no mlock, no health check loop)
a7f7a81

vykanand commited on