Render streamed reasoning_content in a collapsible Thinking box 68544d8 verified NanoBotAIAgent commited on Jun 2
Enable reasoning by default via --jinja --reasoning-format deepseek d3c4711 verified NanoBotAIAgent commited on Jun 2
Serve chat UI at / and keep /v1 API + add /api-info 5d5d213 verified NanoBotAIAgent commited on Jun 2
Set max generation to 25000 tokens (ctx 131072, leaves 106072 for prompt) 8bc620a verified NanoBotAIAgent commited on Jun 2
Use explicit chatml template instead of broken embedded jinja template f42a808 verified NanoBotAIAgent commited on Jun 2
Fix Content-Length error: strip framing headers from request and response 1afd9e4 verified NanoBotAIAgent commited on Jun 2
Fix pip install with --break-system-packages for Ubuntu 24.04 a3acabf verified NanoBotAIAgent commited on May 22
Use local pre-downloaded model and start uvicorn proxy 44f2334 verified NanoBotAIAgent commited on May 14
Add robust proxy with lifespan-based llama-server readiness check a149d5b verified NanoBotAIAgent commited on May 14