Commit History

Auto-detect context length from /models (cloud) or model config (local), fall back to MAX_CONTEXT_TOKENS
a08d92c
verified

Leon4gr45 commited on

Add proactive + reactive context-length compression for long ReAct runs
69fdb6b
verified

Leon4gr45 commited on

Disable SSR mode - its self-reachability check was crashing launch() intermittently
e8d83f2
verified

Leon4gr45 commited on

Drop self-hosted SearXNG (HF abuse-flagged); use Jina search_web exclusively
be8a5e2
verified

Leon4gr45 commited on

Revert to Gradio SDK; use standalone SearXNG space; add explicit research-goal tracking with vagueness-aware early stopping
5753795
verified

Leon4gr45 commited on

Add rustc/cargo and upgrade pip so tokenizers builds cleanly
fd7ed59
verified

Leon4gr45 commited on

Switch to Docker SDK: self-host SearXNG sidecar as primary search, Jina as fallback
f6728df
verified

Leon4gr45 commited on

Use Jina search_web exclusively for search; drop SearXNG (unreliable, bot-blocked)
fcd5678
verified

Leon4gr45 commited on

Switch default SearXNG instance to search.mdosch.de
4abe0bf
verified

Leon4gr45 commited on

Treat 429 rate-limit as retryable in cloud backup call
4fefcd4
verified

Leon4gr45 commited on

Add Jina MCP read_url as primary scrape backend; retry-with-backoff for transient/proxy errors
a95e243
verified

Leon4gr45 commited on

Add Inference Mode switch (Auto/Local only/Cloud only)
b4c6e16
verified

Leon4gr45 commited on

Local ZeroGPU inference primary, OpenAI-compatible cloud backup; SearXNG-primary search with Serper backup
56fe555
verified

Leon4gr45 commited on

initial commit
5f4f7c1
verified

Leon4gr45 commited on