Auto-detect context length from /models (cloud) or model config (local), fall back to MAX_CONTEXT_TOKENS a08d92c verified Leon4gr45 commited on Jul 6
Add proactive + reactive context-length compression for long ReAct runs 69fdb6b verified Leon4gr45 commited on Jul 6
Disable SSR mode - its self-reachability check was crashing launch() intermittently e8d83f2 verified Leon4gr45 commited on Jul 6
Drop self-hosted SearXNG (HF abuse-flagged); use Jina search_web exclusively be8a5e2 verified Leon4gr45 commited on Jul 6
Revert to Gradio SDK; use standalone SearXNG space; add explicit research-goal tracking with vagueness-aware early stopping 5753795 verified Leon4gr45 commited on Jul 6
Add rustc/cargo and upgrade pip so tokenizers builds cleanly fd7ed59 verified Leon4gr45 commited on Jul 6
Switch to Docker SDK: self-host SearXNG sidecar as primary search, Jina as fallback f6728df verified Leon4gr45 commited on Jul 6
Use Jina search_web exclusively for search; drop SearXNG (unreliable, bot-blocked) fcd5678 verified Leon4gr45 commited on Jul 6
Add Jina MCP read_url as primary scrape backend; retry-with-backoff for transient/proxy errors a95e243 verified Leon4gr45 commited on Jul 6
Local ZeroGPU inference primary, OpenAI-compatible cloud backup; SearXNG-primary search with Serper backup 56fe555 verified Leon4gr45 commited on Jul 6