Migrate DiT to dedicated Inference Endpoint (L40S, scale-to-zero) 17fb884 claude commited on 3 days ago
DiT: bypass diffusers entirely, use internal PSM pipeline byte-identically 7d5b077 heheyas commited on 9 days ago
PE: SSE streaming (/api/generate_sp/stream) + SPA live token render c425f49 heheyas commited on 9 days ago
Swap diffusers' transformer for internal modeling.qwenimage impl 1d50da1 heheyas commited on 9 days ago
DiT: compact-single-quote SP normalization on the Space side too b4dc72d heheyas commited on 9 days ago
DiT: only overlay dit_model.*, skip text_encoder (matches EvalKit) 170a63b heheyas commited on 9 days ago
PE input_template: '<prompt>' (raw), drop [width/height] suffix 8504cc2 heheyas commited on 9 days ago
PE JSON extractor: split duplicate-id dicts + json_repair fallback 3d002a9 heheyas commited on 9 days ago
Space /api/generate_sp: retry-with-backoff on endpoint 503 (cold start) db7ff81 heheyas commited on 9 days ago
Wire /api/generate_sp to HF Inference Endpoint (vLLM+Qwen3.5-35B-A3B) b9749da heheyas commited on 9 days ago
Prepend a Route('/') instead of middleware (fastapi frozen post-launch) 859009e heheyas commited on 12 days ago
Let Gradio be primary launcher; attach fastapi routes to demo.app 8e55230 heheyas commited on 12 days ago
Switch to sdk: docker (Gradio SDK monkey-patches uvicorn.run) 95df090 heheyas commited on 12 days ago