--- title: CoderInstruc emoji: 🌵 colorFrom: green colorTo: indigo sdk: gradio sdk_version: 6.20.0 app_file: app.py pinned: false license: apache-2.0 short_description: CoderInstruc coding assistant (Qwen3-Coder + post-train) --- # CoderInstruc Chat Gradio + API para agents. Inferência remota via Hugging Face Inference Router (não baixa o modelo 30B neste Space). ## Agents ```bash curl https://huggingface.co/spaces/amarorn/CoderInstruc/agents.md ``` O `agents.md` é **gerado automaticamente** pela HF para todo Gradio Space. Agents (Claude Code, Codex, etc.) leem esse arquivo e chamam a API Gradio. Endpoint útil neste app: **`ask`** (`prompt` → `answer`). ## Hardware Este Space **não carrega o modelo 30B**. Só faz HTTP para a Inference API. - Preferido: **CPU Basic** - Se estiver em **ZeroGPU**, o `app.py` inclui `@spaces.GPU` para o runtime não falhar com `No @spaces.GPU function detected during startup` Em **Settings → Settings → Hardware**, troque ZeroGPU → CPU se puder. ## Secrets (Settings → Variables and secrets) | Name | Valor | |------|--------| | `HF_TOKEN` | token com permissão Inference | | `CODERINSTRUC_HF_INFERENCE_MODEL` | `Qwen/Qwen3-Coder-30B-A3B-Instruct` (depois: seu adapter) | | `CODERINSTRUC_HF_INFERENCE_ENDPOINT` | `https://router.huggingface.co/v1` (opcional) | ## Deploy a partir do GitHub Repo código: `CodeModel` → pasta `spaces/coderinstruc-chat/` Space alvo: **`amarorn/CoderInstruc`** ```bash uv run python scripts/deploy_space.py --space amarorn/CoderInstruc ``` Ou GitHub Action `deploy-hf-space` (secret `HF_TOKEN`). > Hosting Gradio no CPU free pode exigir [HF PRO](https://huggingface.co/pro). Sem PRO: `uv run coderinstruc space`