CoderInstruc / README.md
amarorn's picture
Upload folder using huggingface_hub
178ff41 verified
|
Raw
History Blame Contribute Delete
1.73 kB
---
title: CoderInstruc
emoji: 🌵
colorFrom: green
colorTo: indigo
sdk: gradio
sdk_version: 6.20.0
app_file: app.py
pinned: false
license: apache-2.0
short_description: CoderInstruc coding assistant (Qwen3-Coder + post-train)
---
# CoderInstruc
Chat Gradio + API para agents. Inferência remota via Hugging Face Inference Router
(não baixa o modelo 30B neste Space).
## Agents
```bash
curl https://huggingface.co/spaces/amarorn/CoderInstruc/agents.md
```
O `agents.md` é **gerado automaticamente** pela HF para todo Gradio Space. Agents (Claude Code, Codex, etc.) leem esse arquivo e chamam a API Gradio.
Endpoint útil neste app: **`ask`** (`prompt``answer`).
## Hardware
Este Space **não carrega o modelo 30B**. Só faz HTTP para a Inference API.
- Preferido: **CPU Basic**
- Se estiver em **ZeroGPU**, o `app.py` inclui `@spaces.GPU` para o runtime não falhar com
`No @spaces.GPU function detected during startup`
Em **Settings → Settings → Hardware**, troque ZeroGPU → CPU se puder.
## Secrets (Settings → Variables and secrets)
| Name | Valor |
|------|--------|
| `HF_TOKEN` | token com permissão Inference |
| `CODERINSTRUC_HF_INFERENCE_MODEL` | `Qwen/Qwen3-Coder-30B-A3B-Instruct` (depois: seu adapter) |
| `CODERINSTRUC_HF_INFERENCE_ENDPOINT` | `https://router.huggingface.co/v1` (opcional) |
## Deploy a partir do GitHub
Repo código: `CodeModel` → pasta `spaces/coderinstruc-chat/`
Space alvo: **`amarorn/CoderInstruc`**
```bash
uv run python scripts/deploy_space.py --space amarorn/CoderInstruc
```
Ou GitHub Action `deploy-hf-space` (secret `HF_TOKEN`).
> Hosting Gradio no CPU free pode exigir [HF PRO](https://huggingface.co/pro). Sem PRO: `uv run coderinstruc space`