Spaces:
Sleeping
Sleeping
| title: S2S Backend HF Cerebras | |
| emoji: 🎤 | |
| colorFrom: green | |
| colorTo: indigo | |
| sdk: docker | |
| app_port: 8765 | |
| pinned: false | |
| suggested_hardware: t4-small | |
| short_description: Parakeet + Gemma-4 Cerebras + Qwen3-TTS realtime | |
| Backend WebSocket compatible con el protocolo OpenAI Realtime GA. | |
| Sirve `/v1/realtime` en el `app_port` del Space. | |
| Corre `huggingface/speech-to-speech --mode realtime` con: | |
| - **STT**: `nvidia/parakeet-tdt-0.6b-v3` (en GPU del Space) | |
| - **LLM**: `google/gemma-4-31B-it:cerebras` vía HF Router | |
| - **TTS**: `Qwen3-TTS-12Hz-1.7B` (en GPU del Space, backend torch) | |
| Secretos requeridos: | |
| - `HF_TOKEN` — token con acceso a Inference Providers (para Cerebras via router) | |
| Cliente: cualquier frontend que hable OpenAI Realtime, por ejemplo el fork de | |
| `smolagents/hf-realtime-voice`. Poner `wss://<este-space>.hf.space` en Settings. | |