--- title: S2S Backend HF Cerebras emoji: 🎤 colorFrom: green colorTo: indigo sdk: docker app_port: 8765 pinned: false suggested_hardware: t4-small short_description: Parakeet + Gemma-4 Cerebras + Qwen3-TTS realtime --- Backend WebSocket compatible con el protocolo OpenAI Realtime GA. Sirve `/v1/realtime` en el `app_port` del Space. Corre `huggingface/speech-to-speech --mode realtime` con: - **STT**: `nvidia/parakeet-tdt-0.6b-v3` (en GPU del Space) - **LLM**: `google/gemma-4-31B-it:cerebras` vía HF Router - **TTS**: `Qwen3-TTS-12Hz-1.7B` (en GPU del Space, backend torch) Secretos requeridos: - `HF_TOKEN` — token con acceso a Inference Providers (para Cerebras via router) Cliente: cualquier frontend que hable OpenAI Realtime, por ejemplo el fork de `smolagents/hf-realtime-voice`. Poner `wss://.hf.space` en Settings.