s2s-backend / README.md
dponcedeleonf's picture
initial: speech-to-speech backend
1ffbccc verified
|
Raw
History Blame Contribute Delete
848 Bytes
---
title: S2S Backend HF Cerebras
emoji: 🎤
colorFrom: green
colorTo: indigo
sdk: docker
app_port: 8765
pinned: false
suggested_hardware: t4-small
short_description: Parakeet + Gemma-4 Cerebras + Qwen3-TTS realtime
---
Backend WebSocket compatible con el protocolo OpenAI Realtime GA.
Sirve `/v1/realtime` en el `app_port` del Space.
Corre `huggingface/speech-to-speech --mode realtime` con:
- **STT**: `nvidia/parakeet-tdt-0.6b-v3` (en GPU del Space)
- **LLM**: `google/gemma-4-31B-it:cerebras` vía HF Router
- **TTS**: `Qwen3-TTS-12Hz-1.7B` (en GPU del Space, backend torch)
Secretos requeridos:
- `HF_TOKEN` — token con acceso a Inference Providers (para Cerebras via router)
Cliente: cualquier frontend que hable OpenAI Realtime, por ejemplo el fork de
`smolagents/hf-realtime-voice`. Poner `wss://<este-space>.hf.space` en Settings.