Spaces:
Sleeping
Sleeping
metadata
title: S2S Backend HF Cerebras
emoji: 🎤
colorFrom: green
colorTo: indigo
sdk: docker
app_port: 8765
pinned: false
suggested_hardware: t4-small
short_description: Parakeet + Gemma-4 Cerebras + Qwen3-TTS realtime
Backend WebSocket compatible con el protocolo OpenAI Realtime GA.
Sirve /v1/realtime en el app_port del Space.
Corre huggingface/speech-to-speech --mode realtime con:
- STT:
nvidia/parakeet-tdt-0.6b-v3(en GPU del Space) - LLM:
google/gemma-4-31B-it:cerebrasvía HF Router - TTS:
Qwen3-TTS-12Hz-1.7B(en GPU del Space, backend torch)
Secretos requeridos:
HF_TOKEN— token con acceso a Inference Providers (para Cerebras via router)
Cliente: cualquier frontend que hable OpenAI Realtime, por ejemplo el fork de
smolagents/hf-realtime-voice. Poner wss://<este-space>.hf.space en Settings.