s2s-backend / README.md
dponcedeleonf's picture
initial: speech-to-speech backend
1ffbccc verified
|
Raw
History Blame Contribute Delete
848 Bytes
metadata
title: S2S Backend HF Cerebras
emoji: 🎤
colorFrom: green
colorTo: indigo
sdk: docker
app_port: 8765
pinned: false
suggested_hardware: t4-small
short_description: Parakeet + Gemma-4 Cerebras + Qwen3-TTS realtime

Backend WebSocket compatible con el protocolo OpenAI Realtime GA. Sirve /v1/realtime en el app_port del Space.

Corre huggingface/speech-to-speech --mode realtime con:

  • STT: nvidia/parakeet-tdt-0.6b-v3 (en GPU del Space)
  • LLM: google/gemma-4-31B-it:cerebras vía HF Router
  • TTS: Qwen3-TTS-12Hz-1.7B (en GPU del Space, backend torch)

Secretos requeridos:

  • HF_TOKEN — token con acceso a Inference Providers (para Cerebras via router)

Cliente: cualquier frontend que hable OpenAI Realtime, por ejemplo el fork de smolagents/hf-realtime-voice. Poner wss://<este-space>.hf.space en Settings.