Servidor
Esta p谩gina cubre la inferencia del lado del servidor para Fish Audio S2, adem谩s de enlaces r谩pidos para la inferencia con WebUI y el despliegue con Docker.
Inferencia del servidor API
Fish Speech proporciona un punto de entrada de servidor HTTP en tools/api_server.py.
Iniciar el servidor localmente
python tools/api_server.py \
--llama-checkpoint-path checkpoints/s2-pro \
--decoder-checkpoint-path checkpoints/s2-pro/codec.pth \
--listen 0.0.0.0:8080
Opciones comunes:
--compile: habilitar optimizaci贸n contorch.compile--half: usar modo fp16--api-key: requerir autenticaci贸n mediante bearer token--workers: establecer la cantidad de procesos worker
Verificaci贸n de estado (health check)
curl -X GET http://127.0.0.1:8080/v1/health
Respuesta esperada:
{"status":"ok"}
Endpoint principal de la API
POST /v1/ttspara generaci贸n de texto a voz (text-to-speech)POST /v1/vqgan/encodepara codificaci贸n VQPOST /v1/vqgan/decodepara decodificaci贸n VQ
Ejemplo de cliente en Python
El modelo base de TTS se selecciona al iniciar el servidor. En el ejemplo anterior, el servidor se inicia con los pesos checkpoints/s2-pro, por lo que cada request enviada a http://127.0.0.1:8080/v1/tts usar谩 S2-Pro autom谩ticamente. No existe un campo model por request en tools/api_client.py para llamadas al servidor local.
python tools/api_client.py \
--url http://127.0.0.1:8080/v1/tts \
--text "Hello from Fish Speech" \
--output s2-pro-demo
Si quieres seleccionar una voz de referencia guardada, usa --reference_id. Esto elige la referencia de voz, no el modelo base TTS:
python tools/api_client.py \
--url http://127.0.0.1:8080/v1/tts \
--text "Hello from Fish Speech" \
--reference_id my-speaker \
--output s2-pro-demo
Inferencia con WebUI
Para uso con WebUI, ver:
Docker
Para despliegue del servidor o WebUI basado en Docker, ver:
Tambi茅n puedes iniciar directamente el perfil del servidor con Docker Compose:
docker compose --profile server up