Werea-TSS / README.md
GoktugD's picture
Werea-TSS 183M beta: evaluated conservative checkpoint
6187707 verified
|
Raw
History Blame Contribute Delete
3.79 kB
---
language:
- tr
license: apache-2.0
pipeline_tag: text-to-speech
library_name: freyatts
base_model: freyavoice/Freya-TTS
tags:
- text-to-speech
- tts
- turkish
- flow-matching
- synthetic-data
- werea
---
# Werea-TSS 183M — Türkçe Metinden Sese
Werea-TSS, Werea organizasyonu için geliştirilmiş 183,2 milyon parametreli,
Türkçe öncelikli bir metinden-sese modelidir. Model, Apache-2.0 lisanslı
[FreyaTTS-small](https://huggingface.co/freyavoice/Freya-TTS) ağırlıklarının
tam-parametreli, korumacı bir fine-tune türevidir. Çıkış 48 kHz mono sestir.
Bu depo yalnızca bir arayüz değildir: `model.safetensors`, Werea eğitiminde
değiştirilmiş türetilmiş ağırlıkları içerir.
🎧 [Werea-TSS örnek WAV dosyası](./werea_sample.wav)
## Mimari
- Tokenizer/G2P olmadan 92 karakterlik Türkçe sözlük
- 183,2M parametreli non-autoregressive flow-matching DiT
- 25 Hz × 64 boyutlu AudioVAE2 latent uzayı
- 32 adımlı Euler ODE örnekleme
- Dondurulmuş, Apache-2.0 lisanslı VoxCPM2 AudioVAE2 decoder
## Werea ses kimliği ve veri kaynağı
İzinsiz gerçek kişi kaydı veya ses klonlama verisi kullanılmadı. Eğitim
metinleri Werea için özgün olarak üretildi. Öğretmen sesler, FreyaTTS-small
tabanından sabit `20260814` tohumu ile sentetik üretildi ve kaynak/seed bilgisi
manifestlerde tutuldu.
- Stage-1: 960 benzersiz Türkçe cümle, yaklaşık 1,19 saat
- Kısa-ifade denetimi: 312 ek kısa cümle
- Ayrılmış eval: eğitim metniyle sıfır çakışmalı 20 özgün Türkçe cümle
- Seçilen checkpoint: `conservative-step75` (`lr=2e-6`, effective batch 8)
## Değerlendirme
Ölçüm, `faster-whisper-small` ile Werea'nın 20 cümlelik ayrılmış eval setinde
yapıldı. Bu küçük iç değerlendirme, Freya'nın yayımladığı Freya-TR-Eval
sonuçlarıyla doğrudan karşılaştırılmamalıdır.
| Model | WER ↓ | CER ↓ | Geçerli ses |
|---|---:|---:|---:|
| FreyaTTS base (aynı koşul) | 27,22% | 9,44% | 20/20 |
| **Werea-TSS seçilen** | **29,11%** | **10,08%** | **20/20** |
| Agresif Stage-2 final (reddedildi) | 48,10% | 17,02% | 20/20 |
Agresif checkpoint kalite gerilemesi nedeniyle yayınlanmadı. Ayrıntılı ve
makinece okunabilir ölçümler `evaluation.json` dosyasındadır.
## Kullanım
Önce FreyaTTS kaynak deposunun gereksinimlerini kurun:
```bash
git clone https://github.com/freyavoiceai/FreyaTTS.git
cd FreyaTTS
pip install -r requirements.txt
```
```python
from freyatts import FreyaTTS
tts = FreyaTTS.from_pretrained("Werea-co/Werea-TSS", device="cuda")
wav = tts.synthesize(
"Merhaba, Werea deneyimine hoş geldiniz.",
steps=32,
seed=20260814,
)
tts.save_wav(wav, "werea.wav")
```
Depodaki `freyatts/` klasörü, sabitlenmiş upstream committen alınan Apache-2.0
çıkarım kodunu da içerir; Space dağıtımı bu kopyayı kullanır.
Werea ses kimliği için `seed=20260814` açıkça verilmelidir. Mevcut FreyaTTS
istemcisinin varsayılan tohumu farklıdır.
## Amaçlanan kullanım
Türkçe organizasyon duyuruları, erişilebilirlik seslendirmeleri, prototip sesli
asistanlar ve açık araştırma. Model insan sesi taklit etmek veya bir kişinin
kimliğine bürünmek amacıyla tasarlanmamıştır.
## Sınırlamalar
- Beta sürümdür; özel adlar, yabancı sözcükler ve çok uzun cümlelerde hata yapabilir.
- Duygusal kontrol ve referans-ses ile klonlama desteklenmez.
- Kritik duyurular yayımlanmadan önce insan tarafından dinlenmelidir.
- Sentetik ses olduğu kullanıcılara açıkça belirtilmelidir.
## Lisans ve atıf
Kod ve ağırlıklar Apache License 2.0 altındadır. Taban model FreyaTTS-small,
decoder ise VoxCPM2 AudioVAE2'dir. Korunan atıflar ve değişiklik bildirimi için
`NOTICE` ve `LICENSE` dosyalarına bakın.