| --- |
| language: |
| - tr |
| license: apache-2.0 |
| pipeline_tag: text-to-speech |
| library_name: freyatts |
| base_model: freyavoice/Freya-TTS |
| tags: |
| - text-to-speech |
| - tts |
| - turkish |
| - flow-matching |
| - synthetic-data |
| - werea |
| --- |
| |
| # Werea-TSS 183M — Türkçe Metinden Sese |
|
|
| Werea-TSS, Werea organizasyonu için geliştirilmiş 183,2 milyon parametreli, |
| Türkçe öncelikli bir metinden-sese modelidir. Model, Apache-2.0 lisanslı |
| [FreyaTTS-small](https://huggingface.co/freyavoice/Freya-TTS) ağırlıklarının |
| tam-parametreli, korumacı bir fine-tune türevidir. Çıkış 48 kHz mono sestir. |
|
|
| Bu depo yalnızca bir arayüz değildir: `model.safetensors`, Werea eğitiminde |
| değiştirilmiş türetilmiş ağırlıkları içerir. |
|
|
| 🎧 [Werea-TSS örnek WAV dosyası](./werea_sample.wav) |
|
|
| ## Mimari |
|
|
| - Tokenizer/G2P olmadan 92 karakterlik Türkçe sözlük |
| - 183,2M parametreli non-autoregressive flow-matching DiT |
| - 25 Hz × 64 boyutlu AudioVAE2 latent uzayı |
| - 32 adımlı Euler ODE örnekleme |
| - Dondurulmuş, Apache-2.0 lisanslı VoxCPM2 AudioVAE2 decoder |
|
|
| ## Werea ses kimliği ve veri kaynağı |
|
|
| İzinsiz gerçek kişi kaydı veya ses klonlama verisi kullanılmadı. Eğitim |
| metinleri Werea için özgün olarak üretildi. Öğretmen sesler, FreyaTTS-small |
| tabanından sabit `20260814` tohumu ile sentetik üretildi ve kaynak/seed bilgisi |
| manifestlerde tutuldu. |
|
|
| - Stage-1: 960 benzersiz Türkçe cümle, yaklaşık 1,19 saat |
| - Kısa-ifade denetimi: 312 ek kısa cümle |
| - Ayrılmış eval: eğitim metniyle sıfır çakışmalı 20 özgün Türkçe cümle |
| - Seçilen checkpoint: `conservative-step75` (`lr=2e-6`, effective batch 8) |
|
|
| ## Değerlendirme |
|
|
| Ölçüm, `faster-whisper-small` ile Werea'nın 20 cümlelik ayrılmış eval setinde |
| yapıldı. Bu küçük iç değerlendirme, Freya'nın yayımladığı Freya-TR-Eval |
| sonuçlarıyla doğrudan karşılaştırılmamalıdır. |
|
|
| | Model | WER ↓ | CER ↓ | Geçerli ses | |
| |---|---:|---:|---:| |
| | FreyaTTS base (aynı koşul) | 27,22% | 9,44% | 20/20 | |
| | **Werea-TSS seçilen** | **29,11%** | **10,08%** | **20/20** | |
| | Agresif Stage-2 final (reddedildi) | 48,10% | 17,02% | 20/20 | |
|
|
| Agresif checkpoint kalite gerilemesi nedeniyle yayınlanmadı. Ayrıntılı ve |
| makinece okunabilir ölçümler `evaluation.json` dosyasındadır. |
|
|
| ## Kullanım |
|
|
| Önce FreyaTTS kaynak deposunun gereksinimlerini kurun: |
|
|
| ```bash |
| git clone https://github.com/freyavoiceai/FreyaTTS.git |
| cd FreyaTTS |
| pip install -r requirements.txt |
| ``` |
|
|
| ```python |
| from freyatts import FreyaTTS |
| |
| tts = FreyaTTS.from_pretrained("Werea-co/Werea-TSS", device="cuda") |
| wav = tts.synthesize( |
| "Merhaba, Werea deneyimine hoş geldiniz.", |
| steps=32, |
| seed=20260814, |
| ) |
| tts.save_wav(wav, "werea.wav") |
| ``` |
|
|
| Depodaki `freyatts/` klasörü, sabitlenmiş upstream committen alınan Apache-2.0 |
| çıkarım kodunu da içerir; Space dağıtımı bu kopyayı kullanır. |
|
|
| Werea ses kimliği için `seed=20260814` açıkça verilmelidir. Mevcut FreyaTTS |
| istemcisinin varsayılan tohumu farklıdır. |
|
|
| ## Amaçlanan kullanım |
|
|
| Türkçe organizasyon duyuruları, erişilebilirlik seslendirmeleri, prototip sesli |
| asistanlar ve açık araştırma. Model insan sesi taklit etmek veya bir kişinin |
| kimliğine bürünmek amacıyla tasarlanmamıştır. |
|
|
| ## Sınırlamalar |
|
|
| - Beta sürümdür; özel adlar, yabancı sözcükler ve çok uzun cümlelerde hata yapabilir. |
| - Duygusal kontrol ve referans-ses ile klonlama desteklenmez. |
| - Kritik duyurular yayımlanmadan önce insan tarafından dinlenmelidir. |
| - Sentetik ses olduğu kullanıcılara açıkça belirtilmelidir. |
|
|
| ## Lisans ve atıf |
|
|
| Kod ve ağırlıklar Apache License 2.0 altındadır. Taban model FreyaTTS-small, |
| decoder ise VoxCPM2 AudioVAE2'dir. Korunan atıflar ve değişiklik bildirimi için |
| `NOTICE` ve `LICENSE` dosyalarına bakın. |
|
|