language:
- tr
license: apache-2.0
pipeline_tag: text-to-speech
library_name: freyatts
base_model: freyavoice/Freya-TTS
tags:
- text-to-speech
- tts
- turkish
- flow-matching
- synthetic-data
- werea
Werea-TSS 183M — Türkçe Metinden Sese
Werea-TSS, Werea organizasyonu için geliştirilmiş 183,2 milyon parametreli, Türkçe öncelikli bir metinden-sese modelidir. Model, Apache-2.0 lisanslı FreyaTTS-small ağırlıklarının tam-parametreli, korumacı bir fine-tune türevidir. Çıkış 48 kHz mono sestir.
Bu depo yalnızca bir arayüz değildir: model.safetensors, Werea eğitiminde
değiştirilmiş türetilmiş ağırlıkları içerir.
Mimari
- Tokenizer/G2P olmadan 92 karakterlik Türkçe sözlük
- 183,2M parametreli non-autoregressive flow-matching DiT
- 25 Hz × 64 boyutlu AudioVAE2 latent uzayı
- 32 adımlı Euler ODE örnekleme
- Dondurulmuş, Apache-2.0 lisanslı VoxCPM2 AudioVAE2 decoder
Werea ses kimliği ve veri kaynağı
İzinsiz gerçek kişi kaydı veya ses klonlama verisi kullanılmadı. Eğitim
metinleri Werea için özgün olarak üretildi. Öğretmen sesler, FreyaTTS-small
tabanından sabit 20260814 tohumu ile sentetik üretildi ve kaynak/seed bilgisi
manifestlerde tutuldu.
- Stage-1: 960 benzersiz Türkçe cümle, yaklaşık 1,19 saat
- Kısa-ifade denetimi: 312 ek kısa cümle
- Ayrılmış eval: eğitim metniyle sıfır çakışmalı 20 özgün Türkçe cümle
- Seçilen checkpoint:
conservative-step75(lr=2e-6, effective batch 8)
Değerlendirme
Ölçüm, faster-whisper-small ile Werea'nın 20 cümlelik ayrılmış eval setinde
yapıldı. Bu küçük iç değerlendirme, Freya'nın yayımladığı Freya-TR-Eval
sonuçlarıyla doğrudan karşılaştırılmamalıdır.
| Model | WER ↓ | CER ↓ | Geçerli ses |
|---|---|---|---|
| FreyaTTS base (aynı koşul) | 27,22% | 9,44% | 20/20 |
| Werea-TSS seçilen | 29,11% | 10,08% | 20/20 |
| Agresif Stage-2 final (reddedildi) | 48,10% | 17,02% | 20/20 |
Agresif checkpoint kalite gerilemesi nedeniyle yayınlanmadı. Ayrıntılı ve
makinece okunabilir ölçümler evaluation.json dosyasındadır.
Kullanım
Önce FreyaTTS kaynak deposunun gereksinimlerini kurun:
git clone https://github.com/freyavoiceai/FreyaTTS.git
cd FreyaTTS
pip install -r requirements.txt
from freyatts import FreyaTTS
tts = FreyaTTS.from_pretrained("Werea-co/Werea-TSS", device="cuda")
wav = tts.synthesize(
"Merhaba, Werea deneyimine hoş geldiniz.",
steps=32,
seed=20260814,
)
tts.save_wav(wav, "werea.wav")
Depodaki freyatts/ klasörü, sabitlenmiş upstream committen alınan Apache-2.0
çıkarım kodunu da içerir; Space dağıtımı bu kopyayı kullanır.
Werea ses kimliği için seed=20260814 açıkça verilmelidir. Mevcut FreyaTTS
istemcisinin varsayılan tohumu farklıdır.
Amaçlanan kullanım
Türkçe organizasyon duyuruları, erişilebilirlik seslendirmeleri, prototip sesli asistanlar ve açık araştırma. Model insan sesi taklit etmek veya bir kişinin kimliğine bürünmek amacıyla tasarlanmamıştır.
Sınırlamalar
- Beta sürümdür; özel adlar, yabancı sözcükler ve çok uzun cümlelerde hata yapabilir.
- Duygusal kontrol ve referans-ses ile klonlama desteklenmez.
- Kritik duyurular yayımlanmadan önce insan tarafından dinlenmelidir.
- Sentetik ses olduğu kullanıcılara açıkça belirtilmelidir.
Lisans ve atıf
Kod ve ağırlıklar Apache License 2.0 altındadır. Taban model FreyaTTS-small,
decoder ise VoxCPM2 AudioVAE2'dir. Korunan atıflar ve değişiklik bildirimi için
NOTICE ve LICENSE dosyalarına bakın.