--- language: - tr license: apache-2.0 pipeline_tag: text-to-speech library_name: freyatts base_model: freyavoice/Freya-TTS tags: - text-to-speech - tts - turkish - flow-matching - synthetic-data - werea --- # Werea-TSS 183M — Türkçe Metinden Sese Werea-TSS, Werea organizasyonu için geliştirilmiş 183,2 milyon parametreli, Türkçe öncelikli bir metinden-sese modelidir. Model, Apache-2.0 lisanslı [FreyaTTS-small](https://huggingface.co/freyavoice/Freya-TTS) ağırlıklarının tam-parametreli, korumacı bir fine-tune türevidir. Çıkış 48 kHz mono sestir. Bu depo yalnızca bir arayüz değildir: `model.safetensors`, Werea eğitiminde değiştirilmiş türetilmiş ağırlıkları içerir. 🎧 [Werea-TSS örnek WAV dosyası](./werea_sample.wav) ## Mimari - Tokenizer/G2P olmadan 92 karakterlik Türkçe sözlük - 183,2M parametreli non-autoregressive flow-matching DiT - 25 Hz × 64 boyutlu AudioVAE2 latent uzayı - 32 adımlı Euler ODE örnekleme - Dondurulmuş, Apache-2.0 lisanslı VoxCPM2 AudioVAE2 decoder ## Werea ses kimliği ve veri kaynağı İzinsiz gerçek kişi kaydı veya ses klonlama verisi kullanılmadı. Eğitim metinleri Werea için özgün olarak üretildi. Öğretmen sesler, FreyaTTS-small tabanından sabit `20260814` tohumu ile sentetik üretildi ve kaynak/seed bilgisi manifestlerde tutuldu. - Stage-1: 960 benzersiz Türkçe cümle, yaklaşık 1,19 saat - Kısa-ifade denetimi: 312 ek kısa cümle - Ayrılmış eval: eğitim metniyle sıfır çakışmalı 20 özgün Türkçe cümle - Seçilen checkpoint: `conservative-step75` (`lr=2e-6`, effective batch 8) ## Değerlendirme Ölçüm, `faster-whisper-small` ile Werea'nın 20 cümlelik ayrılmış eval setinde yapıldı. Bu küçük iç değerlendirme, Freya'nın yayımladığı Freya-TR-Eval sonuçlarıyla doğrudan karşılaştırılmamalıdır. | Model | WER ↓ | CER ↓ | Geçerli ses | |---|---:|---:|---:| | FreyaTTS base (aynı koşul) | 27,22% | 9,44% | 20/20 | | **Werea-TSS seçilen** | **29,11%** | **10,08%** | **20/20** | | Agresif Stage-2 final (reddedildi) | 48,10% | 17,02% | 20/20 | Agresif checkpoint kalite gerilemesi nedeniyle yayınlanmadı. Ayrıntılı ve makinece okunabilir ölçümler `evaluation.json` dosyasındadır. ## Kullanım Önce FreyaTTS kaynak deposunun gereksinimlerini kurun: ```bash git clone https://github.com/freyavoiceai/FreyaTTS.git cd FreyaTTS pip install -r requirements.txt ``` ```python from freyatts import FreyaTTS tts = FreyaTTS.from_pretrained("Werea-co/Werea-TSS", device="cuda") wav = tts.synthesize( "Merhaba, Werea deneyimine hoş geldiniz.", steps=32, seed=20260814, ) tts.save_wav(wav, "werea.wav") ``` Depodaki `freyatts/` klasörü, sabitlenmiş upstream committen alınan Apache-2.0 çıkarım kodunu da içerir; Space dağıtımı bu kopyayı kullanır. Werea ses kimliği için `seed=20260814` açıkça verilmelidir. Mevcut FreyaTTS istemcisinin varsayılan tohumu farklıdır. ## Amaçlanan kullanım Türkçe organizasyon duyuruları, erişilebilirlik seslendirmeleri, prototip sesli asistanlar ve açık araştırma. Model insan sesi taklit etmek veya bir kişinin kimliğine bürünmek amacıyla tasarlanmamıştır. ## Sınırlamalar - Beta sürümdür; özel adlar, yabancı sözcükler ve çok uzun cümlelerde hata yapabilir. - Duygusal kontrol ve referans-ses ile klonlama desteklenmez. - Kritik duyurular yayımlanmadan önce insan tarafından dinlenmelidir. - Sentetik ses olduğu kullanıcılara açıkça belirtilmelidir. ## Lisans ve atıf Kod ve ağırlıklar Apache License 2.0 altındadır. Taban model FreyaTTS-small, decoder ise VoxCPM2 AudioVAE2'dir. Korunan atıflar ve değişiklik bildirimi için `NOTICE` ve `LICENSE` dosyalarına bakın.