Update README.md
Browse files
README.md
CHANGED
|
@@ -23,14 +23,14 @@ pipeline_tag: automatic-speech-recognition
|
|
| 23 |
|
| 24 |
# SOTA Uzbek STT v1 — Low Volume & Multilingual Fine-tuned
|
| 25 |
|
| 26 |
-
**Ishlab chiqaruvchi:**
|
| 27 |
## Model haqida
|
| 28 |
|
| 29 |
Base model umumiy holatlarda yaxshi ishlaydi, lekin past ovozda (shivirlashga yaqin, xonadan uzoqdan yozilgan) nutqni tanishda xatoliklar ko'proq edi. Shu muammoni hal qilish uchun model qo'shimcha ma'lumot bilan qayta o'qitildi.
|
| 30 |
|
| 31 |
Whisper me'morchiligining tabiiy ko'p tillilik xususiyati tufayli, model faqat o'zbekcha emas — **o'zbek, ingliz va rus tillarida, hattoki bir gap ichida tillar aralashib kelganda ham** (code-switching, masalan "keyin meeting'da discuss qilamiz", "hisobotni project bo'yicha tayyorladim") nutqni ishonchli tarzda matnga aylantira oladi.
|
| 32 |
|
| 33 |
-
- **Ishlab chiqaruvchi:**
|
| 34 |
- **Tillar:** O'zbek (uz), Ingliz (en), Rus (ru) — shu jumladan tillar aralash holatda
|
| 35 |
- **Vazifa:** Automatic Speech Recognition (ASR) / Speech-to-Text (STT)
|
| 36 |
- **Litsenziya:** MIT
|
|
|
|
| 23 |
|
| 24 |
# SOTA Uzbek STT v1 — Low Volume & Multilingual Fine-tuned
|
| 25 |
|
| 26 |
+
**Ishlab chiqaruvchi:** BaseLayer
|
| 27 |
## Model haqida
|
| 28 |
|
| 29 |
Base model umumiy holatlarda yaxshi ishlaydi, lekin past ovozda (shivirlashga yaqin, xonadan uzoqdan yozilgan) nutqni tanishda xatoliklar ko'proq edi. Shu muammoni hal qilish uchun model qo'shimcha ma'lumot bilan qayta o'qitildi.
|
| 30 |
|
| 31 |
Whisper me'morchiligining tabiiy ko'p tillilik xususiyati tufayli, model faqat o'zbekcha emas — **o'zbek, ingliz va rus tillarida, hattoki bir gap ichida tillar aralashib kelganda ham** (code-switching, masalan "keyin meeting'da discuss qilamiz", "hisobotni project bo'yicha tayyorladim") nutqni ishonchli tarzda matnga aylantira oladi.
|
| 32 |
|
| 33 |
+
- **Ishlab chiqaruvchi:** BaseLayer
|
| 34 |
- **Tillar:** O'zbek (uz), Ingliz (en), Rus (ru) — shu jumladan tillar aralash holatda
|
| 35 |
- **Vazifa:** Automatic Speech Recognition (ASR) / Speech-to-Text (STT)
|
| 36 |
- **Litsenziya:** MIT
|