Upload app.py
Browse files
app.py
CHANGED
|
@@ -55,8 +55,9 @@ if ASR_LANGUAGE not in {"ky", "ru", "auto"}:
|
|
| 55 |
)
|
| 56 |
ASR_LANGUAGE = "auto"
|
| 57 |
|
| 58 |
-
#
|
| 59 |
-
#
|
|
|
|
| 60 |
logging.info("ASR тили: %s", ASR_LANGUAGE)
|
| 61 |
logging.info("Аудио фильтр: %s", "custom" if AUDIO_FILTER else AUDIO_FILTER_PRESET)
|
| 62 |
|
|
@@ -230,7 +231,7 @@ def build_generate_kwargs() -> dict[str, Any]:
|
|
| 230 |
"no_speech_threshold": 0.6,
|
| 231 |
}
|
| 232 |
|
| 233 |
-
if ASR_LANGUAGE
|
| 234 |
generate_kwargs["language"] = ASR_LANGUAGE
|
| 235 |
|
| 236 |
return generate_kwargs
|
|
|
|
| 55 |
)
|
| 56 |
ASR_LANGUAGE = "auto"
|
| 57 |
|
| 58 |
+
# Whisper does not have an official Kyrgyz language token, so ASR_LANGUAGE="ky"
|
| 59 |
+
# uses the Kyrgyz fine-tuned model without passing a language kwarg. "auto" may
|
| 60 |
+
# work better when Kyrgyz and Russian are mixed in one recording.
|
| 61 |
logging.info("ASR тили: %s", ASR_LANGUAGE)
|
| 62 |
logging.info("Аудио фильтр: %s", "custom" if AUDIO_FILTER else AUDIO_FILTER_PRESET)
|
| 63 |
|
|
|
|
| 231 |
"no_speech_threshold": 0.6,
|
| 232 |
}
|
| 233 |
|
| 234 |
+
if ASR_LANGUAGE == "ru":
|
| 235 |
generate_kwargs["language"] = ASR_LANGUAGE
|
| 236 |
|
| 237 |
return generate_kwargs
|