Jeff Xie
myjeffxie
Β·
AI & ML interests
education, ai, bigdata
Organizations
T2V
Virtual
- RunningAgents2.81k
OutfitAnyone
π’2.81kGenerate virtual tryβon images for any model and clothing
-
Tann-dev/sex-chat-dirty-girlfriend
Text Generation β’ 7B β’ Updated β’ 66 β’ 49 -
baicai1145/GPT-SoVITS-STAR
Updated β’ 62 - Runtime errorAgents150
Multi Voice TTS(English/Chinese/Japanese)
π150[δΈζ/English/ζ₯ζ¬θͺ]multilingual text-to-speech
ASR
text-gen
audio_deepfake
-
facebook/wav2vec2-base-960h
Automatic Speech Recognition β’ 94.4M β’ Updated β’ 1.8M β’ 400 -
microsoft/wavlm-base
Feature Extraction β’ Updated β’ 38.8k β’ 11 -
microsoft/wavlm-large
Feature Extraction β’ Updated β’ 520k β’ 112 -
facebook/hubert-large-ls960-ft
Automatic Speech Recognition β’ Updated β’ 152k β’ 76
TTS
-
coqui/XTTS-v2
Text-to-Speech β’ Updated β’ 9.19M β’ 3.7k - Runtime errorAgents150
Multi Voice TTS(English/Chinese/Japanese)
π150[δΈζ/English/ζ₯ζ¬θͺ]multilingual text-to-speech
-
alphacep/vosk-tts-ru-gpt-sovits
Updated β’ 3 -
metavoiceio/metavoice-1B-v0.1
Text-to-Speech β’ Updated β’ 175 β’ 789
RAG
dataset
text_to_image
audio_deepfake
-
facebook/wav2vec2-base-960h
Automatic Speech Recognition β’ 94.4M β’ Updated β’ 1.8M β’ 400 -
microsoft/wavlm-base
Feature Extraction β’ Updated β’ 38.8k β’ 11 -
microsoft/wavlm-large
Feature Extraction β’ Updated β’ 520k β’ 112 -
facebook/hubert-large-ls960-ft
Automatic Speech Recognition β’ Updated β’ 152k β’ 76
T2V
TTS
-
coqui/XTTS-v2
Text-to-Speech β’ Updated β’ 9.19M β’ 3.7k - Runtime errorAgents150
Multi Voice TTS(English/Chinese/Japanese)
π150[δΈζ/English/ζ₯ζ¬θͺ]multilingual text-to-speech
-
alphacep/vosk-tts-ru-gpt-sovits
Updated β’ 3 -
metavoiceio/metavoice-1B-v0.1
Text-to-Speech β’ Updated β’ 175 β’ 789
Virtual
- RunningAgents2.81k
OutfitAnyone
π’2.81kGenerate virtual tryβon images for any model and clothing
-
Tann-dev/sex-chat-dirty-girlfriend
Text Generation β’ 7B β’ Updated β’ 66 β’ 49 -
baicai1145/GPT-SoVITS-STAR
Updated β’ 62 - Runtime errorAgents150
Multi Voice TTS(English/Chinese/Japanese)
π150[δΈζ/English/ζ₯ζ¬θͺ]multilingual text-to-speech
RAG
ASR
dataset
text-gen