Isa0 commited on
Commit
c0c0c57
·
1 Parent(s): 2ae144c

change dataset id

Browse files
Files changed (1) hide show
  1. train.py +2 -2
train.py CHANGED
@@ -12,7 +12,7 @@ from transformers import (
12
  )
13
 
14
  MODEL_ID = "facebook/wav2vec2-base"
15
- DATASET_ID = "lj_speech"
16
 
17
 
18
  @dataclass
@@ -66,7 +66,7 @@ if __name__ == "__main__":
66
  tokenizer = AutoTokenizer.from_pretrained(MODEL_ID)
67
  processor = Wav2Vec2Processor.from_pretrained(MODEL_ID)
68
 
69
- dataset = load_dataset(DATASET_ID, split="train", trust_remote_code=True)
70
  dataset = dataset.train_test_split(test_size=0.05, seed=42)
71
 
72
  dataset = dataset.map(
 
12
  )
13
 
14
  MODEL_ID = "facebook/wav2vec2-base"
15
+ DATASET_ID = "keithito/lj_speech"
16
 
17
 
18
  @dataclass
 
66
  tokenizer = AutoTokenizer.from_pretrained(MODEL_ID)
67
  processor = Wav2Vec2Processor.from_pretrained(MODEL_ID)
68
 
69
+ dataset = load_dataset(DATASET_ID, split="train")
70
  dataset = dataset.train_test_split(test_size=0.05, seed=42)
71
 
72
  dataset = dataset.map(