diff --git a/datasets/TTSDataset.py b/datasets/TTSDataset.py index 6722b510..03eabc71 100644 --- a/datasets/TTSDataset.py +++ b/datasets/TTSDataset.py @@ -89,7 +89,7 @@ class MyDataset(Dataset): file_name = os.path.basename(wav_file).split('.')[0] tmp_path = os.path.join("tmp/",file_name+'_phoneme.npy') if os.path.isfile(tmp_path): - text = np.load(tmp_path) + text = np.load(tmp_path, dtype=np.int32) else: text = np.asarray( phoneme_to_sequence(text, [self.cleaners]), dtype=np.int32) diff --git a/utils/text/__init__.py b/utils/text/__init__.py index dce66c94..80ac3274 100644 --- a/utils/text/__init__.py +++ b/utils/text/__init__.py @@ -75,6 +75,7 @@ def phoneme_to_sequence(text, cleaner_names): clean_text = _clean_text(text, cleaner_names) for word in clean_text.split(): phonemes_text = text2phone(word) + print(word, ' -- ', phonemes_text) if phonemes_text == None: print("!! After phoneme conversion the result is None. -- {} ".format(word)) continue