enable loading precomputed vocoder dataset

This commit is contained in:
erogol
2020-06-15 19:04:05 +02:00
parent 9e71d4d66d
commit 28ee6af06c
3 changed files with 42 additions and 8 deletions
+21
View File
@@ -1,5 +1,6 @@
import glob
import os
from pathlib import Path
import numpy as np
@@ -9,8 +10,28 @@ def find_wav_files(data_path):
return wav_paths
def find_feat_files(data_path):
feat_paths = glob.glob(os.path.join(data_path, '**', '*.npy'), recursive=True)
return feat_paths
def load_wav_data(data_path, eval_split_size):
wav_paths = find_wav_files(data_path)
np.random.seed(0)
np.random.shuffle(wav_paths)
return wav_paths[:eval_split_size], wav_paths[eval_split_size:]
def load_wav_feat_data(data_path, feat_path, eval_split_size):
wav_paths = sorted(find_wav_files(data_path))
feat_paths = sorted(find_feat_files(feat_path))
assert len(wav_paths) == len(feat_paths)
for wav, feat in zip(wav_paths, feat_paths):
wav_name = Path(wav).stem
feat_name = Path(feat).stem
assert wav_name == feat_name
items = list(zip(wav_paths, feat_paths))
np.random.seed(0)
np.random.shuffle(items)
return items[:eval_split_size], items[eval_split_size:]