抱歉,如果我的问题是如此垃圾,但我花了很多时间试图了解问题的原因,但我不能,所以在这里
我正在谷歌云 ML 上训练 tacotron 模型我之前在弗洛伊德集线器上训练过它,它非常快,所以我将我的项目配置为能够在谷歌 ML 上运行
这是我对我的项目所做的主要更改
原来的
with open(metadata_filename, encoding='utf-8') as f:
self._metadata = [line.strip().split('|') for line in f]
hours = sum((int(x[2]) for x in self._metadata)) * hparams.frame_shift_ms / (3600 * 1000)
log('Loaded metadata for %d examples (%.2f hours)' % (len(self._metadata), hours))
我的配置
with file_io.FileIO(metadata_filename, 'r') as f:
self._metadata = [line.strip().split('|') for line in f]
hours = sum((int(x[2]) for x in self._metadata)) * hparams.frame_shift_ms / (3600 * 1000)
log('Loaded metadata for %d examples (%.2f hours)' % (len(self._metadata), hours))
原来的
def _get_next_example(self):
'''Loads a single example (input, mel_target, linear_target, cost) from disk'''
if self._offset >= len(self._metadata):
self._offset = 0
random.shuffle(self._metadata)
meta = self._metadata[self._offset]
self._offset += 1
text = meta[3]
if self._cmudict and random.random() < _p_cmudict:
text = ' '.join([self._maybe_get_arpabet(word) for word in text.split(' ')])
input_data = np.asarray(text_to_sequence(text, self._cleaner_names), dtype=np.int32)
linear_target = np.load(os.path.join(self._datadir, meta[0]))
mel_target = np.load(os.path.join(self._datadir, meta[1]))
return (input_data, mel_target, linear_target, len(linear_target))
我的配置
def _get_next_example(self):
'''Loads a single example (input, mel_target, linear_target, cost) from disk'''
if self._offset >= len(self._metadata):
self._offset = 0
random.shuffle(self._metadata)
meta = self._metadata[self._offset]
self._offset += 1
text = meta[3]
if self._cmudict and random.random() < _p_cmudict:
text = ' '.join([self._maybe_get_arpabet(word) for word in text.split(' ')])
input_data = np.asarray(text_to_sequence(text, self._cleaner_names), dtype=np.int32)
f = BytesIO(file_io.read_file_to_string(
os.path.join(self._datadir, meta[0]),binary_mode=True))
linear_target = np.load(f)
s = BytesIO(file_io.read_file_to_string(
os.path.join(self._datadir, meta[1]),binary_mode = True))
mel_target = np.load(s)
return (input_data, mel_target, linear_target, len(linear_target))
这里有 2 个屏幕截图来显示 Google ML和FLoydhub的区别
这是我在谷歌 ML 中使用的训练命令,我使用 scale-tier=BASIC_GPU
gcloud ml-engine jobs submit training "$JOB_NAME" --stream-logs --module-name trainier.train --package-path trainier --staging-bucket "$BUCKET_NAME" --region "us-central1" --scale-tier=basic-gpu --config ~/gp-master/config.yaml --runtime-version=1.4 -- --base_dir "$BASEE_DIR" --input "$TRAIN_DATA"
所以我的问题是我是否做了一些可能导致读取数据缓慢的事情,或者谷歌云 ML 存在问题,我对此表示怀疑?