首先模型需要放在GPU上,形如:
device = torch.device("cuda" if use_cuda else "cpu")
model = LSTM(args.timestep, args.batch_size, args.audio_window).to(device)
然后使用nn.nn.DataParallel,
model = nn.DataParallel(model, device_ids=[0,1,2,3])
由于定义的lstm模型中存在如下类似的初始函数
def init_hidden(self, batch_size, use_gpu=True):
if use_gpu: return torch.zeros(1, batch_size, 256).cuda()
else: return torch.zeros(1, batch_size, 256)
多卡训练时,使用网上的方法会出现各种问题,因此,直接将产生hidden的变量放在dataloader中,形如:
class RawDataset(data.Dataset):
def __init__(self, raw_file, list_file, audio_window):
""" raw_file: train-clean-100.h5
list_file: list/training.txt
audio_window: 20480
"""
self.raw_file = raw_file
self.audio_window = audio_window
self.utts =

本文介绍了在PyTorch中进行多GPU训练LSTM模型的步骤,包括如何将模型放置在GPU上,利用nn.nn.DataParallel,以及处理LSTM初始隐藏状态的方法。在处理隐藏状态时,由于其维度需求,需要在forward中调整输入维度。训练过程中,还需确保将隐藏状态转换到CUDA设备。虽然描述较为简洁,但提供了关键思路。
&spm=1001.2101.3001.5002&articleId=106571007&d=1&t=3&u=53ca6c2a187042cfa91f9d3caca605d4)
1279

被折叠的 条评论
为什么被折叠?



