pytorch 多GPU训练LSTM(RNN或GRU)

本文介绍了在PyTorch中进行多GPU训练LSTM模型的步骤,包括如何将模型放置在GPU上,利用nn.nn.DataParallel,以及处理LSTM初始隐藏状态的方法。在处理隐藏状态时,由于其维度需求,需要在forward中调整输入维度。训练过程中,还需确保将隐藏状态转换到CUDA设备。虽然描述较为简洁,但提供了关键思路。

首先模型需要放在GPU上,形如:

device = torch.device("cuda" if use_cuda else "cpu")
model = LSTM(args.timestep, args.batch_size, args.audio_window).to(device)

然后使用nn.nn.DataParallel,

model = nn.DataParallel(model,  device_ids=[0,1,2,3])

由于定义的lstm模型中存在如下类似的初始函数

    def init_hidden(self, batch_size, use_gpu=True):
        if use_gpu: return torch.zeros(1, batch_size, 256).cuda()
        else: return torch.zeros(1, batch_size, 256)

多卡训练时,使用网上的方法会出现各种问题,因此,直接将产生hidden的变量放在dataloader中,形如:

class RawDataset(data.Dataset):
    def __init__(self, raw_file, list_file, audio_window):
        """ raw_file: train-clean-100.h5
            list_file: list/training.txt
            audio_window: 20480
        """
        self.raw_file  = raw_file
        self.audio_window = audio_window
        self.utts =
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

IT远征军

谢谢各位鼓励

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值