pytorch多GPU的正确使用方式

假如你有多个GPU(>2),此处假设你有8块,并且前4块已经使用了,那么怎么才能从第5块开始用呢?
常见错误:

    raise AssertionError("Invalid device id")
AssertionError: Invalid device id
THCudaCheck FAIL file=..\torch\csrc\cuda\Module.cpp line=59 error=101 : invalid
device ordinal
Traceback (most recent call last):
  File "train2.py", line 26, in <module>
    torch.cuda.set_device(4)
  File "C:\ProgramData\Anaconda3\lib\site-packages\torch\cuda\__init__.py", line
 281, in set_device
    torch._C._cuda_setDevice(device)
RuntimeError: cuda runtime error (101) : invalid device ordinal at ..\torch\csrc
\cuda\Module.cpp:59

解决方法:
我们知道GPU的编号是从0开始的,这8块的编号就是0,1,2,3,4,5,6,7
现在要从4开始使用,只用4和5
1.在你的训练脚本import 结束的时候放下面两句:

torch.cuda.set_device(4)  #指定主显卡,不指定不行,默认是0,但是0被占用了
os.environ["CUDA_VISIBLE_DEVICES"] = "4,5"

2.脚本里面需要放:

device = torch.device("cuda:4" if torch.cuda.is_available() else "cpu")

3.还需要改:

self.net = torch.nn.DataParallel(self.net, device_ids=[4,5])
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

如雾如电

随缘

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值