安装CUDA后重启仍然失败:Failed to initialize NVML: Driver/library version mismatch after restart

Ubuntu安装CUDA后输入命令 nvidia-smi 报错:

Failed to initialize NVML: Driver/library version mismatch after restart

搜索引擎大部分结果是让你重启,或者不能重启的话卸载内核重新加载之类。但我试了一下不奏效,重启后还是一样的结果

找了半天原因之后终于知道了问题的关键,其实那一行错误已经提示得很明确了:内核和系统驱动不匹配。

输入命令 dmesg |grep NVRM ,结果如果提示kernel版本与driver版本不一致,就说明你遇到了和我一样的问题。

为什么会遇到这个问题呢?主要还是CUDA自己挖的坑,幸好我记了当时安装CUDA的日志:

Installing the NVIDIA display driver...
Installing the CUDA Toolkit in /home/ubuntu/software/cuda-9.0 ...
Missing recommended library: libXmu.so

Installing the CUDA Samples in /home/ubuntu/software ...
Copying samples to /home/boaoli/software/NVIDIA_CUDA-9.0_Samples now...
Finished copying samples.
...
...

看第一行,没错, C U D A 给 你 装 了 N V I D I A 驱 动 ! \color{red}{CUDA给你装了NVIDIA驱动!} CUDANVIDIA
我们在安装cuda的时候,它会问你

Install NVIDIA Accelerated Graphics Driver for Linux-x86_64 384.81?
(y)es/(n)o/(q)uit: y

如果你输入yes,CUDA就会自动给你装一个和你原先显卡kernel版本不同的驱动,从而导致nvidia-smi问题出现。

解决方法其实很简单,重装一下nvidia和显卡内核版本相同的显卡驱动,可以不用卸载cuda给你装的那个。
nvidia显卡驱动下载链接:

https://us.download.nvidia.com/XFree86/Linux-x86_64/384.130/NVIDIA-Linux-x86_64-384.130.run

由于一些老版本的驱动可能找不到,建议直接修改链接去下载(我的版本是384.130),把链接中的两个384.130改成你的版本即可。

安装nvidia驱动教程:链接。安装的时候可能需要加上 –no-x-check

安装好后 nvidia-smi 立刻奏效。

  • 7
    点赞
  • 13
    收藏
    觉得还不错? 一键收藏
  • 2
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值