Ubuntu 18.04, CUDA 10.0 编译安装tensorflow GPU版本

小编 2026-06-30 阅读:645 评论:0
显卡: GTX 1080 系统: Ubuntu 18.04   在尝试了多次在Windows下安装tensorflow GPU版本仍然不成功后,决定在Ubuntu系统上安装tensorflow GPU...

显卡: GTX 1080

系统: Ubuntu 18.04

 

在尝试了多次在Windows下安装tensorflow GPU版本仍然不成功后,决定在Ubuntu系统上安装tensorflow GPU版本。

 

安装的指导流程为: https://www.pytorials.com/how-to-install-tensorflow-gpu-with-cuda-10-0-for-python-on-ubuntu/

 

虽然最后证明哪条路都不好走,但是好歹还是在Linux上成功了,特此记录几个踩到的坑。

 

1. Ubuntu系统对显卡的支持

虽然Ubuntu系统在安装的时候就能够自动辨识Nvidia的显卡,但是18.04默认安装的显卡驱动是错误的。安装完就出现待机黑屏无法重新点亮的问题,如果不解决这个问题,会直接影响后续CUDA的成功安装。

 

1)使用nvidia-smi命令查看显卡是否正常工作,如果有错误信息,说明显卡驱动不对;

2) 在系统设置的detail中查看显卡的信息是否正确;

3)在Software&Updates中,更改显卡的驱动程序(先装系统检测到的390版本),设置UEFI硬件锁密码,在下次启动的时候,进入BIOS MOK设置;

 

2. 一些基础准备工作

1) 安装好中文输入法,方便查找问题;在安装了中文支持之后,需要重启一起,才能安装拼音输入法;

2) 使用sudo apt-get install python*方式安装python, pip等必要库;

sudo apt-get install python3-sklearn

在这个阶段,不推荐使用anaconda安装;

3) 配置好ubuntu以及pip的国内源,否则安装速度让人崩溃;

 

3. 安装CUDA及cuDNN

在Nvidia官网中,虽然有详细的教程,但是在安装过程中依然有问题:

1) 在Ubuntu 18.04版本下,Nvidia推荐CUDA 10.0;按照官网的流程安装完成后,重启,然后使用nvcc -V检查版本信息是否正确;第一次在没有解决显卡驱动的情况下,安装不成功;后来显卡问题解决后,CUDA的安装也正常了。

2)cuDNN的安装,官网的流程(deb文件安装),还需要把cuDNN.h以及libcudnn*.so文件拷到/usr/local/cuda-10.0/下相应的include(.h)和lib64(.so)文件夹下,并修改访问权限;

deb安装并没有自动把这些文件拷贝到正确的路径中;

官方安装教程:https://docs.nvidia.com/deeplearning/sdk/cudnn-install/index.html

还有测试的方法

3)NCCL库的安装,由于只有一个GPU,可以先不管(其实跟cuDNN是一个问题,deb安装后,没有把文件装到正确的路径中)

4)把CUDA ,cuDNN和NCCL的版本号记录下来,后面编译的时候需要使用;在本次安装中,分别为10.0和7.4.2;

 

4. 从源代码用bazel编译tensorflow GPU

现在tensforflow GPU的预编译文件(1.12版本)不支持CUDA 10.0,只支持CUDA 9.0;因此直接用pip install安装,会报错找不到.so文件。只能用bazel从源代码编译tensorflow,在windows环境下同样需要从源代码编译。

 

1)NCCL的配置时,用1.3,编译的时候会自动下载安装;

2)需要把python3和python2都安装,否则会报错;

3)同时安装pip和pip3时,发生了报错(__main__错误),可使用sudo python3 -m pip uninstall pip && sudo apt install python3 -pip –reinstall修复

4)记得在配置时选上GPU支持,否则就白折腾了。

 

5. 几个还不知道答案的问题

1)Ubuntu 18.04是否可以安装CUDA 9.0,然后直接用pip install?

2)NCCL库没有使用最新的版本,是否影响性能?

 

祝踩坑愉快!

版权声明

本文仅代表作者观点,不代表百度立场。
本文系作者授权百度百家发表,未经许可,不得转载。

热门文章
  • 机房智能化温湿度解决方式之POE供电以太网温湿度传感器

    机房智能化温湿度解决方式之POE供电以太网温湿度传感器
    机房智能化温湿度解决方式之POE供电以太网温湿度传感器 北京盈创力和电子科技有限公司 智能型TCP网口温湿度记录仪 北京IP网络温湿度记录仪厂家,北京盈创力和 北京智能型TCP网口温湿度记录仪IP网络温湿度记录仪是一种新型的基于TCP/IP协议双绞线以太网标准温湿度采集模块,利用它可以实现现场温度值、相对湿度值的采集,同时利用其自身的RJ45通信接口可以方便地和机房监控主机或交换机集线器进行联网。 工作于-40℃~85℃工业级带...
  • Sequential Monte Carlo Methods (SMC) 序列蒙特卡洛/粒子滤波/Bootstrap Filtering

    Sequential Monte Carlo Methods (SMC) 序列蒙特卡洛/粒子滤波/Bootstrap Filtering
    Problem Statement 我们考虑一个具有马尔可夫性质、非线性、非高斯的状态空间模型(State Space Model):对于一个时间序列上的观测结果{yt,t∈N}\\{ y_t , t \\in N \\}{yt​,t∈N},我们认为每个观测结果yty_tyt​的生成依赖于一个无法直接观察的隐变量xt∈{xt,t∈N}x_t \\in \\{x_t , t \\in N \\}xt​∈{xt​,t∈N},即:p(...
  • HTTP状态保持的原理

    HTTP状态保持的原理
    a)在用户登录之后,浏览器返回响应的时候会在响应中添加上cookieb)浏览器接收到cookie之后会自动保存c)当用户再次请求同一服务器中的其他网页的时候,浏览器会自动带上之前保存的cookied)服务接收到请求之后可以请 request 对象中取到cookie 判断当前用户是否登录  Http是无状态的,就是连接时数据互通,关闭后...
  • Hive 系统函数及示例

    Hive 系统函数及示例
    查看所有系统函数 show functions; 函数分类 内置函数【系统函数】 数学函数: floor、round、ceil、cos、log2等 字符串函数: length、reverse、trim、lower、get_json_object、repeat等 收集函数: size 转换函数: cast 日期函数: year、month、datediff、date、date_add等 条件函数: coalesce、case…w...
  • CSRF的原理和防范措施

    CSRF的原理和防范措施
    a)攻击原理:i.用户C访问正常网站A时进行登录,浏览器保存A的cookieii.用户C再访问攻击网站B,网站B上有某个隐藏的链接或者图片标签会自动请求网站A的URL地址,例如表单提交,传指定的参数iii.而攻击网站B在访问网站A的时候,浏览器会自动带上网站A的cookieiv.所以网站A在接收到请求之后可判断当前用户是登录状态,所以...
标签列表