服务器端的GPU使用

查看GPU信息

查看nvidia GPU信息：

# 输入指令

lspci | grep -i nvidia

# 结果如下：

# 04:00.0 3D controller: NVIDIA Corporation Device 1db4 (rev a1)

# 05:00.0 3D controller: NVIDIA Corporation Device 1db4 (rev a1)

# 08:00.0 3D controller: NVIDIA Corporation Device 1db4 (rev a1)

# 09:00.0 3D controller: NVIDIA Corporation Device 1db4 (rev a1)

# 84:00.0 3D controller: NVIDIA Corporation Device 1db4 (rev a1)

# 85:00.0 3D controller: NVIDIA Corporation Device 1db4 (rev a1)

# 88:00.0 3D controller: NVIDIA Corporation Device 1db4 (rev a1)

# 89:00.0 3D controller: NVIDIA Corporation Device 1db4 (rev a1)

输出结果04:00.0，可用于后续查看详细的信息

查看指定显卡的详细信息：

# 输入指令：

lspci -v -s 04:00.0

# 输出结果：

# 04:00.0 3D controller: NVIDIA Corporation Device 1db4 (rev a1)

# 	Subsystem: NVIDIA Corporation Device 1214

# 	Flags: bus master, fast devsel, latency 0, IRQ 26, NUMA node 0

# 	Memory at c4000000 (32-bit, non-prefetchable) [size=16M]

# 	Memory at 27800000000 (64-bit, prefetchable) [size=16G]

# 	Memory at 27c00000000 (64-bit, prefetchable) [size=32M]

# 	Capabilities: <access denied>

# 	Kernel driver in use: nvidia

# 	Kernel modules: nvidiafb, nouveau, nvidia_384_drm, nvidia_384

查看GPU的使用信息

nvidia-smi

其主要看Memory-Usage栏，避免使用了其他人已经占用了显卡
一般使用如下指令，周期性查看显卡的使用情况：
```
watch -n 10 nvidia-smi
```
每10s刷新一下显示

参考：Linux查看GPU信息和使用情况

指定GPU进行训练

在查看了GPU的信息后，在训练是指定空闲的GPU进行训练。

在终端执行时指定GPU

CUDA_VISIBLE_DEVICES=0 python3 ***.py  # 指定GPU集群中第一块GPU使用,其他的屏蔽掉

# CUDA_VISIBLE_DEVICES=1           Only device 1 will be seen

# CUDA_VISIBLE_DEVICES=0,1         Devices 0 and 1 will be visible

# CUDA_VISIBLE_DEVICES=""          No GPU will be visible

在配置文件头上指定GPU，此方法和上述方法类似，以下举个例子：
- 创建.sh文件；
- 通过chmod +x ***.sh给文件加入可执行的属性；
- 在文件中写入：
```
#! /bin/bash

CUDA_VISIBLE_DEVICES=1 \

python model_main.py \

        --model_dir=training/model \

        --pipeline_config_path=training/pipeline.config \

        --num_train_steps=25000
```
- 之后在执行时，通过bash ***.sh 运行即可。

在Python代码中指定

import os

os.environ["CUDA_VISIBLE_DEVICES"] = "0"  　#指定第一块gpu

在tensorflow中指定GPU的使用

# allow_soft_placement=True ： 如果你指定的设备不存在，允许TF自动分配设备

# log_device_placement=True : 是否打印设备分配日志

config = tf.ConfigProto(allow_soft_placement=True, log_device_placement=True)

# 限制GPU资源的使用：两者选其一即可

# 方式一：限制GPU使用率

config.gpu_options.per_process_gpu_memory_fraction = 0.4  #占用40%显存

# 方式二：动态申请显存

config.gpu_options.allow_growth = True

sess = tf.Session(config=config)

参考：

Linux查看GPU信息和使用情况

指定GPU进行训练

tensorflow中配置GPU使用

服务器端的GPU使用的更多相关文章

openGL 提升渲染性能之顶点数组 VBO IBO VAO
使用openGL图形库绘制,都需要通过openGL接口向图像显卡提交顶点数据,显卡根据提交的数据绘制出相应的图形. openGL绘制方式有:直接模式,显示列表,顶点数组,顶点索引. 直接模式:最简单, ...
TensorFlow从1到2（十五）（完结）在浏览器做机器学习
TensorFlow的Javascript版 TensorFlow一直努力扩展自己的基础平台环境,除了熟悉的Python,当前的TensorFlow还实现了支持Javascript/C++/Java/ ...
OpenStack 企业私有云的若干需求（1）：Nova 虚机支持 GPU
本系列会介绍OpenStack 企业私有云的几个需求: 自动扩展(Auto-scaling)支持多租户和租户隔离 (multi-tenancy and tenancy isolation) 混合云( ...
国内云计算的缺失环节: GPU并行计算（转）
[IT时代周刊编者按]云计算特有的优点和巨大的商业前景,让其成为了近年来的IT界最热门词汇之一.当然,这也与中国移动互联网的繁荣紧密相关,它们需要有相应的云计算服务作为支撑.但本文作者祁海江结合自身的 ...
Pycharm实现服务器端代码的远程调试
Pycharm是很多人在学习机器学习时的常用IDE.但是,当代码需要庞大计算资源的时候,我们往往需要借助远程服务器的GPU资源.很多人都是将代码拷贝到服务器,然后运行,但是当修改调试的时候,很不方便 ...
谈谈GPU与FPGA的一些看法
从几个方面来介绍一下GPU和FPGA. 从峰值性能来说,GPU(10Tflops)远远高于FPGA(<1TFlops).GPU上面成千上万个core同时跑在GHz的频率上还是非常壮观的,最新的G ...
OpenStack企业私有云新需求（1）：Nova 虚机支持 GPU
作者:Sammy Liu 刘世民本系列会介绍OpenStack 企业私有云的几个需求: GPU 支持自动扩展(Auto-scaling)支持混合云(Hybrid cloud)支持物理机(Bar ...
win7旗舰版+caffe+vs2013+matlab2014b(无GPU版)
参考网站: http://www.cnblogs.com/njust-ycc/p/5776286.html 无法找到gpu/mxGPUArray.h: No such file or director ...
ubuntu12.04通过Ganglia利用NVML模块进行GPU监控
1.安装Ganglia,这里安装的是3.1*版本,因为监控GPU的模块只支持3.1*版本系列的 apt-get install ganglia* 2.下载并安装PyNVML和NVML模块,下载地址ht ...

随机推荐

Smooth
考场\(AC\),还是很开心的. 考虑这题让你干啥,就是给你一堆素数,然后让你用他们去构造数,求其中第\(k\)小的. 我们可以用系数累乘的方式,同时利用小根堆实现有序,加一个优化,就过了 ...
Sentry Web 性能监控 - Metrics
系列 1 分钟快速使用 Docker 上手最新版 Sentry-CLI - 创建版本快速使用 Docker 上手 Sentry-CLI - 30 秒上手 Source Maps Sentry For ...
Identity简单授权
详情访问官方文档以下代码将访问权限限制为任何经过身份验证的用户,这里为控制器级 [Authorize] public class AccountController : Controller { p ...
学习反射例子，调用DLL窗体及方法
创建类库,并添加新窗体,加入以下方法 public static string setText(string str) { return str; } 编译后把生成的DLL文件放入新项目的bin目录, ...
远程线程注入DLL
远程线程注入 0x00 前言远程线程注入是一种经典的DLL注入技术.其实就是指一个新进程中另一个进程中创建线程的技术. 0x01 介绍 1.远程线程注入原理画了一个图大致理解了下远程线程注入dll ...
CommonsCollections2 反序列化利用链分析
在 ysoserial中 commons-collections2 是用的 PriorityQueue reaObject 作为反序列化的入口那么就来看一下 java.util.PriorityQu ...
python中时间处理标准库DateTime加强版库：pendulum
DateTime 的时区问题 Python的datetime可以处理2种类型的时间,分别为offset-naive和offset-aware.前者是指没有包含时区信息的时间,后者是指包含时区信息的时间 ...
linux命令(用户)
一.常用命令 1.1 ls ls 命令是 linux 下最常用的命令,ls 命令就是 list 的缩写. ls 用来打印出当前目录的清单.如果 ls 指定其他目录,那么就会显示指定目录里的文件及文件夹 ...
教你用ps如何将图片、文字做出模糊斑驳的作旧效果
1.对图片的图层执行滤镜-风格化-扩散,选变亮优先. 2.选择画笔工具,在画笔选项里选择喷溅59像素,画笔大小我用的是100px,大家可以根据自己的情况自定义大小,前景设置为黑色. 3.在图章图层上方 ...
openldap集成ssh 登录
一安装nslcd服务 yum install nss-pam-ldapd 二.修改vi /etc/nslcd.conf这个配置文件修改uri 和base的值改为你的ldap的地址和用户名三. ...

服务器端的GPU使用

服务器端的GPU使用

查看GPU信息

查看GPU的使用信息

指定GPU进行训练

参考：

服务器端的GPU使用的更多相关文章

随机推荐

热门专题