19赞

pytorch查看torch.Tensor和model是否在CUDA上的实例

作者：手机用户2502851955 | 2021-12-11 20:40

今天小编就为大家分享一篇pytorch查看torch.Tensor和model是否在CUDA上的实例，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧

今天训练faster R-CNN时，发现之前跑的很好的程序（是指在运行程序过程中，显卡利用率能够一直维持在70%以上），今天看的时候，显卡利用率很低，所以在想是不是我的训练数据torch.Tensor或者模型model没有加载到GPU上训练，于是查找如何查看tensor和model所在设备的命令。

import torch
import torchvision.models as models
model=models.vgg11(pretrained=False)
print(next(model.parameters()).is_cuda)#False

data=torch.ones((5,10))
print(data.device)#cpu

上述是我在自己的笔记本上（显然没有GPU）的打印情况。

上次被老板教授了好久，出现西安卡利用率一直很低的情况千万不能认为它不是问题，而一定要想办法解决。比如可以在加载训练图像的过程中（__getitem__方法中）设定数据增强过程中每个步骤的时间点，对每个步骤的时间点进行打印，判断花费时间较多的是哪些步骤，然后尝试对代码进行优化，因为torhc.utils.data中的__getitem__方法是由CPU上的一个num_workers执行一遍的，如果__getitem__方法执行太慢，则会导致IO速度变慢，即GPU在大多数时间都处于等待CPU读取数据并处理成torch.cuda.tensor的过程，一旦CPU读取一个batch size的数据完毕，GPU很快就计算结束，从而看到的现象是：GPU在绝大多数时间都处于利用率很低的状态。

所以我总结的是，如果GPU显卡利用率比较低，最可能的就是CPU数据IO耗费时间太多（我之前就是由于数据增强的裁剪过程为了裁剪到object使用了for循环，导致这一操作很耗时间），还有可能的原因是数据tensor或者模型model根本就没有加载到GPU cuda上面。其实还有一种可能性很小的原因就是，在网络前向传播的过程中某些特殊的操作对GPU的利用率不高，当然指的是除了网络（卷积，全连接）操作之外的其他的对于tensor的操作，比如我之前的faster R-CNN显卡利用率低就是因为RPN中的NMS算法速度太慢，大约2-3秒一张图，虽然这时候tensor特征图在CUDA上面，而且NMS也使用了CUDA kernel编译后的代码，也就是说NMS的计算仍然是利用的CPU，但是由于NMS算法并行度不高，所以对于GPU的利用不多，导致了显卡利用率低，之前那个是怎么解决的呢？

哈哈，说到底还是环境的问题非常重要，之前的faster R-CNN代码在python2 CUDA9.0 pytorch 0.4.0 环境下编译成功我就没有再仔细纠结环境问题，直接运行了，直到后来偶然换成python3 CUDA9.0 pytorch 0.4.1 环境才极大地提高了显卡利用率，并且通过设置了几十个打印时间点之后发现，真的就是NMS的速度现在基本能维持在0.02-0.2数量级范围内。

下图分别表示之前（显卡利用率很低）时的NMS处理单张图像所消耗的时间（之所以会有长有短是因为我支持不同分辨率的图像训练），后面一张图是GPU利用率一直能维持在很高的情况下NMS处理时间，由于数据增强部分的代码完全没有修改，故而换了环境之后我就没有再打印数据增强每个步骤所消耗的时间了。

以上这篇pytorch查看torch.Tensor和model是否在CUDA上的实例就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持。

推荐阅读

程序员
使用Sumiif（）合并单元格的条件总和

如何解决《使用Sumiif（）合并单元格的条件总和》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何从AWS Lambda函数查询第三方JSON API

如何解决《如何从AWSLambda函数查询第三方JSONAPI》经验，为你挑选了1个好方法。 ... [详细]
程序员
可选的Promise API

如何解决《可选的PromiseAPI》经验，为你挑选了1个好方法。 ... [详细]
程序员
Angularjs何时何地绑定事件

如何解决《Angularjs何时何地绑定事件》经验，为你挑选了1个好方法。 ... [详细]
程序员
在JavaScript事件回调中绑定"this"的正确方法？

如何解决《在JavaScript事件回调中绑定"this"的正确方法？》经验，为你挑选了1个好方法。 ... [详细]
程序员
在Robolectric中测试文件创建

如何解决《在Robolectric中测试文件创建》经验，为你挑选了0个好方法。 ... [详细]
程序员
RuntimeError:针对API版本a编译的模块,但是这个版本的numpy在ubuntu中是9

如何解决《RuntimeError:针对API版本a编译的模块,但是这个版本的numpy在ubuntu中是9》经验，为你挑选了0个好方法。 ... [详细]
程序员
将angular指令添加到rails中的simple_form会破坏集合输入的选定选项

如何解决《将angular指令添加到rails中的simple_form会破坏集合输入的选定选项》经验，为你挑选了0个好方法。 ... [详细]
程序员
删除列表项单词后面的逗号

如何解决《删除列表项单词后面的逗号》经验，为你挑选了1个好方法。 ... [详细]
程序员
有谁真的知道如何解决这些错误？

如何解决《有谁真的知道如何解决这些错误？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Maven版本插件：更新插件

如何解决《Maven版本插件：更新插件》经验，为你挑选了0个好方法。 ... [详细]
程序员
lsof打印数字端口

如何解决《lsof打印数字端口》经验，为你挑选了1个好方法。 ... [详细]
程序员
打字稿类型转换不起作用

如何解决《打字稿类型转换不起作用》经验，为你挑选了2个好方法。 ... [详细]
程序员
解释PlayFramework 2中的测试工具之间的差异(WithApplication,WithServer,WithBrowser,InMemory等...)

如何解决《解释PlayFramework2中的测试工具之间的差异(WithApplication,WithServer,WithBrowser,InMemory等)》经验，为你挑选了1个好方法。 ... [详细]
程序员
如果它们具有相同的名称并且我无法修改其他文件,如何在其他C文件中使用具有相同名称的多个函数？

如何解决《如果它们具有相同的名称并且我无法修改其他文件,如何在其他C文件中使用具有相同名称的多个函数？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Google Apps脚本，选择一个工作表

如何解决《GoogleApps脚本，选择一个工作表》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何快速查找本地计算机名称？

如何解决《如何快速查找本地计算机名称？》经验，为你挑选了1个好方法。 ... [详细]
程序员
iOS检测类是Objective-C还是Swift

如何解决《iOS检测类是Objective-C还是Swift》经验，为你挑选了1个好方法。 ... [详细]
程序员
一旦点击,如何防止JCheckBoxMenuItem关闭？

如何解决《一旦点击,如何防止JCheckBoxMenuItem关闭？》经验，为你挑选了1个好方法。 ... [详细]
程序员
将Angular和localForage与webpack一起使用

如何解决《将Angular和localForage与webpack一起使用》经验，为你挑选了1个好方法。 ... [详细]

手机用户2502851955

这个屌丝很懒，什么也没留下！

关注作者

Tags | 热门标签

RankList | 热门文章