pytorch中的model=model.to(device)使用说明


Posted in Python onMay 24, 2021

这代表将模型加载到指定设备上。

其中,device=torch.device("cpu")代表的使用cpu,而device=torch.device("cuda")则代表的使用GPU。

当我们指定了设备之后,就需要将模型加载到相应设备中,此时需要使用model=model.to(device),将模型加载到相应的设备中。

将由GPU保存的模型加载到CPU上。

将torch.load()函数中的map_location参数设置为torch.device('cpu')

device = torch.device('cpu')
model = TheModelClass(*args, **kwargs)
model.load_state_dict(torch.load(PATH, map_location=device))

将由GPU保存的模型加载到GPU上。确保对输入的tensors调用input = input.to(device)方法。

device = torch.device("cuda")
model = TheModelClass(*args, **kwargs)
model.load_state_dict(torch.load(PATH))
model.to(device)

将由CPU保存的模型加载到GPU上。

确保对输入的tensors调用input = input.to(device)方法。map_location是将模型加载到GPU上,model.to(torch.device('cuda'))是将模型参数加载为CUDA的tensor。

最后保证使用.to(torch.device('cuda'))方法将需要使用的参数放入CUDA。

device = torch.device("cuda")
model = TheModelClass(*args, **kwargs)
model.load_state_dict(torch.load(PATH, map_location="cuda:0"))  # Choose whatever GPU device number you want
model.to(device)

补充:pytorch中model.to(device)和map_location=device的区别

一、简介

在已训练并保存在CPU上的GPU上加载模型时,加载模型时经常由于训练和保存模型时设备不同出现读取模型时出现错误,在对跨设备的模型读取时候涉及到两个参数的使用,分别是model.to(device)和map_location=devicel两个参数,简介一下两者的不同。

将map_location函数中的参数设置 torch.load()为 cuda:device_id。这会将模型加载到给定的GPU设备。

调用model.to(torch.device('cuda'))将模型的参数张量转换为CUDA张量,无论在cpu上训练还是gpu上训练,保存的模型参数都是参数张量不是cuda张量,因此,cpu设备上不需要使用torch.to(torch.device("cpu"))。

二、实例

了解了两者代表的意义,以下介绍两者的使用。

1、保存在GPU上,在CPU上加载

保存:

torch.save(model.state_dict(), PATH)

加载:

device = torch.device('cpu')
model = TheModelClass(*args, **kwargs)
model.load_state_dict(torch.load(PATH, map_location=device))

解释:

在使用GPU训练的CPU上加载模型时,请传递 torch.device('cpu')给map_location函数中的 torch.load()参数,使用map_location参数将张量下面的存储器动态地重新映射到CPU设备 。

2、保存在GPU上,在GPU上加载

保存:

torch.save(model.state_dict(), PATH)

加载:

device = torch.device("cuda")
model = TheModelClass(*args, **kwargs)
model.load_state_dict(torch.load(PATH))
model.to(device)
# Make sure to call input = input.to(device) on any input tensors that you feed to the model

解释:

在GPU上训练并保存在GPU上的模型时,只需将初始化model模型转换为CUDA优化模型即可model.to(torch.device('cuda'))。

此外,请务必.to(torch.device('cuda'))在所有模型输入上使用该 功能来准备模型的数据。

请注意,调用my_tensor.to(device) 返回my_tensorGPU上的新副本。

它不会覆盖 my_tensor。

因此,请记住手动覆盖张量: my_tensor = my_tensor.to(torch.device('cuda'))

3、保存在CPU,在GPU上加载

保存:

torch.save(model.state_dict(), PATH)

加载:

device = torch.device("cuda")
model = TheModelClass(*args, **kwargs)
model.load_state_dict(torch.load(PATH, map_location="cuda:0"))  # Choose whatever GPU device number you want
model.to(device)
# Make sure to call input = input.to(device) on any input tensors that you feed to the model

解释:

在已训练并保存在CPU上的GPU上加载模型时,请将map_location函数中的参数设置 torch.load()为 cuda:device_id。

这会将模型加载到给定的GPU设备。

接下来,请务必调用model.to(torch.device('cuda'))将模型的参数张量转换为CUDA张量。

最后,确保.to(torch.device('cuda'))在所有模型输入上使用该 函数来为CUDA优化模型准备数据。

请注意,调用 my_tensor.to(device)返回my_tensorGPU上的新副本。

它不会覆盖my_tensor。

因此,请记住手动覆盖张量:my_tensor = my_tensor.to(torch.device('cuda'))

以上为个人经验,希望能给大家一个参考,也希望大家多多支持三水点靠木。

Python 相关文章推荐
python使用urllib模块开发的多线程豆瓣小站mp3下载器
Jan 16 Python
Python中使用dom模块生成XML文件示例
Apr 05 Python
python通过函数属性实现全局变量的方法
May 16 Python
Apache如何部署django项目
May 21 Python
浅谈配置OpenCV3 + Python3的简易方法(macOS)
Apr 02 Python
利用ctypes获取numpy数组的指针方法
Feb 12 Python
Python数据分析模块pandas用法详解
Sep 04 Python
python同义词替换的实现(jieba分词)
Jan 21 Python
Python 实现使用空值进行赋值 None
Mar 12 Python
python+requests接口自动化框架的实现
Aug 31 Python
只用50行Python代码爬取网络美女高清图片
Jun 02 Python
python和Appium的移动端多设备自动化测试框架
Apr 26 Python
解决pytorch-gpu 安装失败的记录
May 24 #Python
如何解决.cuda()加载用时很长的问题
一劳永逸彻底解决pip install慢的办法
May 24 #Python
Django实现翻页的示例代码
May 24 #Python
pytorch--之halfTensor的使用详解
pandas DataFrame.shift()函数的具体使用
May 24 #Python
教你怎么用python实现字符串转日期
May 24 #Python
You might like
法兰绒滤网冲泡
2021/03/03 冲泡冲煮
PHP学习之正则表达式
2011/04/17 PHP
php过滤XSS攻击的函数
2013/11/12 PHP
Thinkphp的volist标签嵌套循环使用教程
2014/07/08 PHP
在Thinkphp中使用ajax实现无刷新分页的方法
2016/10/25 PHP
PHP实现数组根据某个字段进行水平合并,横向合并案例分析
2019/10/08 PHP
jquery 表单下所有元素的隐藏
2009/07/25 Javascript
jquery获取下拉列表的值为null的解决方法
2011/03/18 Javascript
jQuery 在光标定位的地方插入文字的插件
2012/05/10 Javascript
javascript数组快速打乱重排的方法
2014/01/02 Javascript
一个非常全面的javascript URL解析函数和分段URL解析方法
2014/04/12 Javascript
extjs每个组件要设置唯一的ID否则会出错
2014/06/15 Javascript
javascript面向对象之共享成员属性与方法及prototype关键字用法
2015/01/13 Javascript
jQuery给多个不同元素添加class样式的方法
2015/03/26 Javascript
教你如何终止JQUERY的$.AJAX请求
2016/02/23 Javascript
react-router4 嵌套路由的使用方法
2017/07/24 Javascript
Node.js进阶之核心模块https入门
2018/05/23 Javascript
利用hasOwnProperty给数组去重的面试题分享
2018/11/05 Javascript
微信小程序 子级页面返回父级并把子级参数带回父级实现方法
2019/08/22 Javascript
[04:02]DOTA2上海特锦赛小组赛第二日recap精彩回顾
2016/02/28 DOTA
[46:23]完美世界DOTA2联赛PWL S2 FTD vs Magma 第一场 11.20
2020/11/23 DOTA
Python Requests安装与简单运用
2016/04/07 Python
实现python版本的按任意键继续/退出
2016/09/26 Python
python实现批量注册网站用户的示例
2019/02/22 Python
Python中的类与类型示例详解
2019/07/10 Python
对Python中一维向量和一维向量转置相乘的方法详解
2019/08/26 Python
调试Django时打印SQL语句的日志代码实例
2019/09/12 Python
Jupyter notebook快速入门教程(推荐)
2020/05/18 Python
浅谈Python3中print函数的换行
2020/08/05 Python
Python列表嵌套常见坑点及解决方案
2020/09/30 Python
解决Python 写文件报错TypeError的问题
2020/10/23 Python
Python基于mediainfo批量重命名图片文件
2020/12/29 Python
银行毕业实习自我鉴定
2013/09/19 职场文书
营业员实习自我鉴定
2013/12/07 职场文书
数控专业自荐书范文
2014/03/16 职场文书
体育教师求职信
2014/06/30 职场文书