显存充足但是CUDA out of Memory报错解决

阅读: 评论:0

显存充足但是CUDA out of Memory报错解决

显存充足但是CUDA out of Memory报错解决

首先排除了是batchsize太大的原因,我从16改到了1,还是一直在OOM,而且更重要的是,前一天还是能跑的,今天就跑不了了55。

然后突然想到是不是僵尸进程的原因,僵尸进程是不会显示在nvidia-smi里的

去网上搜了搜怎么看僵尸进程的方法:fuser -v /dev/nvidia* 这条命令用不用sudo都行。

我看了两次,真让我找到两个叛徒。nvidia-smi里面根本没有它们。kill掉之后终于能跑啦

-------------------------------一些碎碎念--------------------------
好久没写了咳咳。
以后大概不会继续写论文阅读了,之前刚开始读论文总感觉读不太懂,所以写一遍加深印象。
现在慢慢步入正轨了(主要还是懒,写下来真的好麻烦OO)
以后大概是bug解决居多吧()

本文发布于:2024-01-29 05:53:46,感谢您对本站的认可!

本文链接:https://www.4u4v.net/it/170647882913171.html

版权声明:本站内容均来自互联网,仅供演示用,请勿用于商业和其他非法用途。如果侵犯了您的权益请与我们联系,我们将在24小时内删除。

标签:显存   报错   充足   CUDA   Memory
留言与评论(共有 0 条评论)
   
验证码:

Copyright ©2019-2022 Comsenz Inc.Powered by ©

网站地图1 网站地图2 网站地图3 网站地图4 网站地图5 网站地图6 网站地图7 网站地图8 网站地图9 网站地图10 网站地图11 网站地图12 网站地图13 网站地图14 网站地图15 网站地图16 网站地图17 网站地图18 网站地图19 网站地图20 网站地图21 网站地图22/a> 网站地图23