【bug记录】RuntimeError: CUDA error: CUBLAS_STATUS_EXECUTION_FAILED when calling `cublasSgemm

9月前作者：yifanliuu 分类：Toy博客阅读(48) 违法举报

这篇具有很好参考价值的文章主要介绍了【bug记录】RuntimeError: CUDA error: CUBLAS_STATUS_EXECUTION_FAILED when calling `cublasSgemm。希望对大家有所帮助。如果存在错误或未考虑完全的地方，请大家不吝赐教，您也可以点击"举报违法"按钮提交疑问。

问题
在训练到一定迭代次数之后报错：
RuntimeError: CUDA error: CUBLAS_STATUS_EXECUTION_FAILED when calling cublasSgemm( handle, opa, opb, m, n, k, &alpha, a, lda, b, ldb, &beta, c, ldc)

可能的原因

shape维度不匹配
变量不在同一个device上
pytorch和cuda版本不匹配

解决方案

在train.py文件的开头加上 os.environ['CUDA_VISIBLE_DEVICES'] = '0' ，并且设置device='cuda'。
但是有一个很奇怪的现象：如果不设置可见gpu，而是指定device='cuda:0'的话，也会报错。文章来源地址https://www.toymoban.com/news/detail-511615.html

到了这里，关于【bug记录】RuntimeError: CUDA error: CUBLAS_STATUS_EXECUTION_FAILED when calling `cublasSgemm的文章就介绍完了。如果您还想了解更多内容，请在右上角搜索TOY模板网以前的文章或继续浏览下面的相关文章，希望大家以后多多支持TOY模板网！

本文来自互联网用户投稿，该文观点仅代表作者本人，不代表本站立场。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如若转载，请注明出处：如若内容造成侵权/违法违规/事实不符，请点击违法举报进行投诉反馈，一经查实，立即删除！

分享到：

领支付宝红包赞助服务器费用

解决：RuntimeError: CUDA error: device-side assert triggered

@[TOC]解决办法：RuntimeError: CUDA error: device-side assert triggered CUDA kernel errors might be asynchronously reported at some other API call,so the stacktrace below might be incorrect. For debugging consider passing CUDA_LAUNCH_BLOCKING=1. RuntimeError: CUDA error: device-side assert triggered CUDA kernel errors might be asynchronously reported at

2024年02月12日
浏览(37)
RuntimeError: CUDA error: an illegal memory access was encountered

后续发现其实是某张卡有问题， 0~3一共4个GPU，只在使用0号GPU的时候会出问题 0号卡似乎是被某个进程锁了，还是怎么样，不用那个卡就没事了其实不难发现，我报错的位置基本都是从 gpu 往 cpu 转换的时候出现的问题。因此考虑是不是cpu内存不太够了，所以内存访问发生错

2024年01月17日
浏览(57)
【RuntimeError: CUDA error: device-side assert triggered】问题与解决

当我在调试模型的时候，出现了如下的问题 /opt/conda/conda-bld/pytorch_1656352465323/work/aten/src/ATen/native/cuda/IndexKernel.cu:91: operator(): block: [5,0,0], thread: [63,0,0] Assertion `index = -sizes[i] index sizes[i] “index out of bounds”` failed. 通过提示信息可以知道是个数组越界的问题。但是如图一中第二行

2024年01月21日
浏览(40)
RuntimeError: CUDA error: CUBLAS_STATUS_NOT_INITIALIZED when calling `cublas‘

调用nn.linear时出现RuntimeError: CUDA error: CUBLAS_STATUS_NOT_INITIALIZED when calling `cublas’错误，搜索网上资料，主要指出以下原因： batch size太大（本人将batchsize设置成4，够小吧！还是不行。。。） CUDA版本和torch不匹配（本人cuda版本是10.1，pytorch版本安装的是cuda10.1+python3.8的pytorch1.

2023年04月08日
浏览(41)
RuntimeError: CUDA error: CUBLAS_STATUS_NOT_INITIALIZED when calling `cublasCreate(handle)`

DialoGPT/data_loader.py at 457835e7d8acd08acf7f6f0e980f36fd327ea37c · microsoft/DialoGPT · GitHub 报错：RuntimeError: CUDA error: CUBLAS_STATUS_NOT_INITIALIZED when calling `cublasCreate(handle)` 我把输入用同样形状的随机张量进行了测试，发现用随机的整数张量可以，但是用我的输入就不行，于是想看看两者的区别

2024年02月11日
浏览(117)
出现错误（已解决）RuntimeError: CUDA error: no kernel image is available for execution on the device CUDA ker

为什么把警告po出来，是因为警告可以让我们了解一些有用信息。首先警告里的内容不可忽略，翻译过来就是NVIDIA RTX GeForce 3060Ti（我使用的服务器）支持的CUDA的算力为8.6，与当前的pytorch的版本不匹配。说白了就是CUDA和pytorch版本不一致。当前的pytorch版本支持的CUDA的算力为

2024年02月10日
浏览(52)
已解决RuntimeError: CUDA error: device-side assert triggered异常的正确解决方法，亲测有效！！！

已解决RuntimeError: CUDA error: device-side assert triggered异常的正确解决方法，亲测有效！！！ RuntimeError: CUDA error: device-side assert triggered 出现 CUDA error: device-side assert triggered 错误通常是由于 GPU 上的某些计算出现了问题，导致 CUDA 运行时库触发了设备端断言。下滑查看解决方法要解

2024年02月07日
浏览(43)
RuntimeError: CUDA error: no kernel image is available for execution on the device

导致的原因一般都是显卡算力和cuda或者torch版本不匹配比如在conda中安装的pytorch=1.5.0 cuda=10.2 错误：RuntimeError: CUDA error: no kernel image is available for execution on the device 参考pytorch 报错 RuntimeError: CUDA error: no kernel image is available for execution on the device_可豌豆的博客-CSDN博客则应该安装

2024年02月15日
浏览(60)
解决RuntimeError: CUDA error: no kernel image is available for execution on the deviceCUDA

解决RuntimeError: CUDA error: no kernel image is available for execution on the deviceCUDA kernel errors might be asynchronously reported at some other API call,so the stacktrace below might be incorrect. 在服务器复现代码的时候，遇到了上述错误，解决办法如下。 .bashrc文件在服务器上初始页面的配置文件的地方参考：

2024年02月16日
浏览(51)
[已解决]RuntimeError: CUDA error: no kernel image is available for execution on the device

在ubuntu服务器上用python炼丹的时候遇到的两个问题，一个warning和一个runtimeErro，我的环境是用conda配置的，我就切换了一下环境，然后切回来就报这两个错误，期间啥也没干，之前重新安装opencv疯狂报错也是这种样子的。 warning warning：NVIDIA GeForce RTX 3090 with CUDA capability sm_86

2024年02月02日
浏览(70)