wxypku 2018-10-28 08:26 采纳率: 20%
浏览 677
已结题

多节点运行cuda+mpi时报错 cudaEvent报错

我在一个小集群上运行mpi+cuda的程序,设置了cuda计时,但是其中一个节点运行到
CUDA_CALL(cudaEventRecord(stop, 0));
CUDA_CALL(cudaEventSynchronize(stop));
时报错:
CUDA Error: invalid resource handle (err_num=33)
其他节点正常运行,请问这是什么原因。

  • 写回答

1条回答 默认 最新

  • threenewbee 2018-10-28 16:54
    关注

    这往往是显存的问题,但是没有办法知道是多节点部署的问题还是你程序本身就有问题,最好加上日志输出下,看看是哪一步出错的。

    评论

报告相同问题?

悬赏问题

  • ¥15 flink cdc无法实时同步mysql数据
  • ¥100 有人会搭建GPT-J-6B框架吗?有偿
  • ¥15 求差集那个函数有问题,有无佬可以解决
  • ¥15 【提问】基于Invest的水源涵养
  • ¥20 微信网友居然可以通过vx号找到我绑的手机号
  • ¥15 寻一个支付宝扫码远程授权登录的软件助手app
  • ¥15 解riccati方程组
  • ¥15 使用rabbitMQ 消息队列作为url源进行多线程爬取时,总有几个url没有处理的问题。
  • ¥15 Ubuntu在安装序列比对软件STAR时出现报错如何解决
  • ¥50 树莓派安卓APK系统签名