我的思考:
1.核函数的运算量较大,有创建的对象,占用空间很大,有些核函数有if条件语句,需要将核函数的计算量减少。因为一个线程块使用的共享存储器和计算器数量变小,就可以分配更多的线程块(当前程序中每个线程块包含128个线程)
2.更换更好的显卡,就会有更多的cuda core和寄存器等资源,可以计算更多的线程(目前使用的显卡为Geforce RTX3060),若需要更换,可以选择哪些显卡呢?
![](https://profile-avatar.csdnimg.cn/e2bbbb9687104e8dad49fc4b383dadbf_qq_43538607.jpg!4)
在较大规模计算中,cuda核函数中执行配置的线程数量为20万,程序可以运行。若想要运行更多的线程数量,有哪些解决方案?
- 写回答
- 好问题 0 提建议
- 追加酬金
- 关注问题
- 邀请回答
-
1条回答 默认 最新
- SmallAntJ 2022-04-26 00:15关注
单卡的话也可以尝试对数据进行分割,多次传入GPU计算。
GeForce RTX 3060 有 3,584 CUDA core,要是追求CUDA core的数量的话可以考虑RTX A40, RTX A6000, GeForce RTX 3080 Ti, GeForce RTX 3090, GeForce RTX 3090 Ti 这5款都有10000+的CUDA core。本回答被题主选为最佳回答 , 对您是否有帮助呢?解决 无用评论 打赏 举报
悬赏问题
- ¥15 metadata提取的PDF元数据,如何转换为一个Excel
- ¥15 关于arduino编程toCharArray()函数的使用
- ¥100 vc++混合CEF采用CLR方式编译报错
- ¥15 coze 的插件输入飞书多维表格 app_token 后一直显示错误,如何解决?
- ¥15 vite+vue3+plyr播放本地public文件夹下视频无法加载
- ¥15 c#逐行读取txt文本,但是每一行里面数据之间空格数量不同
- ¥50 如何openEuler 22.03上安装配置drbd
- ¥20 ING91680C BLE5.3 芯片怎么实现串口收发数据
- ¥15 无线连接树莓派,无法执行update,如何解决?(相关搜索:软件下载)
- ¥15 Windows11, backspace, enter, space键失灵