在修改了原网络的backbone,加入了注意力机制后,在训练过程中total_loss正常但是val loss出现nan是怎么回事啊
1条回答 默认 最新
- Neo很努力 2022-07-08 16:02关注
梯度下降的过程中因为中间网络层是随机生成的初始权重,所以梯度下降的过程中可能陷入了局部最优,可以通过调试batchsize或者lr等超参数解决。
本回答被题主选为最佳回答 , 对您是否有帮助呢?解决 1无用
悬赏问题
- ¥15 网络科学导论,网络控制
- ¥15 metadata提取的PDF元数据,如何转换为一个Excel
- ¥15 关于arduino编程toCharArray()函数的使用
- ¥100 vc++混合CEF采用CLR方式编译报错
- ¥15 coze 的插件输入飞书多维表格 app_token 后一直显示错误,如何解决?
- ¥15 vite+vue3+plyr播放本地public文件夹下视频无法加载
- ¥15 c#逐行读取txt文本,但是每一行里面数据之间空格数量不同
- ¥50 如何openEuler 22.03上安装配置drbd
- ¥20 ING91680C BLE5.3 芯片怎么实现串口收发数据
- ¥15 无线连接树莓派,无法执行update,如何解决?(相关搜索:软件下载)