傥子龙云 2019-10-15 23:32 采纳率: 20%
浏览 654
已结题

严重的非平衡数据二分类问题

数据挖掘中,利用机器学习算法解决二分类问题,数据样本分布极不平衡:
好样本和坏样本之间的比率高达500:1,
请问采用什么机器学习算法和数据采样方法,或者两者的可以解决这样的数据极不平衡问题?

  • 写回答

1条回答

  • threenewbee 2019-10-16 09:03
    关注

    两个办法,一个是通过复制的方式扩展坏样本,凑到和好样本一样多
    一个是修改损失函数,将坏样本识别为好样本(漏报)的权重远远大于误报(好样本识别为坏样本)的权重

    评论

报告相同问题?

悬赏问题

  • ¥15 关于#python#的问题:求帮写python代码
  • ¥15 LiBeAs的带隙等于0.997eV,计算阴离子的N和P
  • ¥15 关于#windows#的问题:怎么用WIN 11系统的电脑 克隆WIN NT3.51-4.0系统的硬盘
  • ¥15 来真人,不要ai!matlab有关常微分方程的问题求解决,
  • ¥15 perl MISA分析p3_in脚本出错
  • ¥15 k8s部署jupyterlab,jupyterlab保存不了文件
  • ¥15 ubuntu虚拟机打包apk错误
  • ¥199 rust编程架构设计的方案 有偿
  • ¥15 回答4f系统的像差计算
  • ¥15 java如何提取出pdf里的文字?