naeux 2017-09-07 09:07 采纳率: 0%
浏览 1450

如何清除hbase表中重复数据

类似mysql中table1表
id name
1 name1
2 name2
3 name1
我们可以使用
delete table1 from table1, (select max(id) mid, name from table1 group by name having count(id) > 1 ) as t2 where table1.name = t2.name and table1.id != t2.mid;
语句清除重复name值的数据,只保留其中重复数据中id最大的数据,得到:
id name
2 name2
3 name1

那么在hbase中,怎么清除表中某字段值重复的记录,而保留重复数据中最后一条数据?

求大神解答

  • 写回答

1条回答 默认 最新

  • CMM1 2017-09-07 09:11
    关注

    用主键分组然后找到最大或最小的记录,不是最大或最小的记录全部删除

    评论

报告相同问题?

悬赏问题

  • ¥20 有关区间dp的问题求解
  • ¥15 多电路系统共用电源的串扰问题
  • ¥15 slam rangenet++配置
  • ¥15 有没有研究水声通信方面的帮我改俩matlab代码
  • ¥15 对于相关问题的求解与代码
  • ¥15 ubuntu子系统密码忘记
  • ¥15 信号傅里叶变换在matlab上遇到的小问题请求帮助
  • ¥15 保护模式-系统加载-段寄存器
  • ¥15 电脑桌面设定一个区域禁止鼠标操作
  • ¥15 求NPF226060磁芯的详细资料