带眼镜的老鹰
2021-10-26 17:31
采纳率: 66.7%
浏览 55
已结题

Python中pandas怎么实现分组去重统计和求和

原数据:

img

想要的结果:

img

sql实现逻辑:

select 
大区,
count(distinct  用户编码)  as 用户数,
count(distinct  订单编码)  as 订单数,
sum(数量) as 数量,
sum(金额) as 金额
from order_table
group by  大区

我现在想到的是Python方法是分别计算,然后进行组合:

df1 = order_table.groupby('大区')['数量','金额'].sum()
df2 = order_table.groupby('大区')['用户编码','订单编码'].unique()

result = pd.merge( df1 , df2 ,how = 'left' ,on = '大区')

现在的问题Python有没有更简单的方法,直接用一个语句实现

  • 写回答
  • 好问题 提建议
  • 追加酬金
  • 关注问题
  • 收藏
  • 邀请回答

3条回答 默认 最新

  • 我叫啥呢 2021-10-26 18:07
    已采纳
        result = order_able.groupby('大区').agg({'数量': 'sum', '金额': 'sum', '用户编码': 'unique', '订单编码': 'unique'})
    
    评论
    解决 1 无用
    打赏 举报
  • 查看更多回答(2条)

相关推荐 更多相似问题