带眼镜的老鹰 2021-10-26 17:31 采纳率: 66.7%
浏览 775
已结题

Python中pandas怎么实现分组去重统计和求和

原数据:

img

想要的结果:

img

sql实现逻辑:

select 
大区,
count(distinct  用户编码)  as 用户数,
count(distinct  订单编码)  as 订单数,
sum(数量) as 数量,
sum(金额) as 金额
from order_table
group by  大区

我现在想到的是Python方法是分别计算,然后进行组合:

df1 = order_table.groupby('大区')['数量','金额'].sum()
df2 = order_table.groupby('大区')['用户编码','订单编码'].unique()

result = pd.merge( df1 , df2 ,how = 'left' ,on = '大区')

现在的问题Python有没有更简单的方法,直接用一个语句实现

  • 写回答

3条回答 默认 最新

  • 我叫啥呢 2021-10-26 18:07
    关注
        result = order_able.groupby('大区').agg({'数量': 'sum', '金额': 'sum', '用户编码': 'unique', '订单编码': 'unique'})
    
    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(2条)

报告相同问题?

问题事件

  • 系统已结题 11月3日
  • 已采纳回答 10月26日
  • 创建了问题 10月26日

悬赏问题

  • ¥20 wireshark抓不到vlan
  • ¥20 关于#stm32#的问题:需要指导自动酸碱滴定仪的原理图程序代码及仿真
  • ¥20 设计一款异域新娘的视频相亲软件需要哪些技术支持
  • ¥15 stata安慰剂检验作图但是真实值不出现在图上
  • ¥15 c程序不知道为什么得不到结果
  • ¥40 复杂的限制性的商函数处理
  • ¥15 程序不包含适用于入口点的静态Main方法
  • ¥15 素材场景中光线烘焙后灯光失效
  • ¥15 请教一下各位,为什么我这个没有实现模拟点击
  • ¥15 执行 virtuoso 命令后,界面没有,cadence 启动不起来