qq_38411575 2021-03-26 14:00 采纳率: 77.8%
浏览 96
已结题

dataframe 分类排序问题2

我之前问过类似的问题,见链接: https://ask.csdn.net/questions/7409644

现在碰到更复杂的问题,我需要对dataframe按照类分类,每类按照该类data2的值最大的时候的data1值过滤该类,然后排序,请问该如何优化?

我把整数改成浮点数,更精确一点 ,代码如下:

import numpy as np
import pandas as pd

df = pd.DataFrame()
n = 200
df['category'] = np.random.choice(('A', 'B'), n)
df['data1'] = np.random.rand(len(df))*100
df['data2'] = np.random.rand(len(df))*100

a = df[df['category'] == 'A']
c = a[a['data2'] == a.data2.max()].data1.max()
a = a[a['data1'] <= c]
a = a.sort_values(by='data2', ascending=False).head(4)

b = df[df['category'] == 'B']
c = b[b['data2'] == b.data2.max()].data1.max()
b = b[b['data1'] <= c]
b = b.sort_values(by='data2', ascending=False).head(4)

df = pd.concat([a, b]).sort_values(by=['category', 'data1'], ascending=[True, False]).reset_index(drop=True)
print(df)

结果为:

  category      data1      data2
0        A  77.453241  98.628388
1        A  54.786469  97.470081
2        A  19.618200  96.261181
3        A   9.031004  97.067451
4        B  50.751809  99.219009
5        B  47.546003  96.488705
6        B  32.735357  98.565826
7        B  14.092039  95.359450
  • 写回答

3条回答 默认 最新

  • ProfSnail 2021-03-26 14:16
    关注

    使用groupby方法。

    import numpy as np
    import pandas as pd
     
    df = pd.DataFrame()
    n = 200
    df['category'] = np.random.choice(('A', 'B'), n)
    df['data1'] = np.random.randint(1, 100, len(df))
    df['data2'] = np.random.randint(1, 100, len(df))
    print(df)
    
    rowIndex = pd.Series()
    for name, group in df.groupby('category'):
    	heading = group[group['data1']<group['data2'].max()].sort_values(by='data2', ascending=False).head(4)
    	rowIndex = pd.concat([rowIndex, pd.Series(heading.index)])
    out = df.loc[rowIndex]
    print(out)
    
        category  data1  data2
    71         A     23     99
    115        A     58     96
    167        A     87     95
    174        A     12     95
    119        B     12     99
    135        B     12     98
    117        B     90     98
    88         B     19     97
    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(2条)

报告相同问题?

问题事件

  • 已结题 (查看结题原因) 8月19日

悬赏问题

  • ¥15 r语言神经网络自变量重要性分析
  • ¥15 基于双目测规则物体尺寸
  • ¥15 wegame打不开英雄联盟
  • ¥15 公司的电脑,win10系统自带远程协助,访问家里个人电脑,提示出现内部错误,各种常规的设置都已经尝试,感觉公司对此功能进行了限制(我们是集团公司)
  • ¥15 救!ENVI5.6深度学习初始化模型报错怎么办?
  • ¥30 eclipse开启服务后,网页无法打开
  • ¥30 雷达辐射源信号参考模型
  • ¥15 html+css+js如何实现这样子的效果?
  • ¥15 STM32单片机自主设计
  • ¥15 如何在node.js中或者java中给wav格式的音频编码成sil格式呢