qq_38411575 2021-03-24 19:23 采纳率: 77.8%
浏览 128
已结题

dataframe分类排序优化问题

我想取dataframe 'category'列两个字母中,另外一列'data'的最大4个,并按照一定的规则排序,代码如下,请问有什么更简单的方法么?

import numpy as np
from time import time
import pandas as pd

df = pd.DataFrame()
n = 200
df['category'] = np.random.choice(('A', 'B'), n)
df['data'] = np.random.randint(1, 10000, len(df))
a = df[df['category'] == 'A'].sort_values(by='data', ascending=False).head(4)
b = df[df['category'] == 'B'].sort_values(by='data', ascending=False).head(4)
df = pd.concat([a, b]).sort_values(by=['category','data'],ascending=[True,False]).reset_index(drop=True)
print(df)

结果如下

  category  data
0        A  9889
1        A  9879
2        A  9873
3        A  9822
4        B  9909
5        B  9855
6        B  9775
7        B  9689
  • 写回答

1条回答 默认 最新

  • 关注

    试试这个

    temp  = df.groupby('category')['data'].nlargest(4).reset_index()
    temp.drop('level_1',axis=1)
    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论

报告相同问题?

悬赏问题

  • ¥15 r语言神经网络自变量重要性分析
  • ¥15 基于双目测规则物体尺寸
  • ¥15 wegame打不开英雄联盟
  • ¥15 公司的电脑,win10系统自带远程协助,访问家里个人电脑,提示出现内部错误,各种常规的设置都已经尝试,感觉公司对此功能进行了限制(我们是集团公司)
  • ¥15 救!ENVI5.6深度学习初始化模型报错怎么办?
  • ¥30 eclipse开启服务后,网页无法打开
  • ¥30 雷达辐射源信号参考模型
  • ¥15 html+css+js如何实现这样子的效果?
  • ¥15 STM32单片机自主设计
  • ¥15 如何在node.js中或者java中给wav格式的音频编码成sil格式呢