樣本資料集(注意 Col_A 和 Col_B 的每個組合都是唯一的):
import pandas as pd
d = {'Col_A': [1,2,3,4,5,6,9,9,10,11,11,12,12,12,12,12,12,13,13],
'Col_B': ['A','K','E','E','H','A','J','A','L','A','B','A','J','C','D','E','A','J','L'],
'Value':[180,120,35,654,789,34,567,21,235,83,234,648,654,234,873,248,45,67,94]
}
df = pd.DataFrame(data=d)

要求是生成一個表,其中包含每個 Col_B 的數量、Col_A 的計數和每個 Col_A 的總量。按總金額降序顯示 Col_B 中的類別。
這是我到目前為止:
df.groupby(['Col_B','Col_A']).agg(['count','sum'])
輸出看起來像這樣。但是,我想為每個 Col_B 類別添加小計,并按降序排列這些類別的小計,以便滿足獲取每個 Col_B 數量的要求。

提前謝謝大家!
uj5u.com熱心網友回復:
預期的結果對我來說不清楚,但它是你想要的嗎?
piv = df.groupby(['Col_B', 'Col_A'])['Amount'].agg(['count','sum']).reset_index()
tot = piv.groupby('Col_B', as_index=False).sum().assign(Col_A='Total')
cat = pd.CategoricalDtype(tot.sort_values('sum')['Col_B'], ordered=True)
out = pd.concat([piv, tot]).astype({'Col_B': cat}) \
.sort_values('Col_B', ascending=False, kind='mergesort') \
.set_index(['Col_B', 'Col_A'])
>>> out
count sum
Col_B Col_A
J 9 1 567
12 1 654
13 1 67
Total 3 1288
A 1 1 180
6 1 34
9 1 21
11 1 83
12 2 693
Total 6 1011
E 3 1 35
4 1 654
12 1 248
Total 3 937
D 12 1 873
Total 1 873
H 5 1 789
Total 1 789
L 10 1 235
13 1 94
Total 2 329
C 12 1 234
Total 1 234
B 11 1 234
Total 1 234
K 2 1 120
Total 1 120
轉載請註明出處,本文鏈接:https://www.uj5u.com/gongcheng/373426.html
上一篇:Java對串列大小的反向排序
