我有一個看起來像這樣的資料框
| 星期 | DELIVERY_BOY_ID | TOTAL_GMV |
|---|---|---|
| 2022-04-04 | 999999999.0 | 470510.11 |
| 2022-04-11 | 999999999.0 | 557351.02 |
| 2022-04-18 | 999999999.0 | 454225.78 |
| 2022-04-25 | 999999999.0 | 527932.46 |
| 2022-05-02 | 999999999.0 | 556741.18 |
| 2022-05-09 | 999999999.0 | 524571.93 |
| 2022-05-16 | 999999999.0 | 547195.66 |
| 2022-05-23 | 999999999.0 | 112423.49 |
我要做的是每 4 周對 TOTAL_GMV 求和(從 2022-05-02 周到 2022-05-23 周的總和,從 2022-04-25 到 2022-05-16 的總和,依此類推) ),并顯示與上周日期相加的結果
因此,最終結果應如下所示:
| 星期 | DELIVERY_BOY_ID | TOTAL_GMV | 解釋 |
|---|---|---|---|
| 2022-04-04 | 999999999.0 | ********* | 從 2022-03-14 到 2022-04-04 的總和 |
| 2022-04-11 | 999999999.0 | ********* | 2022-03-21 至 2022-04-11 的總和 |
| 2022-04-18 | 999999999.0 | ********* | 2022-03-28 至 2022-04-18 的總和 |
| 2022-04-25 | 999999999.0 | 2.010.018,91 | 從 2022-04-04 到 2022-04-25 的總和 |
| 2022-05-02 | 999999999.0 | 2.096.250,44 | 從 2022-04-11 到 2022-05-02 的總和 |
| 2022-05-09 | 999999999.0 | 2.063.469,15 | 2022-04-18 至 2022-05-09 的總和 |
| 2022-05-16 | 999999999.0 | 2.156.441,23 | 從 2022-04-25 到 2022-05-16 的總和 |
| 2022-05-23 | 999999999.0 | 1.639.932,26 | 從 2022-05-02 到 2022-05-23 的總和 |
知道怎么做嗎?
謝謝!!
uj5u.com熱心網友回復:
假設這WEEK是索引,您可以執行以下操作:
>>> df.TOTAL_GMV.rolling(4).sum()
WEEK
2022-04-04 NaN
2022-04-11 NaN
2022-04-18 NaN
2022-04-25 2010019.37
2022-05-02 2096250.44
2022-05-09 2063471.35
2022-05-16 2156441.23
2022-05-23 1740932.26
Name: TOTAL_GMV, dtype: float64
要將其添加到 df,
df['TOTAL_GMV'] = df.TOTAL_GMV.rolling(4).sum()
(如果不是索引,請將其更改為df.set_index('WEEK').TOTAL_GMV.rolling(4).sum()。)
轉載請註明出處,本文鏈接:https://www.uj5u.com/houduan/484088.html
