對所有人來說,
我有一個包含 104959 行和 298 列的資料框。
要替換特定列中的子字串,我嘗試過:
# ??? ??? ????? ?? ?????
df['EVENT_DTL'] = df['EVENT_DTL'].replace(dict(zip(['????_1','????_2','????_3','????_4','????_5','????_6','????_7','????_8','????_9'],
['??','?? ?','?? ?','?? ?? ??','????','????','?? ?? ??','??',''])))
但是當我完全沒有改變print(df.loc[2143,'EVENT_DTL'])
我使用了這種方法,因為經典的替換方法如df.replace({'????_1':'??','????_2':'?? ?'},inplace=True)不起作用
df['EVENT_DTL']看起來像這樣:
1. ??? ?? :
2. ???? : 2013year05month18day 13:00
3. ???? :
1) ???? ? ??
????? ?? : Seoul
???? ?? : Seoul Jongro
??(??)?? ?? : Seoul Jongro Euni
2) ?? ???? ??? ??
????? ?? :
???? ?? :
??(??)?? ?? :
??(?? ??) :
4. ???? ???? : ????_1 / nan_nan
5. ??/?? : MAIN_METHOD_8
6. ???? :
7. ??? ???? :
8. ?????? :
9. ??????? :
10. ?? : ????
11. ???? : nan??????_88?? ??_nan?? ??_nan?? ?_nan?? ??_nan
12. ???? :
13. ?? ???????? ? ?? : ???_3_???_nan???_nan???? ?? ?? ??_nan????_nan ??_nan ???_nan ???_nan ??_nan ????_nan ????_1.0 ?? ??_2.0 ?? ????_2.0 ????_2.0nan ?, ???? ???nan
14. ????? ??? : nan
uj5u.com熱心網友回復:
經過regex = True
d = dict(zip(['????_1','????_2','????_3','????_4','????_5','????_6','????_7','????_8','????_9'],
['??','?? ?','?? ?','?? ?? ??','????','????','?? ?? ??','??','']))
df['EVENT_DTL'] = df['EVENT_DTL'].replace(d, regex = True)
轉載請註明出處,本文鏈接:https://www.uj5u.com/caozuo/532951.html
標籤:Python熊猫
