我的問題是當我匯入基數時,熊貓種嘗試將其轉換為數字?
這或多或少是我的 csv 檔案的樣子。
Data,ID,Text
2018-06-11,20995, bla bla bla
2018-06-11,17980, bla bla bla
2018-06-11,46854, bla bla bla
問題是當我用 pd.read_csv 匯入它時。Id 列應該與 csv 檔案中的完全相同。但是熊貓正在回傳類似的東西:
Data,ID,Text
2018-06-11,20995.0, bla bla bla
2018-06-11,17980.0, bla bla bla
2018-06-11,46854.0, bla bla bla
我在讀取期間嘗試使用 dtype
df= pd.read_csv('df.csv',encoding ='latin1',dtype={'ID':str})
但它仍然添加了.0。當我查看 csv 時,它沒有這些拖尾 .0
我也嘗試過轉換為字串
df['ID'] = df['ID'].astype(str)
我想明確一點,我已經閱讀了這個問題,但回復沒有回答我的 Q
uj5u.com熱心網友回復:
你遇到了有史以來最嚴重的熊貓疣。但現在是 2022 年,終于支持整數的缺失值了!看一下這個。這是一個 csv 檔案,其中a包含一個缺失值的整數列:
a,b
1,y
2,m
,c
3,a
如果您以默認方式閱讀它,您會得到煩人的浮動轉換:
pd.read_csv('test.csv'):
a b
--------------
0 1.0 y
1 2.0 m
2 NaN c
3 3.0 a
但是,如果你告訴 pandas 你想要帶有缺失值的新實驗整數,你會得到好東西:
pd.read_csv('test.csv', dtype={'a': 'Int64'}):
a b
---------
0 1 y
1 2 m
2 <NA> c
3 3 a
轉載請註明出處,本文鏈接:https://www.uj5u.com/qukuanlian/417016.html
標籤:
