我有兩個資料幀,它們都包含匹配的 A 列和 B 列。但是每個資料幀中出現的次數并不相同。資料框二包含第三列,我想將其帶入我的第一個資料框并匹配 A 列和 B 列相同的值。
資料框的形狀或大小不同,DF #1 的列和行比顯示的多很多,所以我不能把它舉起來。
例子:
DF #1
Ethnicity Region
Asian West
Asian West
Asian North
Black West
Black West
Black West
Mixed South
Mixed West
Mixed West
Mixed South East
DF #2
Ethnicity Region Population
Asian South East 278372
Asian East 32992
Asian South 33503
Asian East 86736
Asian East 58871
Asian North 66270
Black East 117442
Black East 69925
Black West 33614
Black West 13903
所以本質上,我想做一個 V 查找型別函式并在第一個資料幀中創建一個新列,它會告訴我來自第二個資料幀的人口。
到目前為止,我已經完成了一個 groupby 函式,它成功地總結了第二個資料幀中每個區域的居民總數,但我不確定如何將其移動到第一個資料幀。
這項任務背后的原因是資料幀 #1 包含大量其他資訊,這些資訊將從第二個資料幀的人口資料中受益。
任何指標/相關檔案都會非常有幫助。謝謝。
uj5u.com熱心網友回復:
你可以做 merge
df2 = df2.groupby(['Ethnicity', 'Region']).sum().reset_index()
df1 = df1.merge(df2,how='left')
轉載請註明出處,本文鏈接:https://www.uj5u.com/caozuo/350411.html
上一篇:為什么表格上沒有滾動條?
下一篇:字典的嵌套字典
