我有一個 Excel 表,所以我正在創建一個自動化腳本,它獲取包含一些特定關鍵字的所有資料。假設在 CI 列中有很多名字,那么我只需要過濾那些資料以不同姓氏的術語“John”開頭的行。如果在 C 列中有 1000 個名字,并且 100 個名字以名字 John 開頭,但姓氏不同。所以我想要所有 100 個名稱以及相應的 A、B 和 D 列。我無法在列上過濾掉。
uj5u.com熱心網友回復:
您可以使用startswith - 試試這個例子:
df = pd.DataFrame(np.array([[1, 2, 'John A', 3], [1, 2, 'John B', 3], [1, 2, 'Michael A', 3]]), columns=['A', 'B', 'C', 'D'])
df_new = df[df.C.str.startswith('John ')]
uj5u.com熱心網友回復:
您可以使用 loc 功能。它將僅提取在“C”列中具有名為 John 的字串的資料。希望這會奏效。
df=df.loc[df['C'].str.contains('John')]
轉載請註明出處,本文鏈接:https://www.uj5u.com/qukuanlian/407229.html
標籤:
上一篇:如何識別串列中對應負數的數字?
下一篇:根據excel中的另一個求和列
