pyspark 2.3.1
我的行col1應該只包含整數。我試圖過濾掉甚至有一個字符的任何行。我怎樣才能在 pyspark 中做到這一點?
我試過了
df.select('col1').filter(df.col1.rlike(^[a-zA-Z]))
然而,包含字母表的行也包含整數,因此不會被過濾。
我怎樣才能做到這一點?
uj5u.com熱心網友回復:
您可以嘗試選擇純數字行。
df = df.filter('col1 rlike "^[0-9] $"')
df.show(truncate=False)
轉載請註明出處,本文鏈接:https://www.uj5u.com/gongcheng/394029.html
