我正在嘗試在 html 頁面中獲取 div 標簽,但結果顯示為空串列。我已經提供了代碼和 html 的圖片。page_text 變數是一個空串列。
url = 'https://www.highspeedinternet.com/in-your-area?zip=50648'
page = requests.get(url).text
doc = BeautifulSoup(page, "html.parser")
page_text = doc.find_all("div", {"data-brand"})
print(page_text)

uj5u.com熱心網友回復:
您已接近目標,只需True在您的dict:
doc.find_all('div',{"data-brand":True})
作為替代方案,您可以使用css selectors并list comprehension獲取所有值:
[e.get('data-brand') for e in doc.select('div[data-brand]')]
輸出:
['CenturyLink', 'Rise Broadband', 'LTD Broadband LLC', 'Viasat', 'HughesNet', 'Heartland Technology', 'Ooma', 'CenturyLink', 'Rise Broadband', 'LTD Broadband LLC', 'Viasat', 'HughesNet', 'Ooma', 'Heartland Technology', 'T-Mobile', 'Verizon Wireless', 'AT&T Wireless', 'Mint', 'Visible']
轉載請註明出處,本文鏈接:https://www.uj5u.com/qita/468024.html
下一篇:我怎樣才能隱藏這個css物件?
