我正在使用 BeautifulSoup 來抓取一個 html 頁面,其中我需要的資訊存盤在如下代碼中:
<a class=" l00_PR_lTitleonContext" href="site0.html"> Title 0 </a>
<a class=" l01_PR_lTitleonContext" href="site1.html"> Title 1 </a>
<a class=" l02_PR_lTitleonContext" href="site2.html"> Title 2 </a>
[...]
我想得到“Title 0”、“Title 1”和“Title 2”,但是每個專案的類名都會改變,所以我使用這樣的正則運算式:
titles = soup.findAll("a", attrs={"class": re.compile('^TitleonContext.*')})
for title in titles:
print(title)
但它不起作用(沒有列印任何內容)。我究竟做錯了什么?
uj5u.com熱心網友回復:
嘗試使用以下正則運算式re.compile(r'.*TitleonContext')or re.compile('.*TitleonContext'),否則您正在尋找以 ( ^) 開頭的值。
轉載請註明出處,本文鏈接:https://www.uj5u.com/caozuo/496222.html
