我目前正在從事一個專案,該專案在給定搜索查詢(即谷物)的情況下抓取雜貨店頁面的資料,并將其顯示在 Spinner 視圖中。但是,我很難找到從頁面上刮取資料的方法。我嘗試使用 Jsoup,因為這是在線共識,但它不支持 JavaScript。
問題在于,大多數(如果不是全部)這樣的網站都使用 DOM 存盤來獲取最新的股票串列和價格。這就是為什么像 Jsoup 這樣的庫不能作業的原因,因為它們會在沒有 JavaScript 的情況下回傳 HTML。我目前有一個通過 WebView 顯示頁面的原型,但我看不到獲取資料的方法。
我試圖研究如何解決這個問題,但如果真的存在,找到一個優雅的解決方案是很令人困惑的。
如果有人可以提供幫助,或者至少為我指明正確的方向,那將不勝感激!謝謝^_^
uj5u.com熱心網友回復:
Selenium 將是網頁抓取的不錯選擇。https://www.selenium.dev/基本上可以訪問網站的DOM。根據過去的經驗,動態生成的網頁可能難以抓取。RegExp 將是您的朋友。https://regexone.com/
轉載請註明出處,本文鏈接:https://www.uj5u.com/shujuku/361481.html
標籤:javascript 爪哇 安卓 dom 汤
