嘗試過火車頭,太過于復雜,對新手不太友好,試過八爪魚后感徑訓不錯,比較適合新手
1.下載安裝八爪魚,注冊賬號,登錄
下載鏈接:
https://www.bazhuayu.com/
登錄進去是這樣:

在開始采集處輸入要拉文章的鏈接
我這里以如下網站為例
https://mp.ofweek.com/ctrade/fiber/
點擊開始采集,左邊為流程圖,右側為網頁,點擊網頁內的鏈接按照右上角的提示提取文章標題和鏈接(點擊時會提示選中相同元素,如果需要批量下載就點擊)

這時我發現文章的標題很多,需要翻頁不斷加載,如果只提取這幾個顯然不夠用,需要添加翻頁回圈操作,點擊這里,選擇回圈

點擊 回圈串列右上角的設定,設定回圈翻頁,點擊應用,最后記得把剛才設定提取文章標題的回圈拖動到回圈翻頁的內部

這時已經設定好了回圈翻頁提取文章標題和鏈接了,下面提取文章內容,點擊右側采集下一集網
頁

選擇從采集的欄位里跳轉到文章內容里,依次點擊標題,采集;時間,采集;正文,采集
(這里要注意,如果要一次性選中全文內容的話需要點擊正文后選擇一下右下角最右邊的DIV,然后點擊提取該元素)

再點擊左上角,采集,啟動本地采集(定時和云都是要付費的) ,下面 是采集結果,點擊匯入,匯入到mysql中即可,注意字符編碼是UTF-8,文章的字符型別設定為longtxt,匯入即可


有問題可以聯系我溝通下~
轉載請註明出處,本文鏈接:https://www.uj5u.com/qita/297100.html
標籤:其他
上一篇:SQL資料庫之增
