作為一名熱愛王者兩年的程式員,早就想爬取所有英雄皮膚的高清照片,在設個幻燈片放映,真香,這次只用16行代碼就能實作,對于新手拿這個作為實戰練手專案既簡單又容易上手,快來嘗試下,
百度"王者榮耀"進入官網 https://pvp.qq.com/,我這邊直接以Goole Chrome瀏覽器為例,在更多工具中選擇開發者工具,或直接按F12進入除錯界面,然后按F5重繪界面

圖中標識的herolist.json檔案就是我們所需要的英雄串列,其中包括英雄編號、英雄名稱、英雄型別、皮膚的名稱等資訊,在檔案上右擊復制鏈接
http://pvp.qq.com/web201605/js/herolist.json

接下來驗證一下我們尋找的是否正確,代碼:
import urllib.request
import json
import os
response = urllib.request.urlopen("http://pvp.qq.com/web201605/js/herolist.json")
hero_json = json.loads(response.read())
hero_num = len(hero_json)
print(hero_json)
print("hero_num : " , str(hero_num))
以上代碼讀取英雄串列并存入hero_json,并獲取英雄數量,運行效果如下圖

點擊首頁的“游戲資料”標簽頁,進入新的頁面后隨意點擊一個英雄頭像進入英雄資料頁面,以李白為例,同樣的F12然后F5,將滑鼠在李白的幾個皮膚上一次掃過
如圖:

可以看到李白的高清皮膚一共有6個,同樣我們在一個皮膚上右鍵復制鏈接得到:
https://game.gtimg.cn/images/yxzj/img201606/skin/hero-info/131/131-bigskin-6.jpg
分析這個鏈接我們可以發現,其中‘131’是英雄的編號,最后的’-6’是該英雄的皮膚編號,到這里,瀏覽器上所需要的資訊我們已經全部獲得,可以開始下載
在第一步獲取到的herolist.json檔案中有'skin_name'欄位,我們只要決議這個欄位就可以獲取皮膚數量與名稱,
代碼如下:
hero_name = hero_json[0]['cname']
skin_names = hero_json[0]['skin_name'].split('|')
skin_num = len(skin_names)
print('hero_name: ', hero_name)
print('skin_names :', skin_names)
print('skin_num: ' + str(skin_num))
下載檔案用到urlretrieve介面,并且考慮兩個問題:
- 檢查檔案夾是否存在,不存在則創建,
save_dir = 'D:\heroskin\\'
if not os.path.exists(save_dir):
os.mkdir(save_dir)
- 檢查圖片檔案是否存在,如果存在則跳過下載,
if not os.path.exists(save_file_name):
urllib.request.urlretrieve(skin_url, save_file_name)
完整代碼如下,除去注釋和空行一共16行代碼:
import urllib.request
import json
import os
response = urllib.request.urlopen("http://pvp.qq.com/web201605/js/herolist.json")
hero_json = json.loads(response.read())
hero_num = len(hero_json)
save_dir = 'D:\heroskin\\'
if not os.path.exists(save_dir):
os.mkdir(save_dir)
for i in range(hero_num):
# 獲取英雄皮膚串列
skin_names = hero_json[i]['skin_name'].split('|')
for cnt in range(len(skin_names)):
save_file_name = save_dir + str(hero_json[i]['ename']) + '-' +hero_json[i]['cname']+ '-' +skin_names[cnt] + '.jpg'
skin_url = 'http://game.gtimg.cn/images/yxzj/img201606/skin/hero-info/'+str(hero_json[i]['ename'])+ '/' +str(hero_json[i]['ename'])+'-bigskin-' + str(cnt+1) +'.jpg'
print(skin_url)
if not os.path.exists(save_file_name):
urllib.request.urlretrieve(skin_url, save_file_name)
實作后的效果如圖所示:
分享到這結束啦,更多Python精彩內容可以關注我看我主頁,爬蟲案例與多種游戲原始碼分享需要的朋友可以私信我交流,
轉載請註明出處,本文鏈接:https://www.uj5u.com/qita/299257.html
標籤:其他
