1. 程式人生 > 程式設計 >用Python爬取LOL所有的英雄資訊以及英雄面板的示例程式碼

用Python爬取LOL所有的英雄資訊以及英雄面板的示例程式碼

實現思路:分為兩部分,第一部分,獲取網頁上資料並使用xlwt生成excel(當然你也可以選擇儲存到資料庫),第二部分獲取網頁資料使用IO流將圖片儲存到本地

一、爬取所有英雄屬性並生成excel

1.程式碼

import json

import requests
import xlwt

# 設定頭部資訊,防止被檢測出是爬蟲
headers = {
 'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML,like Gecko) Chrome/83.0.4103.116 Safari/537.36'
}
url = "https://game.gtimg.cn/images/lol/act/img/js/heroList/hero_list.js"
response = requests.get(url=url,headers=headers).text
loads = json.loads(response)
dic = loads['hero']
# 建立一個workbook 設定編碼
workbook = xlwt.Workbook(encoding='utf-8')
# 建立一個worksheet
worksheet = workbook.add_sheet('LOL')
try:
 for i in range(len(dic)):
  # 設定單元格寬度大小
  worksheet.col(i).width = 4000
  # 設定單元格高度大小
  style = xlwt.easyxf('font:height 300')
  worksheet.row(i).set_style(style)
  # 第一行用於寫入表頭
  if i == 0:
   worksheet.write(i,'編號')
   worksheet.write(i,1,'名稱')
   worksheet.write(i,2,'英文名')
   worksheet.write(i,3,'中文名')
   worksheet.write(i,4,'角色')
   worksheet.write(i,5,'物攻')
   worksheet.write(i,6,'物防')
   worksheet.write(i,7,'魔攻')
   worksheet.write(i,8,'魔防')
   continue
  worksheet.write(i,dic[i - 1]['heroId'])
  worksheet.write(i,dic[i - 1]['name'])
  worksheet.write(i,dic[i - 1]['alias'])
  worksheet.write(i,dic[i - 1]['title'])
  roles_ = dic[i - 1]['roles']
  roles = []
  for data in roles_:
   if 'mage' == data:
    roles.append('法師')
   if 'tank' == data:
    roles.append('坦克')
   if 'fighter' == data:
    roles.append('戰士')
   if 'marksman' == data:
    roles.append('ADC')
   if 'assassin' == data:
    roles.append('刺客')
   if 'support' == data:
    roles.append('輔助')
  worksheet.write(i,str(roles))
  worksheet.write(i,dic[i - 1]['attack'])
  worksheet.write(i,dic[i - 1]['defense'])
  worksheet.write(i,dic[i - 1]['magic'])
  worksheet.write(i,dic[i - 1]['difficulty'])
  # 儲存
 workbook.save('C:\\Users\\Jonsson\\Desktop\\lol.xls')
except Exception as e:
 print(e)

2.效果

用Python爬取LOL所有的英雄資訊以及英雄面板的示例程式碼

二、爬取所有英雄面板並儲存到本地

1.程式碼

import json
import os

import requests
import xlwt

# 設定頭部資訊,防止被檢測出是爬蟲
headers = {
 'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML,like Gecko) Chrome/83.0.4103.116 Safari/537.36'
}
url = "https://game.gtimg.cn/images/lol/act/img/js/heroList/hero_list.js"
# 請求英雄列表的url地址
response = requests.get(url=url,headers=headers).text
loads = json.loads(response)
dic = loads['hero']
for data in dic:
 id_ = data['heroId']
 skinUrl = 'https://game.gtimg.cn/images/lol/act/img/js/hero/%s.js' % id_
 # 請求每個英雄面板的url地址
 skinResponse = requests.get(url=skinUrl,headers=headers).text
 json_loads = json.loads(skinResponse)
 hero_ = json_loads['hero']
 save_path = './skin/%s-%s-%s' % (hero_["heroId"],hero_['name'],hero_['title'])
 # 資料夾不存在,則建立資料夾
 folder = os.path.exists(save_path)
 if not folder:
  os.makedirs(save_path)
 skins_ = json_loads['skins']
 for data in skins_:
  if data['chromas'] == '0':
   content = requests.get(url=data['mainImg'],headers=headers).content
   try:
    with open('%s/%s.jpg' % (save_path,data['name']),"wb") as f:
     print("正在下載英雄:%s 面板名稱:%s ..." % (hero_['name'],data['name']))
     f.write(content)
   except Exception as e:
    print('下載失敗')
    print(e)

2.效果

用Python爬取LOL所有的英雄資訊以及英雄面板的示例程式碼

用Python爬取LOL所有的英雄資訊以及英雄面板的示例程式碼

到此這篇關於用Python爬取LOL所有的英雄資訊以及英雄面板的示例程式碼的文章就介紹到這了,更多相關Python爬取LOL所有英雄內容請搜尋我們以前的文章或繼續瀏覽下面的相關文章希望大家以後多多支援我們!