溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

使用Python爬蟲怎么登陸到嗶哩嗶哩

發(fā)布時間:2020-12-21 15:27:11 來源:億速云 閱讀:217 作者:Leah 欄目:開發(fā)技術

這篇文章將為大家詳細講解有關使用Python爬蟲怎么登陸到嗶哩嗶哩,文章內容質量較高,因此小編分享給大家做個參考,希望大家閱讀完這篇文章后對相關知識有一定的了解。

編程思路

??首先利用xpath或者css選擇器等方法找到要輸入內容的元素位置,然后用自動化爬蟲工具Selenium模擬點擊輸入等操作來進行登錄并分析頁面,獲取點選驗證碼的點選圖片,通過將圖片發(fā)送給快識別打碼平臺識別后獲取坐標信息,根據快識別返回的數據,模擬坐標的點選,即可實現登錄。

前期準備

1.下載chrome driver

??就是下載谷歌瀏覽器的驅動器,當然如果你用其他瀏覽器那么就要下載其他瀏覽器的相應驅動,這里我以chrome瀏覽器為例,為什么要用英文呢?啊,這還用問當然是為了洋氣啦!(手動狗頭)
??下載驅動的時候必須要下載相應的版本,可以在瀏覽器上方輸入chrome://version,即可查看自己的chrome版本。

使用Python爬蟲怎么登陸到嗶哩嗶哩

然后進入 https://npm.taobao.org/mirrors/chromedriver/網站下載相應版本的驅動。

2.安裝selenium庫

??由于是第三方庫,所以在使用selenium之前需要先安裝:

pip install selenium

安裝的時候建議大家換鏡像源,具體方法可以參考這篇文章
鏈接: https://www.jb51.net/article/202564.htm

3.對接打碼平臺

??根據我們前面的編程思路我們需要到快識別網站http://www.kuaishibie.cn/根據給出的開發(fā)文檔和我們所需要的打碼功能構建一個自己的api。

代碼如下:

#快識別網址 http://www.kuaishibie.cn/
#interface
import base64
import json
import requests

def base64_api(uname,pwd,img):
 '''
 驗證碼識別接口
 :param uname: 快識別用戶名
 :param pwd: 快識別密碼
 :param img: 圖片路徑
 :return: 返回識別結果
 '''
 with open(img, 'rb') as f:
 base64_data = base64.b64encode(f.read())
 b64 = base64_data.decode()
 data = {"username": uname, "password": pwd, "image": b64,"typeid":21}
 #result = json.loads(requests.post("http://api.ttshitu.com/base64", json=data).text)
 result = json.loads(requests.post("http://api.ttshitu.com/imageXYPlus", json=data).text)
 if result['success']:
 return result["data"]["result"]
 else:
 return result["message"]

三、完整代碼

??代碼中的一些難點和相關步驟我都做了注釋,根據上面給出的編程思路大家一步一步做就好了,我就不再詳細解釋了,如果任何問題歡迎評論區(qū)提問或者私信我都可以喔~

#login_bilibili
from selenium import webdriver
import time
from PIL import Image
from selenium.webdriver import ActionChains #導入動作鏈模塊


KUAI_USERNAME = '快識別賬號'
KUAI_PASSWORD = '快識別密碼'

USERNAME = 'B站賬號'
PASSWORD = 'B站密碼'

#創(chuàng)建瀏覽器對象
driver = webdriver.Chrome(executable_path='chromedriver.exe')
#打開請求網頁頁面
driver.get('https://passport.bilibili.com/login')
driver.implicitly_wait(10) #隱式等待瀏覽器渲染完成,sleep是強制等待
#driver.execute_script("document.body.style.zoom='0.67'") #瀏覽器內容縮放67%
driver.maximize_window()#最大化瀏覽器

'''
用selenium自動化工具操作瀏覽器,操作的順序和平常用瀏覽器操作的順序是一樣的
'''

'''
找到用戶名和密碼框輸入密碼
'''
user_input = driver.find_element_by_xpath('//*[@id="login-username"]') #使用xpath定位用戶名標簽元素
user_input.send_keys(USERNAME)
time.sleep(1)

user_input = driver.find_element_by_xpath('//*[@id="login-passwd"]') #用戶密碼標簽
user_input.send_keys(PASSWORD)
time.sleep(1)

#點擊登錄
Login_input = driver.find_element_by_css_selector('#geetest-wrap > div > div.btn-box > a.btn.btn-login')
Login_input.click()
time.sleep(5)

#對圖片驗證碼進行提取
img_label = driver.find_element_by_css_selector('body > div.geetest_panel.geetest_wind > div.geetest_panel_box.geetest_no_logo.geetest_panelshowclick > div.geetest_panel_next > div > div') #提取圖片標簽

#保存圖片
driver.save_screenshot('big.png') #截取當前整個頁面
time.sleep(5)
#location可以獲取這個元素左上角坐標
print(img_label.location)
#size可以獲取這個元素的寬(width)和高(height)
print(img_label.size)

#計算驗證碼的左右上下橫切面
left = img_label.location['x']
top = img_label.location['y']
right = img_label.location['x'] + img_label.size['width']
down = img_label.location['y'] + img_label.size['height']

im = Image.open('big.png')
im = im.crop((left,top,right,down))
im.save('yzm.png')

#對接打碼平臺
from interface import base64_api #顯示報錯也無妨,可以運行的不要被唬住

img_path = 'yzm.png'
result = base64_api(uname=KUAI_USERNAME, pwd=KUAI_PASSWORD, img=img_path)
print(result)
print('驗證碼識別結果:', result)
result_list = result.split('|')
for result in result_list:
 x = result.split(',')[0]
 y = result.split(',')[1]
 ActionChains(driver).move_to_element_with_offset(img_label, int(x), int(y)).click().perform() # perform()執(zhí)行整個動作鏈

#點擊確認按鈕
driver.find_element_by_css_selector('body > div.geetest_panel.geetest_wind > div.geetest_panel_box.geetest_no_logo.geetest_panelshowclick > div.geetest_panel_next > div > div > div.geetest_panel > a > div').click()
input() # 用戶輸入 阻塞瀏覽器關閉
# 關閉瀏覽器
driver.quit()

注:chrome driver一定要和項目文件放在一起,這樣更加方便也更穩(wěn)定。interface接口文件最好也喝項目文件在一起,方便import導入

使用Python爬蟲怎么登陸到嗶哩嗶哩

關于使用Python爬蟲怎么登陸到嗶哩嗶哩就分享到這里了,希望以上內容可以對大家有一定的幫助,可以學到更多知識。如果覺得文章不錯,可以把它分享出去讓更多的人看到。

向AI問一下細節(jié)

免責聲明:本站發(fā)布的內容(圖片、視頻和文字)以原創(chuàng)、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI