如何用Python Selenium实现12306网站模拟登录操作?
- 内容介绍
- 文章标签
- 相关推荐
本文共计1459个文字,预计阅读时间需要6分钟。
简介:利用selenium和图像识别技术进行验证,实现12:30的模拟登录,参考了多个项目,制作了小demo,过程中遇到了很多坑,主要难点在于图像识别和滑动验证。
简介:
这里是利用了selenium+图片识别验证,来实现12306的模拟登录,中间也参考了好几个项目,实现了这个小demo,中间也遇到了很多的坑,主要难点在于图片识别和滑动验证这两个方面,图片识别是利用超级鹰的服务进行验证识别的,其次一个难点就是在账户密码和图片识别都过了以后的滑动验证,因为12306网站做了反爬,利用selenium滑动时,会报错,提示你一直刷新,这里也是更改了滑动框。
技术栈:
python、selenium、图片验证、滑动验证
思路:
提前卧槽,12306网站的并发真的牛逼。
在模拟登录的时候,第一个难点就是图片验证,这里不会底层的算法,只能通过图片识别平台的api接口服务进行解密,返回验证坐标以后,通过selenium的点击动能,进行点击,在这里提前说明一下,网上有很多项目在实例化浏览器时,需要调整桌面分辨率,然后最大化窗口,这样截屏才不会出现截不全的情况,我这边是比较省事的,直接用xpath定位到验证码的png文件。直接写入到本地,然后传到图片识别平台进行识别。
里面涉及了一些selenium的方法,我基本上都是现查现用,比如按住鼠标不放、按左键什么的。
具体的代码和注解贴在下面,
fromseleniumimportwebdriver fromhashlibimportmd5 importrequests importtime fromselenium.webdriverimportActionChains #这个类是超级鹰平台写的调用服务的接口代码,也是比较容易看懂的 classChaojiying_Client(object): def__init__(self,username,password,soft_id): self.username=username password=password.encode('utf8') self.password=md5(password).hexdigest() self.soft_id=soft_id self.base_params={ 'user':self.username, 'pass2':self.password, 'softid':self.soft_id, } self.headers={ 'Connection':'Keep-Alive', 'User-Agent':'Mozilla/4.0(compatible;MSIE8.0;WindowsNT5.1;Trident/4.0)', } defPostPic(self,im,codetype): """ im:图片字节 codetype:题目类型参考www.chaojiying.com/price.html """ params={ 'codetype':codetype, } params.update(self.base_params) files={'userfile':('ccc.jpg',im)} r=requests.post('upload.chaojiying.net/Upload/Processing.php',data=params,files=files,headers=self.headers) returnr.json() defReportError(self,im_id): """ im_id:报错题目的图片ID """ params={ 'id':im_id, } params.update(self.base_params) r=requests.post('upload.chaojiying.net/Upload/ReportError.php',data=params,headers=self.headers) returnr.json() #这里进入模拟登录的主程序 #实例化浏览器,并且最大化。然后请求12306主网站,我这里是从首页请求的,大家可以直接从登陆页面请求 browser=webdriver.Chrome() browser.maximize_window() browser.get('12306.cn/') time.sleep(5) #因为是从首页请求的,所以下面有两个点击的动作,都是为了点进登陆页面 browser.find_element_by_xpath('//*[@id="J-header-login"]/a[1]').click() time.sleep(0.3) #这里比较重要了,这里就是利用这个代码,来更改selenium中的滑动功能,让网站不报错 script='Object.defineProperty(navigator,"webdriver",{get:()=>undefined,});' browser.execute_script(script) time.sleep(1) #这里进入帐号登录 browser.find_element_by_xpath('/html/body/div[2]/div[2]/ul/li[2]/a').click() time.sleep(0.3) #这里直接定位验证码的png文件,然后保存 img=browser.find_element_by_xpath('//*[@id="J-loginImg"]') img.screenshot('cde.png') #调用超级鹰的参数 chaojiying=Chaojiying_Client('用户名','密码','ID')#这个在超级鹰的实例代码中有解释 im=open('../12306/cde.png','rb').read() #注意,这里返回的是一个字典格式,所以直接取要用的key,来返回坐标 result=chaojiying.PostPic(im,9004)['pic_str'] print(result) #这里就是处理超级鹰返回坐标的方法了 all_list=[] #通过判断超级鹰返回坐标的格式进行坐标处理, #返回的坐标有两种形式,一种是以|隔开的,一种是用,隔开的,对应下面两种处理方式 #处理好的坐标存入list if'|'inresult: list=result.split('|') foriinrange(len(list)): x_y=[] x=int(list[i].split(',')[0]) y=int(list[i].split(',')[1]) x_y.append(x) x_y.append(y) all_list.append(x_y) else: x_y=[] x=int(result.split(',')[0]) y=int(result.split(',')[1]) x_y.append(x) x_y.append(y) all_list.append(x_y) print(all_list) #处理好的坐标进行循环,并带入selenium进行点击点击 forlinall_list: x=l[0] y=l[1] ActionChains(browser).move_to_element_with_offset( img,x,y).click().perform() time.sleep(0.5) #图片点击好以后,向表单内发送账户密码 browser.find_element_by_xpath('//*[@id="J-userName"]').send_keys('账号') browser.find_element_by_xpath('//*[@id="J-password"]').send_keys('密码') #进行点击登录按钮 browser.find_element_by_xpath('//*[@id="J-login"]').click() time.sleep(2) #下面就是滑动模块了 #上面已经更改过selenium的滑动模块,所以这里就可以直接定位到按钮的位置,进行点击滑动 span=browser.find_element_by_xpath('//*[@id="nc_1_n1z"]') action=ActionChains(browser) #这里是selenium的方法,按住点击不放 action.click_and_hold(span) #下面就是滑动了 action.drag_and_drop_by_offset(span,400,0).perform() #这里加了个循环,就是滑动不行,一直刷新继续滑动,直到成功 #其实这里也只是为了保险起见,因为上面改了滑动框,基本上都会成功 whileTrue: try: info=browser.find_element_by_xpath('//*[@id="J-slide-passcode"]/div/span').text print(info) ifinfo=='哎呀,出错了,点击刷新再来一次': #点击刷新 browser.find_element_by_xpath('//*[@id="J-slide-passcode"]/div/span/a').click() time.sleep(0.2) #重新移动滑块 span=browser.find_element_by_xpath('//*[@id="nc_1_n1z"]') action=ActionChains(browser) #点击长按指定的标签 action.click_and_hold(span).perform() action.drag_and_drop_by_offset(span,400,0).perform() time.sleep(5) except: print('ok!') break #完成后,松开鼠标 action.release() time.sleep(5) #退出 browser.quit()
最后想说的是
实现抢票的事,这个我还暂时没想好怎么去做
平时工作比较忙
所以以后实现这个功能吧
拜拜~
以上就是python+selenium实现12306模拟登录的步骤的详细内容,更多关于python 12306模拟登录的资料请关注易盾网络其它相关文章!
本文共计1459个文字,预计阅读时间需要6分钟。
简介:利用selenium和图像识别技术进行验证,实现12:30的模拟登录,参考了多个项目,制作了小demo,过程中遇到了很多坑,主要难点在于图像识别和滑动验证。
简介:
这里是利用了selenium+图片识别验证,来实现12306的模拟登录,中间也参考了好几个项目,实现了这个小demo,中间也遇到了很多的坑,主要难点在于图片识别和滑动验证这两个方面,图片识别是利用超级鹰的服务进行验证识别的,其次一个难点就是在账户密码和图片识别都过了以后的滑动验证,因为12306网站做了反爬,利用selenium滑动时,会报错,提示你一直刷新,这里也是更改了滑动框。
技术栈:
python、selenium、图片验证、滑动验证
思路:
提前卧槽,12306网站的并发真的牛逼。
在模拟登录的时候,第一个难点就是图片验证,这里不会底层的算法,只能通过图片识别平台的api接口服务进行解密,返回验证坐标以后,通过selenium的点击动能,进行点击,在这里提前说明一下,网上有很多项目在实例化浏览器时,需要调整桌面分辨率,然后最大化窗口,这样截屏才不会出现截不全的情况,我这边是比较省事的,直接用xpath定位到验证码的png文件。直接写入到本地,然后传到图片识别平台进行识别。
里面涉及了一些selenium的方法,我基本上都是现查现用,比如按住鼠标不放、按左键什么的。
具体的代码和注解贴在下面,
fromseleniumimportwebdriver fromhashlibimportmd5 importrequests importtime fromselenium.webdriverimportActionChains #这个类是超级鹰平台写的调用服务的接口代码,也是比较容易看懂的 classChaojiying_Client(object): def__init__(self,username,password,soft_id): self.username=username password=password.encode('utf8') self.password=md5(password).hexdigest() self.soft_id=soft_id self.base_params={ 'user':self.username, 'pass2':self.password, 'softid':self.soft_id, } self.headers={ 'Connection':'Keep-Alive', 'User-Agent':'Mozilla/4.0(compatible;MSIE8.0;WindowsNT5.1;Trident/4.0)', } defPostPic(self,im,codetype): """ im:图片字节 codetype:题目类型参考www.chaojiying.com/price.html """ params={ 'codetype':codetype, } params.update(self.base_params) files={'userfile':('ccc.jpg',im)} r=requests.post('upload.chaojiying.net/Upload/Processing.php',data=params,files=files,headers=self.headers) returnr.json() defReportError(self,im_id): """ im_id:报错题目的图片ID """ params={ 'id':im_id, } params.update(self.base_params) r=requests.post('upload.chaojiying.net/Upload/ReportError.php',data=params,headers=self.headers) returnr.json() #这里进入模拟登录的主程序 #实例化浏览器,并且最大化。然后请求12306主网站,我这里是从首页请求的,大家可以直接从登陆页面请求 browser=webdriver.Chrome() browser.maximize_window() browser.get('12306.cn/') time.sleep(5) #因为是从首页请求的,所以下面有两个点击的动作,都是为了点进登陆页面 browser.find_element_by_xpath('//*[@id="J-header-login"]/a[1]').click() time.sleep(0.3) #这里比较重要了,这里就是利用这个代码,来更改selenium中的滑动功能,让网站不报错 script='Object.defineProperty(navigator,"webdriver",{get:()=>undefined,});' browser.execute_script(script) time.sleep(1) #这里进入帐号登录 browser.find_element_by_xpath('/html/body/div[2]/div[2]/ul/li[2]/a').click() time.sleep(0.3) #这里直接定位验证码的png文件,然后保存 img=browser.find_element_by_xpath('//*[@id="J-loginImg"]') img.screenshot('cde.png') #调用超级鹰的参数 chaojiying=Chaojiying_Client('用户名','密码','ID')#这个在超级鹰的实例代码中有解释 im=open('../12306/cde.png','rb').read() #注意,这里返回的是一个字典格式,所以直接取要用的key,来返回坐标 result=chaojiying.PostPic(im,9004)['pic_str'] print(result) #这里就是处理超级鹰返回坐标的方法了 all_list=[] #通过判断超级鹰返回坐标的格式进行坐标处理, #返回的坐标有两种形式,一种是以|隔开的,一种是用,隔开的,对应下面两种处理方式 #处理好的坐标存入list if'|'inresult: list=result.split('|') foriinrange(len(list)): x_y=[] x=int(list[i].split(',')[0]) y=int(list[i].split(',')[1]) x_y.append(x) x_y.append(y) all_list.append(x_y) else: x_y=[] x=int(result.split(',')[0]) y=int(result.split(',')[1]) x_y.append(x) x_y.append(y) all_list.append(x_y) print(all_list) #处理好的坐标进行循环,并带入selenium进行点击点击 forlinall_list: x=l[0] y=l[1] ActionChains(browser).move_to_element_with_offset( img,x,y).click().perform() time.sleep(0.5) #图片点击好以后,向表单内发送账户密码 browser.find_element_by_xpath('//*[@id="J-userName"]').send_keys('账号') browser.find_element_by_xpath('//*[@id="J-password"]').send_keys('密码') #进行点击登录按钮 browser.find_element_by_xpath('//*[@id="J-login"]').click() time.sleep(2) #下面就是滑动模块了 #上面已经更改过selenium的滑动模块,所以这里就可以直接定位到按钮的位置,进行点击滑动 span=browser.find_element_by_xpath('//*[@id="nc_1_n1z"]') action=ActionChains(browser) #这里是selenium的方法,按住点击不放 action.click_and_hold(span) #下面就是滑动了 action.drag_and_drop_by_offset(span,400,0).perform() #这里加了个循环,就是滑动不行,一直刷新继续滑动,直到成功 #其实这里也只是为了保险起见,因为上面改了滑动框,基本上都会成功 whileTrue: try: info=browser.find_element_by_xpath('//*[@id="J-slide-passcode"]/div/span').text print(info) ifinfo=='哎呀,出错了,点击刷新再来一次': #点击刷新 browser.find_element_by_xpath('//*[@id="J-slide-passcode"]/div/span/a').click() time.sleep(0.2) #重新移动滑块 span=browser.find_element_by_xpath('//*[@id="nc_1_n1z"]') action=ActionChains(browser) #点击长按指定的标签 action.click_and_hold(span).perform() action.drag_and_drop_by_offset(span,400,0).perform() time.sleep(5) except: print('ok!') break #完成后,松开鼠标 action.release() time.sleep(5) #退出 browser.quit()
最后想说的是
实现抢票的事,这个我还暂时没想好怎么去做
平时工作比较忙
所以以后实现这个功能吧
拜拜~
以上就是python+selenium实现12306模拟登录的步骤的详细内容,更多关于python 12306模拟登录的资料请关注易盾网络其它相关文章!

