本文主要用python实现了对网站的模拟登陆。经过本身构造post数据来用Python实现登陆过程。
当你要模拟登陆一个网站时,首先要搞清楚网站的登陆处理细节(发了什么样的数据,给谁发等...)。我是经过HTTPfox来抓取http数据包来分析该网站的登陆流程。同时,咱们还要分析抓到的post包的数据结构和header,要根据提交的数据结构和heander来构造本身的post数据和header。
分析结束后,咱们要构造本身的HTTP数据包,并发送给指定url。咱们经过urllib2等几个模块提供的API来实现request请求的发送和相应的接收。
大部分网站登陆时须要携带cookie,因此咱们还必须设置cookie处理器来保证cookie。
具体代码和讲解以下
-
- import HTMLParser
- import urlparse
- import urllib
- import urllib2
- import cookielib
- import string
- import re
-
- hosturl = '******' //本身填写
- posturl = '******' //从数据包中分析出,处理post请求的url
-
- cj = cookielib.LWPCookieJar()
- cookie_support = urllib2.HTTPCookieProcessor(cj)
- opener = urllib2.build_opener(cookie_support, urllib2.HTTPHandler)
- urllib2.install_opener(opener)
-
- h = urllib2.urlopen(hosturl)
-
- headers = {'User-Agent' : 'Mozilla/5.0 (Windows NT 6.1; WOW64; rv:14.0) Gecko/20100101 Firefox/14.0.1',
- 'Referer' : '******'}
- postData = {'op' : 'dmlogin',
- 'f' : 'st',
- 'user' : '******', //你的用户名
- 'pass' : '******', //你的密码,密码多是明文传输也多是密文,若是是密文须要调用相应的加密算法加密
- 'rmbr' : 'true', //特有数据,不一样网站可能不一样
- 'tmp' : '0.7306424454308195' //特有数据,不一样网站可能不一样
-
- }
-
- postData = urllib.urlencode(postData)
-
- request = urllib2.Request(posturl, postData, headers)
- print request
- response = urllib2.urlopen(request)
- text = response.read()
- print text