Python使用cookielib模块操作cookie的实例教程-侯体宗的博客

Python使用cookielib模块操作cookie的实例教程
Python / 管理员发布于 8年前 292

cookielib是一个自动处理cookies的模块，如果我们在使用爬虫等技术的时候需要保存cookie，那么cookielib会让你事半功倍！他最常见的搭档模块就是python下的urllib和request。

核心类
1.Cookie
该类实现了Netscape and RFC 2965 cookies定义的cookie标准，基本可以理解为某一条cookie数据。
部分代码如下，很多属性是不是很眼熟？

    self.domain_initial_dot = domain_initial_dot    self.path = path    self.path_specified = path_specified    self.secure = secure    self.expires = expires    self.discard = discard    self.comment = comment    self.comment_url = comment_url    self.rfc2109 = rfc2109

2.CookiePolicy
该类的主要功能是收发cookie，即确保正确的cookie发往对应的域名，反之一样。
3.DefaultCookiePolicy
该类实现了CookiePolicy的接口。
4.CookieJar
CookieJar是cookie的集合，可以包含有很多Cookie类，是我们的主要操作对象。里面有一系列的方法可以支持更加细致的操作！
5.FileCookieJar
该类继承自CookieJar，CookieJar只是在内存中完成自己的生命周期，FileCookieJar的子类能够实现数据持久化，定义了save、load、revert三个接口。
6.MozillaCookieJar & LWPCookieJar
两个实现类，继承关系如下：

实例：登录人人网
在firefox下使用httpFox插件来查到人人网的登录时需要POST的地址是http://www.renren.com/ajaxLogin

而且查看到需要POST的DATA有email和password
python通过cookielib来处理cookie，以下是简单的代码

>>> import urllib>>> import urllib2,cookielib>>> login_page = "http://www.renren.com/ajaxLogin">>> cj = cookielib.CookieJar()>>> opener = urllib2.build_opener(urllib2.HTTPCookieProcessor(cj))>>> opener.add_handler = [('User-agent','Mozilla/4.0 (compatible; MSIE 6.0; Windows NT 5.1)')]>>> data = urllib.urlencode({"email":'username',"password":'password'}) >>> opener.open(login_page,data)<addinfourl at 53653216 whose fp = <socket._fileobject object at 0x03307B70>>>>> if cj:... for index,cookie in enumerate(cj):...  print index,':',cookie...  0 : <Cookie _de=90D533AE20EB964CA96710977F452897 for .renren.com/>1 : <Cookie anonymid=hlehtdzg-8359yw for .renren.com/>2 : <Cookie first_login_flag=1 for .renren.com/>3 : <Cookie id=224967207 for .renren.com/>4 : <Cookie loginfrom=null for .renren.com/>5 : <Cookie p=9beb60859c004bcaf0a32ff2c973473d7 for .renren.com/>6 : <Cookie societyguester=86b6a6006002ab6316f708521ab50bfc7 for .renren.com/>7 : <Cookie t=86b6a6006002ab6316f708521ab50bfc7 for .renren.com/>8 : <Cookie xnsid=fa53da51 for .renren.com/>9 : <Cookie t=30af9ffe774f4d6f242e92da1ccd6670 for .renren.com/xtalk/>10 : <Cookie feedType=224967207_hot for .www.renren.com/>11 : <Cookie JSESSIONID=abc3IP9kEhTExblxcRfeu for www.renren.com/>>>>

可以和firebug或者httpFox中得到的cookie进行对比，值可能不一致，但key基本上是一致的，你每次登录应该都不一致

我也尝试过使用fidder模拟发送没有cookie的POST数据，但是没有得到想要的返回值

而加上cookie信息以后就可以正常的跳转到自己的主页了

好了，基本上了解了python中使用cookie来发送登录信息，现在我们来写一个小脚本来登录自己人人网。

#encoding=utf-8import urllib2import urllibimport cookielibdef renrenBrower(url,user,password):  login_page = "http://www.renren.com/ajaxLogin"  try:        cj = cookielib.CookieJar()        opener=urllib2.build_opener(urllib2.HTTPCookieProcessor(cj))    opener.addheaders = [('User-agent','Mozilla/4.0 (compatible; MSIE 6.0; Windows NT 5.1)')]    data = urllib.urlencode({"email":user,"password":password})    opener.open(login_page,data)    op=opener.open(url)    data= op.read()    return data  except Exception,e:    print str(e)print renrenBrower("http://www.renren.com/home","用户名","密码")

这样就可以将自己首页的信息显示出来了，其实在登录完以后，还可以接着写脚本来获取自己想要的信息，如朋友的新鲜事等，这里就不作过多说明了~

您可能感兴趣的文章:

Python get获取页面cookie代码实例
Python Selenium Cookie 绕过验证码实现登录示例代码
python爬虫中get和post方法介绍以及cookie作用
Python爬虫番外篇之Cookie和Session详解
利用selenium 3.7和python3添加cookie模拟登陆的实现
Python HTTP客户端自定义Cookie实现实例
python模拟登录并且保持cookie的方法详解
Python爬虫利用cookie实现模拟登陆实例详解
qpython3 读取安卓lastpass Cookies
python3实现读取chrome浏览器cookie
玩转python爬虫之cookie使用方法
Python中urllib+urllib2+cookielib模块编写爬虫实战
Python3中关于cookie的创建与保存

上一条：
Python的面向对象编程方式学习笔记
下一条：
Python网络编程中urllib2模块的用法总结

0条评论 (评论内容有缓存机制,请悉知!)