requests使用cookie模拟登陆豆瓣

cookie: 一种客户端会话技术,客户登录成功后,服务端将可识别用户的凭证传到客户端,由客户端负责保存维护。一般会设定一定有效时长,在有效时长内,客户无需再次进行登录操作,可直接携带cookie登录。

本文仅演示携带cookie登陆,所以cookie通过手动获取。如何自动获取豆瓣的cookie,请看 selenium登录豆瓣网

1、手动登陆,获取cookie

requests使用cookie模拟登陆豆瓣_第1张图片
手动将cookie复制下来。得到这样的数据:
name1=data1;name2=data2;name3=data3;…

2、cookie数据解析

将得到的cookie数据,转为字典格式

cookie_info = 'name1=data1;name2="data2"'
cookie_list = [info.strip().split('=') for info in cookie_info.split(';')]
cookies = {data[0]:data[1].replace('"','') for data in cookie_list}
print(cookies)

结果:
{'name1': 'data1', 'name2': 'data2'}
3、携带cookie登陆
import requests
cookie_info = 'your cookiedata'
cookie_list = [info.strip().split('=') for info in cookie_info.split(';')]
cookies = {data[0]:data[1].replace('"','') for data in cookie_list}
url = 'https://www.douban.com/'
headers = {
            'User-Agent':'Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/536.5 (KHTML, like Gecko) Chrome/19.0.1084.9 Safari/536.5',
        }
html = requests.get(url,headers=headers,cookies=cookies).content.decode()
print(html)

结果:
requests使用cookie模拟登陆豆瓣_第2张图片
如图,在打印的html中能看到自己的账号名称,证明登陆成功了。

思考:
登陆成功后,访问网站的其他页面,一般也需要携带cookie,才能进行访问。当然,我们可以在每个请求中,都加上cookie,但这无疑显得有些繁琐。能否在请求的时候自动携带呢?这就需要session来帮忙了。
详见下篇 requests使用session保持会话

博主其他文章推荐:
[1] 【python实用特性】-切片

[2] 【python实用特性】- 迭代、可迭代对象、迭代器

[3] 【python实用特性】- 列表生成式

[4] 【python实用特性】- yield生成器

[5] matplotlib自定义坐标轴刻度完成20万+数据的可视化

[6] Python+selenium实现自动爬取实例

[7] python爬取豆瓣Top250-改进版

[8] requests 设置请求头、代理

你可能感兴趣的:(requests库的使用)