cookie: 一种客户端会话技术,客户登录成功后,服务端将可识别用户的凭证传到客户端,由客户端负责保存维护。一般会设定一定有效时长,在有效时长内,客户无需再次进行登录操作,可直接携带cookie
登录。
本文仅演示携带cookie登陆,所以cookie通过手动获取。如何自动获取豆瓣的cookie,请看 selenium登录豆瓣网
手动将cookie复制下来。得到这样的数据:
name1=data1;name2=data2;name3=data3;…
将得到的cookie数据,转为字典
格式
cookie_info = 'name1=data1;name2="data2"'
cookie_list = [info.strip().split('=') for info in cookie_info.split(';')]
cookies = {data[0]:data[1].replace('"','') for data in cookie_list}
print(cookies)
结果:
{'name1': 'data1', 'name2': 'data2'}
import requests
cookie_info = 'your cookiedata'
cookie_list = [info.strip().split('=') for info in cookie_info.split(';')]
cookies = {data[0]:data[1].replace('"','') for data in cookie_list}
url = 'https://www.douban.com/'
headers = {
'User-Agent':'Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/536.5 (KHTML, like Gecko) Chrome/19.0.1084.9 Safari/536.5',
}
html = requests.get(url,headers=headers,cookies=cookies).content.decode()
print(html)
结果:
如图,在打印的html中能看到自己的账号名称,证明登陆成功了。
思考:
登陆成功后,访问网站的其他页面,一般也需要携带cookie,才能进行访问。当然,我们可以在每个请求中,都加上cookie,但这无疑显得有些繁琐。能否在请求的时候自动携带呢?这就需要session
来帮忙了。
详见下篇 requests使用session保持会话
博主其他文章推荐:
[1] 【python实用特性】-切片
[2] 【python实用特性】- 迭代、可迭代对象、迭代器
[3] 【python实用特性】- 列表生成式
[4] 【python实用特性】- yield生成器
[5] matplotlib自定义坐标轴刻度完成20万+数据的可视化
[6] Python+selenium实现自动爬取实例
[7] python爬取豆瓣Top250-改进版
[8] requests 设置请求头、代理