pyspider爬网页出现中文乱码的解决办法

今天爬一个站,发现爬到的中文都是乱码,原因是pyspider内置的pyquery没有正确的解析目标站的编码,导致的解码失败,只需要自己在项目中转码一下即可。代码如下:

response.content = (response.content).decode('utf-8') #目标站是 utf-8 编码

你可能感兴趣的:(pyspider爬网页出现中文乱码的解决办法)