pyspider爬网页出现中文乱码的解决办法
2018-08-23 本文已影响0人
UU小宝
今天爬一个站,发现爬到的中文都是乱码,原因是pyspider内置的pyquery没有正确的解析目标站的编码,导致的解码失败,只需要自己在项目中转码一下即可。代码如下:
response.content = (response.content).decode('utf-8') #目标站是 utf-8 编码
今天爬一个站,发现爬到的中文都是乱码,原因是pyspider内置的pyquery没有正确的解析目标站的编码,导致的解码失败,只需要自己在项目中转码一下即可。代码如下:
response.content = (response.content).decode('utf-8') #目标站是 utf-8 编码