pyspider爬网页出现中文乱码的解决办法

2018-08-23  本文已影响0人  UU小宝

今天爬一个站,发现爬到的中文都是乱码,原因是pyspider内置的pyquery没有正确的解析目标站的编码,导致的解码失败,只需要自己在项目中转码一下即可。代码如下:

response.content = (response.content).decode('utf-8') #目标站是 utf-8 编码

上一篇下一篇

猜你喜欢

热点阅读