py爬取的html中文乱码
2017-03-31 本文已影响0人
魂_影__LHT
今天从美剧天堂爬取网页时,中文出现乱码,从网站代码看是Charest=gb2312,所以对爬取的html进行处理。
html = unicode(html, "gb2312").encode("utf8")可得到正常的中文编码。
今天从美剧天堂爬取网页时,中文出现乱码,从网站代码看是Charest=gb2312,所以对爬取的html进行处理。
html = unicode(html, "gb2312").encode("utf8")可得到正常的中文编码。