大数据 爬虫Python AI Sql

学会Python之后!亲朋好友都夸我厉害!用Python买到最优

2018-07-17  本文已影响7人  919b0c54458f

excel表格:

词频统计:

爬取到的价格是string类型的,且有些价格并不明确的,所以这里需要对价格进行处理并排序,用到的list的sort(key=take_price)方法,其中key=take_price指定的方法,使用指定的方法去进行比较排序。

生成表格

这里采用的xlsxwriter库,便于图片的插入,安装pip install xlsxwriter

主要用到的方法:

xlsxwriter.Workbook("")创建excel表格。

add_worksheet("")创建工作表。

write(row, col, *args) 根据行、列坐标将数据写入单元格。

set_row(row, height) 设置行高。

set_column(first_col, last_col, width) 设置列宽,first_col 指定开始列位置,last_col 指定结束列位置。

insert_image(row, col, image[, options]) 用于插入图片到指定的单元格

创建两个表,一个用于存放爬取的数据,一个用于存放词频。

目录下会生成 furniture.xlsx 表格

生成词频

利用jieba分词对家具名进行分词处理,用字典保存各个名词的数量,写入到excel。

词频统计,实地去购买的时候,也可以根据相应的词汇去咨询卖家~

这篇文章用到的爬虫方面的知识还是比较基础的,excel表格的生成也是xlsxwriter库的使用,制作成表格也方便父母辈查看。当然,爬虫的数据还可以用在许多地方。

源码请私信小编,进群:125240963   即可获取数十套PDF哦!

上一篇下一篇

猜你喜欢

热点阅读