我爱编程

基于selenium和requests的京东商品爬虫

2017-10-06  本文已影响46人  AlanLau
摄于 2017年10月4日 舟山嵊山岛
写了个京东爬虫,基于selenium和requests两个包相结合的,能抓取产品的标题、价格、评论数量、产品的url、产品前100条评论(需要抓取更多可以在代码里面改动)、产品的规格、产品介绍、产品售后信息。数据结合peewee存入sqlite数据库。先执行JD_model.py建立数据库,然后主程序入口JDcrawler.py。现检索词为“电缆线”。
代码github
上一篇 下一篇

猜你喜欢

热点阅读