python:3种爬虫的优缺点

2018-03-18  本文已影响0人  TO_AG

                                                                 性能对比

当网页结构简单并且想要避免额外依赖(不需要安装库),使用正则表达式更为合适。当需要爬取数据量较少时,使用较慢的BeautifulSoup也可以的。当数据量大时,需要追求效益时,Lxml时最好选择。

上一篇 下一篇

猜你喜欢

热点阅读