基于selenium和requests的京东商品信息和评论爬虫

版权声明:本文为博主原创文章,未经博主允许不得转载。 https://blog.csdn.net/AlanConstantineLau/article/details/78167521

摄于 2017年10月4日 舟山嵊山岛

写了个京东爬虫,基于selenium和requests两个包相结合的,能抓取产品的标题、价格、评论数量、产品的url、产品前100条评论(需要抓取更多可以在代码里面改动)、产品的规格、产品介绍、产品售后信息。数据结合peewee存入sqlite数据库。先执行JD_model.py建立数据库,然后主程序入口JDcrawler.py。现检索词为“电缆线”。
代码github

猜你喜欢

转载自blog.csdn.net/AlanConstantineLau/article/details/78167521