
写了个京东爬虫,基于selenium和requests两个包相结合的,能抓取产品的标题、价格、评论数量、产品的url、产品前100条评论(需要抓取更多可以在代码里面改动)、产品的规格、产品介绍、产品售后信息。数据结合peewee存入sqlite数据库。先执行JD_model.py建立数据库,然后主程序入口JDcrawler.py。现检索词为“电缆线”。
代码github

写了个京东爬虫,基于selenium和requests两个包相结合的,能抓取产品的标题、价格、评论数量、产品的url、产品前100条评论(需要抓取更多可以在代码里面改动)、产品的规格、产品介绍、产品售后信息。数据结合peewee存入sqlite数据库。先执行JD_model.py建立数据库,然后主程序入口JDcrawler.py。现检索词为“电缆线”。
代码github
1742

被折叠的 条评论
为什么被折叠?
