Python爬虫入门【15】：煎蛋网XXOO图片抓取

最新推荐文章于 2021-02-03 11:31:42 发布

VIP文章未衬老师

最新推荐文章于 2021-02-03 11:31:42 发布

阅读量1.7w

点赞数

文章标签： Python 爬虫

本文链接：https://blog.csdn.net/weichen090909/article/details/97034311

版权

今天写一个爬虫爱好者特别喜欢的网站煎蛋网http://jandan.net/ooxx，这个网站其实还是有点意思的，网站很多人写了N多的教程了，各种方式的都有，当然网站本身在爬虫爱好者的不断进攻下，也在不断的完善，反爬措施也很多，今天我用selenium在揍他一波。

整体看上去，煎蛋网的妹子图质量还是可以的，不是很多，但是还蛮有味道的，这可能也是爬虫er，一批一批的奔赴上去的原因。

1. 网站分析

这个网站如果用 selenium 爬取，其实也没什么要分析的,模拟访问就行，导入必备的模块。

from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
from lxml import etree
import requests

import time

我使用的是PhantomJS 去加载浏览器，关于这个

最低0.47元/天解锁文章

未衬老师

关注

0
点赞
踩
2

收藏

觉得还不错? 一键收藏
0
评论
Python爬虫入门【15】：煎蛋网XXOO图片抓取

今天写一个爬虫爱好者特别喜欢的网站煎蛋网http://jandan.net/ooxx，这个网站其实还是有点意思的，网站很多人写了N多的教程了，各种方式的都有，当然网站本身在爬虫爱好者的不断进攻下，也在不断的完善，反爬措施也很多，今天我用selenium在揍他一波。整体看上去，煎蛋网的妹子图质量还是可以的，不是很多，但是还蛮有味道的，这可能也是爬虫er，一批一批的奔赴上去的原因。1. 网站分析...
复制链接

扫一扫