Selenium

 

 

1.安装:pip install Selenium==3.0.1

或  从官网https://pypi.python.org/pypi/selenium下载源代码压缩后,运行python setup.py install

selenium3.x调用浏览器必须下载一个类似补丁的文件,比如Firefox的为geckodriver,Chrome的为chromedriver    

本版本补丁下载地址:http://www.seleniumhq.org/download/     将下载补丁所在目录添加到环境变量

2.快速入门

 1 # _*_ coding:utf-8 _*_
 2 __author__ = 'boby'
 3 __date__ = '2018/5/27 0027 上午 9:35'
 4 from selenium import webdriver
 5 from selenium.webdriver.common.keys import Keys
 6 import time
 7 
 8 driver= webdriver.Chrome(r'C:\Users\Administrator\AppData\Local\Google\Chrome\Application\chromedriver.exe')
 9 driver.get('http://www.baidu.com')
10 assert u'百度' in driver.title
11 elem= driver.find_element_by_name('wd')
12 elem.clear()
13 elem.send_keys(u"网络爬虫")
14 elem.send_keys(Keys.RETURN)
15 time.sleep(3)
16 assert u"网络爬虫." not in driver.page_source
17 driver.close()

 

 

除了上面具有确定功能的方法,还有两个通用的方法find_element 和 find_elements,可以通过传入参数来指定功能。

实例如下:

from selenium.webdriver.common.by import By
driver.find_element(By.XPATH,'//button[text()="Some text"]')
#通过xpath表达式来查找

该方式的第一个参数还有:

 页面的操作:

 1 <html>
 2 <heade>
 3 <meta http-equiv='content-type' content='text/html;charset=gbk'>
 4 <head>
 5     <body>
 6     <h1>Welcome</h1>
 7     <p class="content">用户登录<p>
 8             <form id='loginForm'>
 9                   <select name="loginways">
10                             <option value="email">邮箱</option>
11                             <option value="mobile">手机号</option>
12                             <option value='name'>用户名</option>
13                   </select>
14                   <br/>
15                         <input name="username" type="text"/>
16                         <br/>
17                          密码
18                         <br/>
19                          <input name="password" type="password" />
20                          <br/><br/>
21                          <input name="continue" type="submit" value="login" />
22                           <input name="continue" type="button" value="Clear" />
23              </from>
24        <a href="register.html">Register</a>
25 
26 <body>
27 
28 </html>

 

 1.页面交互与填充表单

driver = webdriver.Chrome()
driver.get("f://login.html")

#初始化chrome浏览器,打开html文档

#获取用户名和密码输入框,和登录按钮
username= driver.find_element_by_name('username')
password=driver.find_element_by_xpath(".//*[@id='loginForm']/input[2]")
login_button=driver.find_element_by_xpath("//input[@type='submit']")



#使用send_keys()方法输入用户名和密码,使用click方法模拟点击登录
username.clear()
username.send_key('qiye')
password.send_keys('qiye_pass')
login_button.click()
#操作下拉选择方式

select= driver.find_element_by_xpath("//form/select")
all_options=select.fing_elements_by_tag_name('option')
for option in all_options:
print("Value is :%s"% option.get_attribute('value'))
option.click()
----------------------------------------------------
from selenium.webdriver.support.ui import Select
select=Select(driver.find_element_by_xpath('//form/select'))
select.select_by_index(index)
select.select_by_visible_text['text']
select.select_by_value(value)
#根据索引,文字,value值来选择选项卡中的某一项


 

3.窗口和页面frame的切换
一个浏览器一般都会开多个窗口,我们可以switch_to_window方法实现指定窗口的切换
driver.switch_to_windos('windowName')
也可以通过windows handle 来获取每个窗口的操作对象。如下:
for handle in driver.window_handles:
driver.switch_to_window(handle)
如需切换页面frame,可以使用switch_to_frame方法,实例如下:
driver.switch_to_frame('frameName')
driver.switch_to_frame('frameName.0.child')

4.弹窗处理
alert= driver.switch_to_alert()
alert.dismiss()


5.历史记录 页面的前进与后退
driver.forward()
driver.back()


6.Cookie处理
driver.get("http://www.baidu.com")
cookie={'name':'foo','value':'bar'}
driver.add_cookie(cookie)
dirver.get_cookie()

7.设置PhantomJS请求头中的User-Agent
一般针对phantonJS的反爬措施,默认的User-Agent中含有phantomJS内容,可以通过以下内容进行修改。

 dcap=dict(DesiredCapabilities.PHANTOMJS)

dcap["phantomjs.page.settings.userAgent"]=(

     "MOzilla/5.0(Linus;Android 5.1.1;Nexus 6 BUild/LYZ28E) AppleWebKit/537.36(KHTML,like Gecko) Chrome/48.0.2564.23 MObile Safari/537.36"

)

driver=webriver.PhantomJS()

driver.get('http://www.google.com')

driver.quit()

 等待

 

由于现在的很多网站采用Ajax技术,不确定网页元素什么时候能够完全加载,所以网页元素选择会比较困难,这时候就需要等待。Selenium有两种等待凡是:显示,隐式

#显示等待
from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import webDriverWait
from selenium.webdriver.support import expected_conditions as EC

driver= webdriver.Chrome(r'C:\Users\Administrator\AppData\Local\Google\Chrome\Application\chromedriver.exe')
driver.get('http://somedomain/url_that_delays_loading')
try:
    element= WebDriverWait(driver,10).until(
              EC.precence_of_element_located((By.ID,'myDynamicElement'))
)
finally:
    driver.quit()

 





 隐式等待

作用范围是Webdriver对象实例的整个生命周期,也就是说Webdriver执行每条命令的超时时间都是如此

from selenium import webdriver
driver  = webdriver.CHrome(r'C:\Users\Administrator\AppData\Local\Google\Chrome\Application\chromedriver.exe')
driver.implicitly_wait(100)
driver.get('http://baidu.com')
myDynameElement= driver.find_element_by_id("myDynamicElement")

 

线程休眠

time.sleep(time)

 

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
代码下载:完整代码,可直接运行 ;运行版本:2022a或2019b或2014a;若运行有问题,可私信博主; **仿真咨询 1 各类智能优化算法改进及应用** 生产调度、经济调度、装配线调度、充电优化、车间调度、发车优化、水库调度、三维装箱、物流选址、货位优化、公交排班优化、充电桩布局优化、车间布局优化、集装箱船配载优化、水泵组合优化、解医疗资源分配优化、设施布局优化、可视域基站和无人机选址优化 **2 机器学习和深度学习方面** 卷积神经网络(CNN)、LSTM、支持向量机(SVM)、最小二乘支持向量机(LSSVM)、极限学习机(ELM)、核极限学习机(KELM)、BP、RBF、宽度学习、DBN、RF、RBF、DELM、XGBOOST、TCN实现风电预测、光伏预测、电池寿命预测、辐射源识别、交通流预测、负荷预测、股价预测、PM2.5浓度预测、电池健康状态预测、水体光学参数反演、NLOS信号识别、地铁停车精准预测、变压器故障诊断 **3 图像处理方面** 图像识别、图像分割、图像检测、图像隐藏、图像配准、图像拼接、图像融合、图像增强、图像压缩感知 **4 路径规划方面** 旅行商问题(TSP)、车辆路径问题(VRP、MVRP、CVRP、VRPTW等)、无人机三维路径规划、无人机协同、无人机编队、机器人路径规划、栅格地图路径规划、多式联运运输问题、车辆协同无人机路径规划、天线线性阵列分布优化、车间布局优化 **5 无人机应用方面** 无人机路径规划、无人机控制、无人机编队、无人机协同、无人机任务分配 **6 无线传感器定位及布局方面** 传感器部署优化、通信协议优化、路由优化、目标定位优化、Dv-Hop定位优化、Leach协议优化、WSN覆盖优化、组播优化、RSSI定位优化 **7 信号处理方面** 信号识别、信号加密、信号去噪、信号增强、雷达信号处理、信号水印嵌入提取、肌电信号、脑电信号、信号配时优化 **8 电力系统方面** 微电网优化、无功优化、配电网重构、储能配置 **9 元胞自动机方面** 交通流 人群疏散 病毒扩散 晶体生长 **10 雷达方面** 卡尔曼滤波跟踪、航迹关联、航迹融合

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值