selenium 获取网页源码

最新推荐文章于 2024-05-29 05:59:30 发布

I天辉I

最新推荐文章于 2024-05-29 05:59:30 发布

阅读量3w

点赞数 5

分类专栏： Python_量化投资

Python_量化投资专栏收录该内容

75 篇文章 62 订阅

订阅专栏

selenium本是用来对web application做自动化测试的。不过，它有个天大的好处：能让我们用python(当然不仅是python)代码模拟人对浏览器的操作。
所需软件：python2.7 , firefox 25.0.1(版本不能太高), selenium2.44.0(使用pip install selenium安装即可)
1. 打开浏览器，请求百度主页，5秒钟后关闭浏览器

from selenium import webdriver
import time
brower = webdriver.Firefox()
brower.get('http://www.baidu.com')
time.sleep(5)
brower.close()
注意 url的写法，前面必须加 http://

2. 打开浏览器，请求一个带有动态内容的网页，等待js执行完毕（10秒钟足够），获取当前浏览器render的内容的源码，关闭浏览器

from selenium import webdriver
import time
browser = webdriver.Firefox()
browser.get('http://detail.tmall.com/item.htm?id=12577759834 ')
time.sleep(10)
pageSource = browser.page_source
print pageSource
browser.close()

确定要放弃本次机会？

福利倒计时

: :

立减 ¥

普通VIP年卡可用

立即使用

I天辉I

关注关注

5
点赞
踩
5

收藏

觉得还不错? 一键收藏
5
评论
selenium 获取网页源码

selenium本是用来对web application做自动化测试的。不过，它有个天大的好处：能让我们用python(当然不仅是python)代码模拟人对浏览器的操作。所需软件：python2.7 , firefox 25.0.1(版本不能太高), selenium2.44.0(使用pip install selenium安装即可)1. 打开浏览器，请求百度主页，5秒钟后关闭浏览器fro
复制链接

扫一扫