接着上一步模拟登录操作。学了两天的session 了没有搞定登录。还是回到selenium模拟登录爬取。但是验证码这一块,没有搞定,在文中用的人工辅助登录成功。代码太丑,实在是无言面对同行。
import time
from selenium import webdriver
import csv
from lxml import etree
browser = webdriver.Firefox() # 先模拟登录
url = 'http://www.dxy.cn/bbs/thread/626626#626626/' #丁香医生
browser.get(url)
time.sleep(3)
browser.maximize_window()#打开网页窗口
time.sleep(4)
#denglu = browser.find_element_by_class_name("activate-info-tip-btn")[1]#账号输入框 'FirefoxWebElement' object does not support indexing
denglu = browser.find_element_by_xpath('//div[@class="nav_account"]/a') #找到第一个a节点
denglu.click() #点击进入到登录网站
time.sleep(4)
dl = browser.find_element_by_xpath('//a/i[@class="wechat__ico ico_pc"]')
dl.click()
time.sleep(5) #这里进入电脑版登录界面
input= browser.find_element_by_name("username") #找到账号输入的地方
input.send_keys("17353239795")
passwor