斗鱼爬虫以及服务器部署

以下内容仅限于学习使用

用到的工具

  • selenium
  • python
  • docker 用来部署在云端服务器上
  • xpath 用来定位元素

爬了什么

主要爬了直播房间的名字、热度、作者、分类。
主要思路就是使用selenium直接爬

import time
import logging

from selenium import webdriver
from selenium.webdriver.chrome.options import Options
from selenium.webdriver.common.desired_capabilities import DesiredCapabilities

# LOG_FORMAT = "%(asctime)s - %(levelname)s - %(message)s"
# logging.basicConfig(filename='scrapy.log', level=logging.DEBUG,
#                     format=LOG_FORMAT)

with webdriver.Remote("http://127.0.0.1:4444/wd/hub",
                      DesiredCapabilities.CHROME) as driver:
    url = 'https://www.douyu.com/directory/all'

    driver.get(url)
    driver
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值