爬虫晋江TOP排行


```python
#coding:utf-8
import urllib.response,urllib.request
import re
import xlwt
from bs4 import BeautifulSoup
import requests
import gzip



findnum = re.compile(r'height="23">(\d+)</td>')
findauth = re.compile(r'" title="(.*?)">')
findname = re.compile(r'"tooltip">(.*?)</a>')
findinq = re.compile(r'rel="(.*?)..."',re.M)
findtype = re.compile(r'<td align="center">(.*?)[\s]*</td>')
findpro = re.compile(r'<font color="red">(.*?)</font>')
findwords = re.compile(r'<td align="right" height="23">(\d+)[\s]*</td>')




#获取网页链接
def geturl(baseurl):

    headers = {
   'User-Agent':'Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:106.0) Gecko/20100101 Firefox/106.0'}
    ip = {
   'http'
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值