案例：使用XPath的爬虫（把某贴吧的照片保存到本地）

最新推荐文章于 2024-04-07 08:00:00 发布

super选择题

最新推荐文章于 2024-04-07 08:00:00 发布

阅读量803

点赞数 4

分类专栏： python 文章标签：把某贴吧的照片保存到本地案例：使用XPath的爬虫

本文链接：https://blog.csdn.net/superxzt/article/details/84726734

版权

本案例展示了如何利用XPath进行网页爬虫，具体目标是从指定贴吧抓取每个帖子内的所有楼层图片，并将其下载存储到本地。通过运行，实现了从网上获取图片并成功保存的功能。

摘要由CSDN通过智能技术生成

案例：使用XPath的爬虫

现在我们用XPath来做一个简单的爬虫，我们尝试爬取某个贴吧里的所有帖子，并且将该这个帖子里每个楼层发布的图片下载到本地。

# tieba_xpath.py
#!/usr/bin/env python# -*- coding:utf-8 -*-
import os
import urllib
import urllib2
from lxml import etree
class tieba_xpath:
    def __init__(self):
        self.tiebaName = raw_input("请需要访问的贴吧：")
        self.beginPage = int(raw_input("请输入起始页："))
        self.endPage = int(raw_input("请输入终止页："))

        self.url = 'http://tieba.baidu.com/f'
        self.ua_header = {"User-Agent" : "Mozilla/5.0 (compatible; MSIE 9.0; Windows NT 6.1 Trident/5.0;"}

        # 图片编号
        self.userName = 1

    def tiebaSpider(self):
        for page in range(self.beginPage, self.endPage + 1

最低0.47元/天解锁文章

super选择题

关注

4
点赞
踩
2

收藏

觉得还不错? 一键收藏
0
评论
案例：使用XPath的爬虫（把某贴吧的照片保存到本地）

案例：使用XPath的爬虫现在我们用XPath来做一个简单的爬虫，我们尝试爬取某个贴吧里的所有帖子，并且将该这个帖子里每个楼层发布的图片下载到本地。# tieba_xpath.py#!/usr/bin/env python# -*- coding:utf-8 -*-import osimport urllibimport urllib2from lxml import etr...
复制链接

扫一扫

专栏目录