Python学习 Day45 数据解析-pyquery 09

pyquery解析数据

一、pyquery概述

  • pyquery库是jQuery的Python实现,能够以jQuery的语法来操作解析HTML文档,易用性和解析速度都很好
  • 前提条件:了解CSS选择器以及jQuery
  • 非Python标准模块,需要安装
    安装方式:pip install pyquery -i http://pypi.douban.com/simple --trusted-host pypi.douban.com
    测试方式:import pyquery

二、pyquery的初始化方式

(一)字符串方式

语法

from pyquery import PyQuery as pq
doc = pq(str)
print(doc)
print(type(doc))

具体代码

from pyquery import PyQuery as pq
print('--------------第一种方式:字符串-----------------')
html = '''
        <html>
            <head>
                <title>PyQuery</title>
            </head>
            <body>
                <h1>水面清圆</h1>
            </body>
        </html>
'''
#创建pyquery对象,实际上就是在进行一个类型转换,将str类型转换为PyQuery类型,才能使用pq对应的方法
doc = pq(html)  #输出HTML中的内容
print(type(html)) #字符串类型 <class 'str'>
print(type(doc)) #<class 'pyquery.pyquery.PyQuery'>
print(doc('title'))
--------------第一种方式:字符串-----------------
<class 'str'>
<class 'pyquery.pyquery.PyQuery'>
<title>PyQuery</title>
            

Process finished with exit code 0

(二)URL方式

语法

from pyquery import PyQuery as pq
doc = pq(url='http://www.baidu.com',encoding='utf-8')
print(type(doc))
print(doc('title')

具体代码

from pyquery import PyQuery as pq
print('---------------第二种方式:URL------------------------')
#创建一个pq对象
doc = pq(url = 'http://www.baidu.com',encoding = 'utf-8') #编码解决乱码问题
print(doc)
print('\n标签名称:',doc('title')) #括号中写上待查询的标签名
---------------第二种方式:URL------------------------
<html> <head><meta http-equiv="content-type" content="text/html;charset=utf-8"/><meta http-equiv="X-UA-Compatible" content="IE=Edge"/><meta content="always" name=
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 1
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值