python爬虫之pyquery

1.初始化

from pyquery import PyQuery as pq

html_str='''
<div class="wrap">
	<div id="container">
	    <ul class='list'>
	         <li class="item-0">first item</li>
	         <li class="item-1" id="di"><a href="link2.html">second item</a></li>
	         <li class="item-0 active"><a href="link3.html"><span class="bold">third item</span></a></li>
	         <li class="item-1 active"><a href="link4.html">fourth item</a></li>
	         <li class="item-0"><a href="link5.html">fifth item</a></li>
	     </ul>
	</div>
 </div>
'''
pq_obj = pq(html_str)

2.获取数据
(1)查找子元素,使用find()和children()

#查找id为di的对象
obj_li=pq_obj('#di')#选择到的是一个对象
#find()查找之后的内容中选择想要的子元素 ,和 children('')相同
obj_a = obj_li.find('a')
print(obj_a)
obj_a2 = obj_li.children('a')
print(obj_a2)

结果如下:
在这里插入图片描述
(2)查找父元素,使用parent(),parents()

obj_list = pq_obj('.list')
con = obj_list.parent()
print(con)

在这里插入图片描述
(3)查找兄弟元素,使用siblings()

li_obj = pq_obj('.list .item-0')
li_obj2 = li_obj.siblings()
print(li_obj2)

在这里插入图片描述
(4)获取属性(attr())和文字部分(text())

print('*******获取属性和文字********')
obj_a_href = obj_a.attr('href')
print(obj_a_href)

obj_a_text = obj_a.text()
print(obj_a_text)

在这里插入图片描述

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值