python3 beautifulsoup 模块详解_python3 BeautifulSoup模块使用字典的方法抓取a标签内的数据示例...

最新推荐文章于 2021-02-20 01:16:05 发布

weixin_39612110

最新推荐文章于 2021-02-20 01:16:05 发布

阅读量226

点赞数

文章标签： python3 beautifulsoup 模块详解

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_39612110/article/details/113967305

版权

python3 BeautifulSoup模块使用字典的方法抓取a标签内的数据示例

发布时间：2020-09-08 19:04:36

来源：脚本之家

阅读：87

作者：weixin_34351321

本文实例讲述了python3 BeautifulSoup模块使用字典的方法抓取a标签内的数据。分享给大家供大家参考，具体如下：

# -*- coding:utf-8 -*-

#python 2.7

#XiaoDeng

#http://tieba.baidu.com/p/2460150866

#标签操作

from bs4 import BeautifulSoup

import urllib.request

import re

#如果是网址，可以用这个办法来读取网页

#html_doc = "http://tieba.baidu.com/p/2460150866"

#req = urllib.request.Request(html_doc)

#webpage = urllib.request.urlopen(req)

#html = webpage.read()

html="""

The Dormouse's story

The Dormouse's story

Once upon a time there were three little sisters; and their names were

,

and they lived at the bottom of a well.

...

"""

soup = BeautifulSoup(html, 'html.parser') #文档对象

#查找a标签,只会查找出一个a标签

#print(soup.a)#

for k in soup.find_all('a'):

print(k)

print(k['class'])#查a标签的class属性

print(k['id'])#查a标签的id值

print(k['href'])#查a标签的href值

print(k.string)#查a标签的string

#如果，标签中含有其他标签，比如..，此时要提取中的数据，需要用k.get_text()

#tag.get('calss')，也可以达到这个效果

Python Socket编程技巧总结》、《Python正则表达式用法总结》、《Python数据结构与算法教程》、《Python函数使用技巧总结》、《Python字符串操作技巧汇总》、《Python入门与进阶经典教程》及《Python文件与目录操作技巧汇总》

更多关于Python相关内容可查看本站专题：《

希望本文所述对大家Python程序设计有所帮助。

weixin_39612110

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。