7.爬虫数据提取——BeautifulSoup4库

BeautifulSoup4库

一、什么是BeautifulSoup4库?

和 lxml 一样,Beautiful Soup 也是一个HTML/XML的解析器,主要的功能也是如何解析和提取 HTML/XML 数据。简单来说,Beautiful Soup只是一个从html字符串提取数据的工具而已。

二、性能差异?

lxml 只会局部遍历,Beautiful Soup 是基于HTML DOM(Document Object Model)的,会载入整个文档,解析整个DOM树,因此时间和内存开销都会大很多,所以性能要低于lxml。Beautiful Soup 提取数据速度最慢

三、如何安装?

1.在线安装:

pip install bs4

2.离线安装

转到对应的盘符下pip install +文件名即可。

四、测试

1.在cmd命令行输入Python,然后import bs4,如果成功则表示已经安装成功。

2.打开spyder,然后import bs4,如果成功则表示安装成功。


扫描二维码即可参与该课程,解锁更多爬虫知识:

 

 

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值