接口返回HTML页面详解

最新推荐文章于 2024-06-20 16:20:43 发布

EaSoNgo111

最新推荐文章于 2024-06-20 16:20:43 发布

阅读量1k

点赞数 8

文章标签： python html

本文链接：https://blog.csdn.net/EaSoNgo111/article/details/135022534

版权

import requests
from bs4 import BeautifulSoup
import re
import json

url = 'https://listado.mercadolibre.com.mx/hogar-muebles-jardin/cocina/almacenamiento-organizacion/organizadores-cocina/_CustId_570995983_PrCategId_AD'

# 添加 headers 和 cookies
headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/119.0.0.0 Safari/537.36'
}

cookies = {

}

# 发起带有 headers 和 cookies 的 GET 请求
response = requests.get(url, headers=headers, cookies=cookies)

# 使用 BeautifulSoup 解析 HTML
soup = BeautifulSoup(response.text, 'html.parser')

# 找到包含 TOTAL_RESULTS 的标签
total_results_tag = soup.find('span', {'class': 'ui-search-search-result__quantity-results'})

# 获取 TOTAL_RESULTS 的文本内容
total_results_text = total_results_tag.text.strip()

print(total_results_text)

首先，通过使用requests库发送GET请求，添加了自定义的headers和cookies，以模拟浏览器访问。然后，使用BeautifulSoup库对返回的HTML进行解析。

代码中使用了find方法来找到类名为ui-search-search-result__quantity-results的标签，该标签包含了搜索结果的总数量。然后，使用.text属性获取该标签的文本内容，并使用strip()方法去除多余的空白字符。

Curl命令转代码工具

使用复制的进网站转换为python代码，选取url和headers和cookies参数

EaSoNgo111

关注

8
点赞
踩
7

收藏

觉得还不错? 一键收藏
0
评论
接口返回HTML页面详解

库发送GET请求，添加了自定义的headers和cookies，以模拟浏览器访问。使用复制的进网站转换为python代码，选取url和headers和cookies参数。的标签，该标签包含了搜索结果的总数量。属性获取该标签的文本内容，并使用。库对返回的HTML进行解析。方法去除多余的空白字符。
复制链接

扫一扫