python+playwright 学习-35.获取页面的完整 HTML 内容

最新推荐文章于 2024-08-23 20:09:29 发布

上海-悠悠

最新推荐文章于 2024-08-23 20:09:29 发布

阅读量1.6k

点赞数 2

分类专栏： playwright 文章标签： python

本文链接：https://blog.csdn.net/qq_27371025/article/details/129775421

版权

playwright 专栏收录该内容

92 篇文章 44 订阅 ¥19.90 ¥99.00

订阅专栏

超级会员免费看

本文介绍了在Python中使用Playwright库获取网页完整HTML内容、元素的HTML和文本内容的方法，包括page.content()、inner_html()、inner_text()、text_content()以及all_inner_texts()和all_text_contents()的用法。

摘要由CSDN通过智能技术生成

前言

selenium 里面有个driver.page_source 可以获取整个html页面的内容，playwright里面也有类似的方法使用 page.content()

page.content() 获取html内容

使用示例

from playwright.sync_api import sync_playwright
# 上海悠悠 wx:283340479
# blog:https://www.cnblogs.com/yoyoketang/


with sync_playwright() as p:
    browser = p.chromium.launch(headless=False)
    context = browser.new_context()
    page = context.new_page()

    page.goto("https://www.cnblogs.com/yoyoketang/")
    print(page.content())