Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $YECBGYFECGEAFWHA as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2

Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $BBWFDDBHHYHDXXAB as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2
使用Selenium Wire捕获和分析Selenium自动化中的网络请求_创想鸟

使用Selenium Wire捕获和分析Selenium自动化中的网络请求

使用selenium wire捕获和分析selenium自动化中的网络请求

当使用Selenium进行Web自动化时,直接捕获前端与后端之间的API请求及其响应具有挑战性。本文将介绍如何利用`selenium-wire`库,它作为Selenium的扩展,能够轻松拦截、检查和分析浏览器发出的所有网络流量,包括API请求和JSON响应,从而弥补了标准Selenium在这一功能上的不足,为开发者提供了强大的网络监控能力。

引言:Selenium与网络请求捕获的挑战

Selenium作为一个强大的Web自动化测试工具,主要侧重于模拟用户与网页的交互,例如点击、输入、导航等。然而,在某些高级场景下,我们不仅需要模拟用户行为,还需要深入了解浏览器与服务器之间的数据交换,特别是前端通过JavaScript发起的异步API请求及其返回的JSON数据。

标准Selenium本身并不直接提供一套便捷的API来监听和捕获这些底层的网络请求。虽然可以通过WebDriver的开发者工具协议(CDP)接口或解析性能日志来间接获取部分信息,但这些方法通常较为复杂,且需要对浏览器内部机制有较深的理解。例如,尝试通过driver.get_log(“performance”)获取日志并解析Network.responseReceived事件,虽然可行,但代码实现起来往往冗长且维护成本较高。

面对“点击页面元素后,获取其触发的后端API请求及其JSON响应”这类需求时,我们需要一个更直接、更专业的解决方案。

解决方案:引入Selenium Wire

selenium-wire是selenium的一个强大扩展,它通过在WebDriver和浏览器之间设置一个代理,透明地拦截所有网络流量。这意味着开发者可以轻松地访问、检查甚至修改浏览器发出的每一个HTTP/HTTPS请求和接收到的每一个响应。

相比于直接使用CDP命令或解析性能日志,selenium-wire的优势在于:

简洁性: 提供直观的API来访问请求和响应对象。全面性: 捕获所有类型的网络流量,包括XHR、Fetch、图片、CSS、JS等。易用性: 无需复杂的浏览器内部知识,即可快速上手。

安装与配置

首先,你需要通过pip安装selenium-wire库:

pip install selenium-wire

安装完成后,你就可以像使用标准Selenium WebDriver一样,导入并初始化seleniumwire.webdriver。

from seleniumwire import webdriverimport jsonimport time# 配置WebDriver选项,例如无头模式options = webdriver.ChromeOptions()options.add_argument('--headless') # 可选:在无头模式下运行options.add_argument('--disable-gpu') # 禁用GPU加速,有时在无头模式下需要# 初始化Selenium Wire WebDriver# 默认情况下,Selenium Wire 会为每个请求和响应存储完整的body。# 如果内存成为问题,可以配置为不存储body,或只存储特定请求的body。# driver = webdriver.Chrome(options=options, seleniumwire_options={'disable_capture': True})driver = webdriver.Chrome(options=options)

捕获与分析网络请求

selenium-wire初始化后,所有通过该WebDriver实例发出的网络请求都会被自动捕获并存储在driver.requests列表中。每个元素都是一个Request对象,包含了请求和响应的详细信息。

实战示例:点击元素并获取API响应

假设我们有一个网页,其中包含一个按钮,点击该按钮会触发一个API请求并返回JSON数据。我们的目标是点击按钮,然后捕获这个API请求并解析其JSON响应。

from seleniumwire import webdriverfrom selenium.webdriver.common.by import Byfrom selenium.webdriver.support.ui import WebDriverWaitfrom selenium.webdriver.support import expected_conditions as ECimport jsonimport time# 1. 初始化Selenium Wire WebDriveroptions = webdriver.ChromeOptions()# options.add_argument('--headless') # 根据需要启用无头模式options.add_argument('--disable-gpu')driver = webdriver.Chrome(options=options)try:    # 2. 导航到目标网页    # 替换为你的目标URL,这里使用一个示例    driver.get("https://www.example.com/some_dynamic_page")    print("已导航到页面。")    # 模拟页面加载和元素出现    # 假设页面上有一个ID为 'dataButton' 的按钮    # 你可能需要等待元素可点击    wait = WebDriverWait(driver, 10)    data_button = wait.until(EC.element_to_be_clickable((By.ID, "dataButton")))    # 3. 清空之前的请求记录,确保只捕获点击后的请求    driver.delete_all_requests()    print("已清空所有历史请求。")    # 4. 执行页面交互,触发API请求    data_button.click()    print("已点击按钮,等待API请求...")    # 5. 等待一段时间,让API请求完成并被捕获    # 或者使用更智能的等待方式,例如等待某个特定的API请求出现    time.sleep(5) # 简单等待5秒,实际应用中应更精确地等待    # 6. 遍历捕获到的请求,定位目标API    target_api_url_part = '/api/get_data' # 目标API的URL片段    found_api_response = None    for request in driver.requests:        if request.url.endswith(target_api_url_part) and request.response:            print(f"捕获到目标API请求: {request.url}")            print(f"请求方法: {request.method}")            print(f"响应状态码: {request.response.status_code}")            # 尝试获取并解析JSON响应体            try:                # request.response.body 是字节流,需要解码                response_body = request.response.body.decode('utf-8')                json_data = json.loads(response_body)                found_api_response = json_data                print("API响应数据:")                print(json.dumps(json_data, indent=2, ensure_ascii=False))                break # 找到目标后即可退出循环            except json.JSONDecodeError:                print("响应体不是有效的JSON格式。")                print(f"原始响应体: {response_body[:200]}...") # 打印部分原始响应体            except Exception as e:                print(f"处理响应时发生错误: {e}")    if not found_api_response:        print(f"未找到包含 '{target_api_url_part}' 的API请求或其响应。")    # 7. 对获取到的数据进行后续处理    if found_api_response:        print("n成功获取并解析API数据,可以进行进一步处理。")        # 例如:assert found_api_response['status'] == 'success'        # 或者提取特定字段:data_items = found_api_response.get('items', [])except Exception as e:    print(f"发生错误: {e}")finally:    # 8. 关闭浏览器    driver.quit()    print("浏览器已关闭。")

代码解析:

初始化: 使用seleniumwire.webdriver.Chrome()初始化WebDriver。导航与交互: 导航到目标URL,并通过WebDriverWait确保按钮可点击,然后执行点击操作。清空请求: 在执行关键操作前调用driver.delete_all_requests()是一个好习惯,它可以清除之前捕获的所有请求,确保我们只关注操作后新产生的请求,避免混淆。遍历请求: driver.requests是一个列表,包含了所有被捕获的请求对象。我们可以遍历这个列表,通过request.url、request.method、request.response.status_code等属性来筛选出我们感兴趣的API请求。获取响应体: request.response.body包含了响应的原始字节数据。对于JSON响应,我们需要先使用.decode(‘utf-8’)将其解码为字符串,然后使用json.loads()解析为Python字典。

高级过滤

selenium-wire还提供了更灵活的过滤机制。你可以通过driver.wait_for_request()方法等待特定的请求,这比简单的time.sleep()更高效和准确。

# 等待一个URL包含特定字符串的请求request = driver.wait_for_request('/api/get_data', timeout=10)if request.response:    print(f"捕获到请求: {request.url}")    print(f"响应体: {request.response.body.decode('utf-8')}")

你也可以在遍历时使用更复杂的条件:

for request in driver.requests:    if request.url.startswith('https://api.example.com/') and        request.method == 'POST' and        request.response.status_code == 200:        # 处理符合条件的请求        pass

清空请求记录

为了避免内存占用过高,或者在不同测试步骤之间隔离请求,可以使用driver.delete_all_requests()来清空所有已捕获的请求记录。

注意事项与最佳实践

内存管理: selenium-wire默认会存储所有请求和响应的完整body。如果你的测试会产生大量的网络流量,这可能导致内存占用过高。你可以通过seleniumwire_options来配置:

driver = webdriver.Chrome(    options=options,    seleniumwire_options={'enable_compression': True, 'exclude_hosts': ['cdn.example.com']})# 或者在捕获后及时处理并清空driver.delete_all_requests()

对于不重要的请求,可以考虑不存储其body。

异步操作: 网页中的API请求通常是异步的。在执行操作后,需要给予足够的时间让网络请求完成。使用WebDriverWait结合EC.presence_of_element_located等待页面元素变化,或者使用driver.wait_for_request()等待特定请求,比简单的time.sleep()更为可靠。错误处理: 在解析JSON响应时,务必使用try-except json.JSONDecodeError来处理非JSON格式的响应,提高代码的健壮性。HTTPS证书: 在某些环境中,如果网站使用自签名证书,selenium-wire可能会遇到SSL证书错误。通常可以通过配置WebDriver选项来忽略SSL错误:

options.add_argument('--ignore-certificate-errors')

代理冲突: selenium-wire通过设置内部代理工作。如果你的WebDriver配置了外部代理,可能会发生冲突。通常建议让selenium-wire自行管理代理。

总结

selenium-wire极大地扩展了Selenium的功能,使其能够轻松地拦截、检查和分析前端与后端之间的所有网络通信。无论是进行调试、数据抓取、API测试还是安全审计,selenium-wire都提供了一个强大而直观的工具集,弥补了标准Selenium在网络层监控方面的不足。通过本文介绍的方法,你可以有效地在Selenium自动化过程中捕获和利用API请求及其JSON响应,从而实现更高级、更深入的自动化测试和数据分析任务。

以上就是使用Selenium Wire捕获和分析Selenium自动化中的网络请求的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1378333.html

赞 (0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
Python实践:高效寻找浮点数列表的最小整数乘数
上一篇 2025年12月14日 19:40:25
Django模型方法返回列表的单元测试实践
下一篇 2025年12月14日 19:40:50

相关推荐

  • 解决 Conda 环境中 Java 版本冲突的策略

    本文旨在解决 Conda 环境中 Java 版本激活不正确的问题。当用户尝试在 Conda 环境中指定特定 Java 版本(如 OpenJDK 8)时,系统可能仍激活旧的或错误的 Java 版本。教程将详细分析问题根源,并提供一种通过精确指定 Java 包名来确保 Conda 环境正确管理 Java…

    2026年9月23日
    000
  • Django 项目运行时遇到“django.core.exceptions.ImproperlyConfigured”错误,如何解决?

    当在运行 Django 项目时遇到“django.core.exceptions.ImproperlyConfigured”错误时,这表明 Django 无法导入其预期的数据库后端。 在给定的代码中,错误消息指出 Django 无法导入“django.db.backends.mysql”,这可能是因…

    2026年9月23日
    000
  • Windows安装过程中蓝屏INACCESSIBLE_BOOT_DEVICE怎么办?

    1、蓝屏“INACCESSIBLE_BOOT_DEVICE”通常因SATA模式不匹配或驱动缺失导致;2、进入BIOS将SATA模式从RAID改为AHCI可解决兼容性问题;3、安装时加载主板存储控制器驱动以识别NVMe或RAID磁盘;4、使用diskpart命令清理磁盘并转换为GPT(UEFI)或MB…

    2026年9月23日
    000
  • Linux安装Redis数据库,无需公网IP实现远程连接

    Linux安装Redis数据库,无需公网IP实现远程连接Linux安装Redis数据库,无需公网IP实现远程连接Linux安装Redis数据库,无需公网IP实现远程连接Linux安装Redis数据库,无需公网IP实现远程连接

    redis作为一种高效的key-value数据库,因其将数据存储在内存中而具备极高的读写速度,广泛应用于多种场景中。以下将详细介绍如何在centos 8的linux虚拟机上搭建redis数据库,并利用cpolar实现内网穿透以便通过公网访问。 在Linux(CentOS 8)上安装Redis数据库 …

    2026年9月23日 • 用户投稿
    000
  • 谷歌为 Gemini CLI 带来扩展功能

    谷歌旗下的 AI 编程助手 Gemini CLI 最近推出了名为“扩展”的全新功能。官方表示,这一更新让用户能够“接入常用工具,并定制属于自己的 AI 命令行体验”。现在,任何开发者都可以发布扩展程序,无需经过谷歌的审核批准即可上线使用。 目前扩展库中已提供超过 50 款扩展,涵盖多种实用场景。例如…

    2026年9月23日
    000
  • VSCode文件编码识别错误怎么办?VSCode编码设置调整方法

    VSCode文件编码识别错误怎么办?VSCode编码设置调整方法VSCode文件编码识别错误怎么办?VSCode编码设置调整方法VSCode文件编码识别错误怎么办?VSCode编码设置调整方法VSCode文件编码识别错误怎么办?VSCode编码设置调整方法

    vscode文件编码识别错误导致乱码问题可通过调整编码设置解决。1.查看右下角编码显示,若不对则点击选择“通过编码重新打开”,尝试utf-8、gbk等常见编码直至显示正常;2.如手动无效可启用“自动检测”功能;3.修改vscode默认编码(设置中搜索“files.encoding”并设为常用格式如u…

    2026年9月23日 • 用户投稿
    100
  • 如何恢复未保存的WPS格式文档_WPS未保存文档恢复操作技巧

    首先尝试WPS自动恢复功能,重新打开软件后查看“文档恢复”面板;若无效,可手动查找C:Users当前用户名AppDataLocalKingsoftWPS Officecache目录下的临时文件;若启用云端同步,可通过“备份与恢复”中的历史版本找回;还可使用系统搜索*.asd文件定位自动保存的副本。 …

    2026年9月23日
    100
  • 递归方法中静态变量状态管理与重置策略

    本教程探讨了在递归方法中使用静态(全局)变量时,如何正确管理和重置其状态,以避免多次调用时出现累积错误。核心问题在于静态变量在方法调用之间保留其值,导致后续调用基于旧状态进行计算。解决方案是在递归的基准情况(base case)中,在完成当前调用的计算后,立即将静态变量重置为初始值,从而确保每次独立…

    2026年9月23日
    200
  • 绘蛙AI修图怎样优化旅游照片?旅行社合作方案

    绘蛙ai修图的核心优势在于智能识别与校正,能自动调整白平衡、曝光和色彩饱和度,解决光线不佳或色彩偏差问题;2. 提供一键美化与风格化处理,内置“电影感”“清新自然”等风格,综合调整光影、对比度与锐度,提升照片视觉质感;3. 具备细节增强与瑕疵修复能力,可智能去除背景杂物、降噪、锐化,并自然修复人像瑕…

    2026年9月23日
    000
  • 谷歌浏览器如何将网页添加到阅读清单_谷歌浏览器添加网页到阅读清单方法

    谷歌浏览器支持通过地址栏按钮、右键菜单、主菜单和快捷键四种方式将网页添加到阅读清单。1、点击地址栏右侧“添加到阅读清单”图标即可保存;2、在页面空白处右键选择“添加页面到阅读清单”;3、通过三点菜单进入书签子菜单选择“添加到阅读清单”;4、使用Command+Shift+D(Mac)或Ctrl+Sh…

    2026年9月23日
    100
  • 图片库空间不足怎么办_图片库空间不足如何压缩图片详细步骤

    压缩图片可有效节省空间,推荐使用TinyPNG等在线工具批量处理,或用Photoshop、XnConvert进行精准控制,手机用户可通过专用App或快捷指令一键压缩,配合云存储与格式转换更高效。 图片库空间不足时,压缩图片是节省空间最直接有效的方法。不需要删除照片,通过合理压缩,既能保留视觉质量,又…

    2026年9月23日
    100
  • 苹果手机官网查询门户 苹果查询官网手机入口

    苹果查询官网手机入口是https://www.apple.com.cn,用户可通过该网站查询设备信息、技术支持及配件服务,包括序列号验证、保修状态、维修预约和原厂配件真伪核验等功能。 苹果手机官网查询门户在哪里?这是不少网友都关注的,接下来由PHP小编为大家带来苹果查询官网手机入口,感兴趣的网友一起…

    2026年9月23日
    100
  • 支持多种CPU调整外频!微星B850MPOWER主板图赏

    支持多种CPU调整外频!微星B850MPOWER主板图赏支持多种CPU调整外频!微星B850MPOWER主板图赏支持多种CPU调整外频!微星B850MPOWER主板图赏支持多种CPU调整外频!微星B850MPOWER主板图赏

    10月9日最新消息,微星b850m power主板已正式上市,定价为1599元,首发时迅速售罄,目前仍处于供不应求状态,需参与抢购才能入手。 这款热门新品现已抵达我们评测室,接下来为大家带来详细的图赏内容。 微星B850M POWER主板采用高端的8层服务器级PCB设计,配备双8PIN供电接口,并使…

    2026年9月23日 • 用户投稿
    000
  • Django运行migrate报错“django.db.utils.OperationalError”:如何解决SSL连接错误?

    django运行migrate报错“django.db.utils.operationalerror”的解决方法 在使用django项目的过程中,有时候在命令行中运行“python manage.py migrate”命令时会遇到“django.db.utils.operationalerror”的…

    2026年9月23日
    000
  • Deepseek 满血版联动 Typinator Pro,创建复杂文本模板​

    Deepseek 满血版联动 Typinator Pro,创建复杂文本模板​Deepseek 满血版联动 Typinator Pro,创建复杂文本模板​Deepseek 满血版联动 Typinator Pro,创建复杂文本模板​Deepseek 满血版联动 Typinator Pro,创建复杂文本模板​

    将 ai 与 typinator 联动可打造高效文本模板系统。1. 使用 deepseek 等 ai 工具生成结构化内容,如邮件草稿;2. 将生成内容调整为 typinator 变量格式(如 %|name%);3. 导入 typinator 并设置快捷短语,实现一键插入。典型场景包括批量写邮件、报告…

    2026年9月23日 • 用户投稿
    000
  • Vscode怎么批量修改变量?Vscode变量重命名操作指南

    Vscode怎么批量修改变量?Vscode变量重命名操作指南Vscode怎么批量修改变量?Vscode变量重命名操作指南Vscode怎么批量修改变量?Vscode变量重命名操作指南Vscode怎么批量修改变量?Vscode变量重命名操作指南

    vscode批量修改变量的方法是选中变量按f2输入新名回车,但要更精确控制重命名范围可采取以下措施:1.使用“查找和替换”功能(ctrl+h),结合正则表达式限定匹配范围;2.使用语言支持的“重构”功能(右键→重构→重命名),基于语义分析避免误改;3.安装增强重命名插件提升功能;4.利用静态代码分析…

    2026年9月23日 • 用户投稿
    000
  • Java中用户输入验证:正确使用equals()或转换为整数进行比较

    本教程详细阐述了Java中用户输入字符串(如菜单选项)验证的正确方法。针对==运算符在字符串比较中的局限性,文章介绍了两种解决方案:一是使用String.equals()方法进行内容比较,二是将字符串输入解析为整数后进行数值比较。通过代码示例,帮助开发者避免常见的字符串比较错误,确保程序逻辑的健壮性…

    2026年9月23日
    000
  • 微软免费文件恢复工具介绍

    微软免费文件恢复工具介绍微软免费文件恢复工具介绍微软免费文件恢复工具介绍微软免费文件恢复工具介绍

    现在好了,最近微软在 windows 10 应用商店中上架了一款免费的数据删除恢复工具 windows file recovery,猿妹再也不用担心误删文件了。 Windows File Recovery基于命令行程序设计,大小仅有8.26MB,所有Windows 10用户均可免费下载使用。 无论是…

    2026年9月23日 • 用户投稿
    100
  • VSCode精简配置Perl:语法检查、中文编码、正则调试

    vscode中perl语法检查不生效的主要原因是perl解释器路径未正确配置或缺失,解决方法是在settings.json中明确设置”perl.perlpath”指向正确的perl可执行文件;其次是因缺少cpan模块导致检查失败,需安装对应模块;此外,多个perl扩展冲突、大…

    2026年9月23日
    000
  • Yandex对俄贸易专用搜索 官方网站入口一键直达

    Yandex对俄贸易专用搜索官网为https://yandex.com/,提供俄语内容索引、企业信息查找、地图定位及自动翻译等功能,支持跨境业务拓展与市场分析。 Yandex对俄贸易专用搜索官方网站入口在哪里?这是不少网友都关注的,接下来由PHP小编为大家带来Yandex对俄贸易专用搜索官方网站入口…

    2026年9月23日
    300

发表回复

登录后才能评论
关注微信