Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $YECBGYFECGEAFWHA as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2

Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $BBWFDDBHHYHDXXAB as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2
Python Selenium 网页元素交互:精确操作下拉菜单与动态选项_创想鸟

Python Selenium 网页元素交互:精确操作下拉菜单与动态选项

Python Selenium 网页元素交互:精确操作下拉菜单与动态选项

本文详细阐述了如何使用 %ignore_a_1% selenium 精确地与网页上的下拉菜单进行交互,包括定位并点击下拉菜单的触发器以及选择其中的特定选项。教程强调了选择器策略的重要性,并提供了具体的代码示例。此外,文章还探讨了在处理动态网页元素时应注意的事项,并建议在数据抓取场景下,优先考虑使用网站提供的 api 接口,以提高效率和稳定性。

在自动化测试或网页数据抓取过程中,与网页上的动态元素,特别是下拉菜单(Dropdowns)进行交互是常见的需求。然而,由于网页结构复杂性、元素动态加载或 ID 不固定等原因,直接使用绝对 XPath 或不稳定的 ID 可能会导致 NoSuchElementException 错误。本教程将指导您如何使用 Python Selenium 准确、稳定地操作网页下拉菜单。

使用 Selenium 精确操作下拉菜单

要成功操作一个下拉菜单并选择其中的选项,通常需要两个主要步骤:首先,定位并点击下拉菜单的触发元素,使其展开;其次,定位并点击下拉菜单中您想要选择的特定选项。

1. 定位并点击下拉菜单触发器

下拉菜单的触发器通常是一个按钮、 标签或

元素,点击它会显示下拉选项列表。识别这个触发器的关键在于找到其稳定的定位符。在许多现代网页中,这类元素可能通过 CSS 类名来标识。

例如,如果下拉菜单的触发器具有 aio-tabs-button 这样的类名,我们可以使用 By.CLASS_NAME 来定位它:

立即学习“Python免费学习笔记(深入)”;

from selenium import webdriverfrom selenium.webdriver.common.by import Byfrom selenium.webdriver.support.ui import WebDriverWaitfrom selenium.webdriver.support import expected_conditions as EC# 初始化 WebDriver# 请根据您的浏览器类型和 WebDriver 路径进行调整driver = webdriver.Chrome() driver.get("https://www.gurufocus.com/stocks")try:    # 等待下拉菜单触发器可见并可点击    dropdown_trigger = WebDriverWait(driver, 10).until(        EC.element_to_be_clickable((By.CLASS_NAME, "aio-tabs-button"))    )    dropdown_trigger.click()    print("成功点击下拉菜单触发器。")except Exception as e:    print(f"点击下拉菜单触发器时发生错误: {e}")# 后续代码将在这里继续选择选项

注意事项:

显式等待 (WebDriverWait) 是至关重要的。网页元素可能不会立即加载完成,使用显式等待可以确保在尝试交互之前,目标元素已经可见且可点击,从而避免 NoSuchElementException。选择器优先级: 优先使用 ID、NAME、CLASS_NAME、CSS_SELECTOR 等更稳定和简洁的定位方式,而不是复杂的或绝对的 XPath。

2. 选择下拉菜单中的特定选项

在下拉菜单展开后,您需要定位并点击其中表示特定数值(例如“100”)的选项。这些选项通常是

、 或 标签,并且其文本内容是其最稳定的标识之一。

我们可以使用 XPath 结合文本内容来定位这些选项,这对于动态生成的元素尤其有效,因为它们的 ID 或类名可能不稳定。

# 假设下拉菜单已经展开try:    # 等待包含文本“100”的选项可见并可点击    # 这里我们查找 class 为 'item' 且文本内容包含 '100' 的 div 元素    option_100 = WebDriverWait(driver, 10).until(        EC.element_to_be_clickable((By.XPATH, "//div[@class='item' and contains(text(), '100')]"))    )    option_100.click()    print("成功选择 '100' 选项。")except Exception as e:    print(f"选择 '100' 选项时发生错误: {e}")finally:    # 完成操作后关闭浏览器    driver.quit()

完整示例代码:

将上述两个步骤整合,形成一个完整的操作流程:

from selenium import webdriverfrom selenium.webdriver.common.by import Byfrom selenium.webdriver.support.ui import WebDriverWaitfrom selenium.webdriver.support import expected_conditions as ECimport time # 导入 time 模块用于演示等待# 初始化 WebDriverdriver = webdriver.Chrome() driver.get("https://www.gurufocus.com/stocks")try:    # 1. 定位并点击下拉菜单触发器    dropdown_trigger = WebDriverWait(driver, 10).until(        EC.element_to_be_clickable((By.CLASS_NAME, "aio-tabs-button"))    )    dropdown_trigger.click()    print("成功点击下拉菜单触发器。")    # 2. 选择下拉菜单中的特定选项 (例如 '100')    # 等待下拉选项列表出现,并选择包含文本 '100' 的选项    option_100 = WebDriverWait(driver, 10).until(        EC.element_to_be_clickable((By.XPATH, "//div[@class='item' and contains(text(), '100')]"))    )    option_100.click()    print("成功选择 '100' 选项。")    # 验证操作是否成功(可选):例如,等待页面内容更新或截图    time.sleep(3) # 简单等待页面加载except Exception as e:    print(f"操作过程中发生错误: {e}")finally:    # 关闭浏览器    driver.quit()

优化与替代方案

尽管 Selenium 提供了强大的浏览器自动化能力,但在某些场景下,它可能不是最优解。

1. 提升 Selenium 脚本的健壮性

更精确的定位策略: 尽量避免使用绝对 XPath。当元素没有唯一的 ID 或 NAME 时,可以尝试使用 CSS 选择器或相对 XPath,结合元素的属性(如 class、data-* 属性)和文本内容进行定位。条件等待: 始终使用 WebDriverWait 和 expected_conditions 来等待元素出现、可见或可点击,而不是使用硬编码的 time.sleep()。异常处理: 使用 try-except 块来捕获 NoSuchElementException 或其他 Selenium 异常,以便在元素未找到时能优雅地处理。

2. 考虑使用 Web API 进行数据抓取

对于主要目的是抓取网页数据而不是模拟用户交互的场景,直接调用网站的后端 API 通常是更高效、更稳定、更轻量级的解决方案。

优点:速度快: 无需加载和渲染整个网页,直接获取数据。稳定性高: 不受前端界面变化的影响。资源消耗低: 不需要启动浏览器实例。实现方式:使用浏览器开发者工具(Network 标签页)监控页面加载时发出的 XHR/Fetch 请求。分析请求的 URL、请求方法(GET/POST)、请求头和请求体。使用 Python 的 requests 库模拟这些请求来获取数据。

例如,如果您发现选择“100”选项后,页面会向某个 API 发送请求并返回数据,那么直接模拟这个 API 请求会比 Selenium 自动化浏览器更优。

import requestsimport json# 示例:假设发现页面通过以下API获取数据# 这是一个虚构的URL和参数,您需要根据实际情况进行分析api_url = "https://www.gurufocus.com/api/stocks/data" headers = {    "User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/106.0.0.0 Safari/537.36",    "Accept": "application/json",    # 其他可能需要的请求头,如 Authorization, Referer 等}params = {    "page_size": 100, # 对应选择“100”的逻辑    "page": 1,    # 其他筛选条件}try:    response = requests.get(api_url, headers=headers, params=params)    response.raise_for_status() # 检查HTTP请求是否成功    data = response.json()    print("通过 API 成功获取数据:")    # print(json.dumps(data, indent=2)) # 打印格式化的JSON数据    # 在这里处理获取到的数据    print(f"获取到 {len(data.get('stocks', []))} 条股票数据。")except requests.exceptions.RequestException as e:    print(f"API 请求失败: {e}")except json.JSONDecodeError:    print("API 返回的不是有效的 JSON 格式。")

总结

在 Python Selenium 中操作网页下拉菜单,核心在于准确地定位触发器和选项,并利用显式等待机制应对动态加载。通过 By.CLASS_NAME 定位触发器,结合 By.XPATH 和 contains(text(), ‘…’) 定位选项是一种可靠的方法。然而,在数据抓取场景下,如果网站提供 API 接口,直接使用 requests 库进行 API 调用通常是更推荐的方案,因为它能提供更高的效率和稳定性。选择哪种方法取决于您的具体需求:需要模拟完整用户行为(如表单提交、交互式测试)时使用 Selenium,而仅需获取数据时则优先考虑 API。

以上就是Python Selenium 网页元素交互:精确操作下拉菜单与动态选项的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1604946.html

赞 (0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
优化Quill编辑器内容提交至Flask:DOM元素选择器的关键细节
上一篇 2025年12月23日 18:29:28
Iframe内容在HTTPS页面中无法加载:混合内容安全策略与解决方案
下一篇 2025年12月23日 18:29:39

相关推荐

  • 微软收回弃用 Windows 控制面板的决定?

    微软收回弃用 Windows 控制面板的决定?微软收回弃用 Windows 控制面板的决定?微软收回弃用 Windows 控制面板的决定?微软收回弃用 Windows 控制面板的决定?

    上周,微软曾发布了一份支持文档,宣布将正式淘汰已有39年历史的windows控制面板。然而,现在微软似乎改变了主意,删除了之前提到的关于控制面板将被设置应用取代的说法。目前还不清楚这是微软政策的转变,还是仅仅是对措辞的调整。截至本文撰写时,微软尚未就此发表任何评论。 微软之前的表述是:“控制面板即将…

    2026年9月25日 • 用户投稿
    100
  • 几个方法教会你windows10电脑如何录屏

    几个方法教会你windows10电脑如何录屏几个方法教会你windows10电脑如何录屏几个方法教会你windows10电脑如何录屏几个方法教会你windows10电脑如何录屏

    随着如今电脑技术的持续发展,不断升级的电脑系统总会带来许多新功能。前几天,有位粉丝朋友在网上的评论区向我提问,询问如何用windows 10电脑进行录屏。实际上,这个问题并不复杂,因为我们的电脑本身就已经具备这一功能了。下面,我就详细地为大家讲解一下具体的操作步骤。 首先,我们打开电脑,在桌面右下角…

    2026年9月25日 • 用户投稿
    300
  • 如何提升 Debian Node.js 的安全性

    如何提升 Debian Node.js 的安全性如何提升 Debian Node.js 的安全性如何提升 Debian Node.js 的安全性如何提升 Debian Node.js 的安全性

    在 Debian 系统上部署 Node.js 应用,安全性至关重要。本文概述了确保 Node.js 应用安全性的多方面策略,涵盖安装、配置、持续监控和更新等环节。 一、Node.js 安装与更新 推荐使用 NodeSource PPA 安装并管理 Node.js 和 npm: curl -fsSL …

    2026年9月25日 • 用户投稿
    000
  • 淘宝48小时不发货会被罚款吗?发货可以延期吗? 淘宝48小时不发货必罚?2025最新罚款标准+3招避免延期技巧!

    淘宝48小时不发货会被罚款吗?发货可以延期吗? 淘宝48小时不发货必罚?2025最新罚款标准+3招避免延期技巧!淘宝48小时不发货会被罚款吗?发货可以延期吗? 淘宝48小时不发货必罚?2025最新罚款标准+3招避免延期技巧!淘宝48小时不发货会被罚款吗?发货可以延期吗? 淘宝48小时不发货必罚?2025最新罚款标准+3招避免延期技巧!淘宝48小时不发货会被罚款吗?发货可以延期吗? 淘宝48小时不发货必罚?2025最新罚款标准+3招避免延期技巧!

    在淘宝开店的商家,常常被顾客反复询问:“我的订单什么时候发货?”随着平台对物流时效监管的不断加强,“淘宝48小时内不发货会被罚吗?能否申请延迟发货?” 已成为众多卖家关注的核心问题。本文将全面解读淘宝最新的发货规则,助力商家有效规避运营风险。 一、淘宝最新发货政策详解 依据当前平台规定,所有淘宝商家…

    2026年9月25日 • 用户投稿
    700
  • 豆包AI如何调用外部API 实现AI与第三方服务联动的方法

    本文旨在探讨豆包AI如何通过调用外部API,从而实现与第三方服务的智能联动。我们将详细介绍实现这一功能的核心原理以及具体的操作步骤。通过理解API调用的机制并在豆包AI中进行相应的配置,用户可以赋予豆包AI连接互联网世界、获取实时信息、执行特定任务的能力,极大地扩展了AI的应用场景和智能化水平。文章…

    2026年9月25日
    000
  • Debian Hadoop数据传输优化方法

    Debian Hadoop数据传输优化方法Debian Hadoop数据传输优化方法Debian Hadoop数据传输优化方法Debian Hadoop数据传输优化方法

    提升Debian Hadoop集群数据传输效率的关键在于多方面策略的综合运用。本文将详细阐述优化方法,助您显著提升集群性能。 一、数据本地化策略 最大限度地将计算任务分配至数据存储节点,有效减少节点间数据传输。Hadoop的数据本地化机制会自动将数据块移动到计算任务所在的节点,从而避免网络传输带来的…

    2026年9月25日 • 用户投稿
    200
  • sublime怎么设置python linter_sublime Python Linter配置方法

    sublime怎么设置python linter_sublime Python Linter配置方法sublime怎么设置python linter_sublime Python Linter配置方法sublime怎么设置python linter_sublime Python Linter配置方法sublime怎么设置python linter_sublime Python Linter配置方法

    首先安装SublimeLinter插件及SublimeLinter-pylint或SublimeLinter-flake8,然后通过pip安装pylint或flake8,最后在SublimeLinter设置中配置Python可执行文件路径和检查模式,启用实时与保存时检查即可实现Python代码质量监…

    2026年9月25日 • 用户投稿
    000
  • 动态缓存键配置:Spring Boot 缓存管理的灵活应用

    动态缓存键配置:Spring Boot 缓存管理的灵活应用动态缓存键配置:Spring Boot 缓存管理的灵活应用动态缓存键配置:Spring Boot 缓存管理的灵活应用动态缓存键配置:Spring Boot 缓存管理的灵活应用

    在 Spring Boot 应用中,使用 @Cacheable 注解可以方便地实现缓存功能。然而,在某些场景下,我们需要根据请求参数动态地生成缓存键,而不是简单地使用固定的键值。虽然 @Cacheable 注解允许通过 key 属性指定 SpEL 表达式来生成缓存键,但有时我们可能需要更灵活的控制,…

    2026年9月25日 • 用户投稿
    200
  • p5.js WebGL性能优化:首帧渲染耗时长的原因与对策

    p5.js WebGL性能优化:首帧渲染耗时长的原因与对策p5.js WebGL性能优化:首帧渲染耗时长的原因与对策p5.js WebGL性能优化:首帧渲染耗时长的原因与对策p5.js WebGL性能优化:首帧渲染耗时长的原因与对策

    在使用p5.js的WEBGL渲染模式时,首次调用image()函数渲染图片或p5.Graphics对象通常会比后续调用耗时显著增加。这主要是因为第一次渲染时,p5.js需要将图像数据从CPU内存上传到GPU的纹理内存中,涉及内存分配和数据复制,这是一个相对耗时的过程。后续调用由于纹理已被缓存,可以直…

    2026年9月25日 • 用户投稿
    700
  • Chrome浏览器怎么把所有标签页加入书签_一键收藏全部打开的标签页

    Chrome浏览器怎么把所有标签页加入书签_一键收藏全部打开的标签页Chrome浏览器怎么把所有标签页加入书签_一键收藏全部打开的标签页Chrome浏览器怎么把所有标签页加入书签_一键收藏全部打开的标签页Chrome浏览器怎么把所有标签页加入书签_一键收藏全部打开的标签页

    1、使用Ctrl+Shift+D可将当前所有标签页一键保存为书签文件夹;2、通过安装“Save All Tabs”等扩展程序实现选择性保存或导出链接;3、手动拖拽标签至书签栏后,利用书签管理器归类整理。 如果您在Chrome浏览器中打开了多个需要长期保存的网页标签,手动逐一收藏会非常耗时。通过特定操…

    2026年9月25日 • 用户投稿
    200
  • 为什么不同浏览器对硬件加速的实现存在差异?

    不同浏览器因渲染引擎、图形API及权衡策略差异导致硬件加速表现不同。1. Blink、Gecko、WebKit引擎在图层管理与GPU任务分配上设计不同;2. 各浏览器通过ANGLE等抽象层适配DirectX、Vulkan、Metal,转换开销与支持程度影响性能;3. 厂商在性能、兼容性、稳定性间取舍…

    2026年9月25日
    100
  • C语言判断素数方法

    C语言判断素数方法C语言判断素数方法C语言判断素数方法C语言判断素数方法

    求素数的问题通常可以划分为两大类。 1、解决素数相关问题常用的方法主要有两种。 2、判断某个给定的数是否为质数。 3、找出所有小于指定数值的质数。 4、核心概念包括:素数是大于1且只能被1和其本身整除的自然数。要判断一个数是否为素数,可以通过尝试用从2到该数减1的所有整数去除它,若发现有能整除的因子…

    2026年9月25日 • 用户投稿
    700
  • Debian Hadoop数据安全性如何提升

    Debian Hadoop数据安全性如何提升Debian Hadoop数据安全性如何提升Debian Hadoop数据安全性如何提升Debian Hadoop数据安全性如何提升

    增强Debian Hadoop集群的数据安全性,需要多方面协同努力,涵盖系统维护、用户权限管理、数据加密、访问控制、日志审计和安全策略制定等关键环节。以下是一些具体的实施步骤: 一、系统安全维护 及时更新: 定期执行apt update和apt upgrade命令,确保系统补丁及时更新,抵御已知漏洞…

    2026年9月25日 • 用户投稿
    000
  • 动态缓存键在Spring Boot中的实现教程

    动态缓存键在Spring Boot中的实现教程动态缓存键在Spring Boot中的实现教程动态缓存键在Spring Boot中的实现教程动态缓存键在Spring Boot中的实现教程

    本文介绍了如何在Spring Boot应用中实现基于请求参数的动态缓存键。通过直接操作CacheManager获取缓存对象,并使用cache.get(key, () -> …)方法,可以灵活地根据请求参数生成缓存键,从而实现更精细化的缓存控制。这种方法避免了直接修改缓存名称,而是专…

    2026年9月25日 • 用户投稿
    700
  • win11事件查看器在哪里打开_win11事件查看器打开路径介绍

    win11事件查看器在哪里打开_win11事件查看器打开路径介绍win11事件查看器在哪里打开_win11事件查看器打开路径介绍win11事件查看器在哪里打开_win11事件查看器打开路径介绍win11事件查看器在哪里打开_win11事件查看器打开路径介绍

    答案:可通过五种方式打开Windows 11事件查看器。依次为:开始菜单搜索“事件查看器”或eventvwr;使用Win+R运行eventvwr.msc;右键“此电脑”进入计算机管理并选择事件查看器;按Win+X后选事件查看器;通过控制面板的管理工具双击启动。 如果您需要排查系统故障或查看计算机的运…

    2026年9月25日 • 用户投稿
    000
  • sublime怎么配置eslint进行js校验_sublime集成ESLint代码检查配置

    sublime怎么配置eslint进行js校验_sublime集成ESLint代码检查配置sublime怎么配置eslint进行js校验_sublime集成ESLint代码检查配置sublime怎么配置eslint进行js校验_sublime集成ESLint代码检查配置sublime怎么配置eslint进行js校验_sublime集成ESLint代码检查配置

    首先安装SublimeLinter和SublimeLinter-eslint插件,确保系统或项目中已安装ESLint;通过npx eslint –init生成配置文件;插件会自动调用项目内的eslint,若未识别可手动设置executable路径;保存JavaScript文件时即可实时显…

    2026年9月25日 • 用户投稿
    000
  • firefox浏览器怎么截图整个网页 Firefox浏览器滚动长截图功能使用教程

    firefox浏览器怎么截图整个网页 Firefox浏览器滚动长截图功能使用教程firefox浏览器怎么截图整个网页 Firefox浏览器滚动长截图功能使用教程firefox浏览器怎么截图整个网页 Firefox浏览器滚动长截图功能使用教程firefox浏览器怎么截图整个网页 Firefox浏览器滚动长截图功能使用教程

    Firefox可通过内置截图工具截取长网页,点击菜单选择“截图”或使用Ctrl+Shift+S,再点“截取整页”即可保存完整页面。 如果您在浏览网页时需要保存完整页面内容,但Firefox默认仅截取当前可见区域,则可以通过内置的截图工具扩展功能实现全页截图。以下是具体操作方法: 本文运行环境:Del…

    2026年9月25日 • 用户投稿
    000
  • 抖音直播如何增加人气_抖音直播增加人气的核心策略

    抖音直播如何增加人气_抖音直播增加人气的核心策略抖音直播如何增加人气_抖音直播增加人气的核心策略抖音直播如何增加人气_抖音直播增加人气的核心策略抖音直播如何增加人气_抖音直播增加人气的核心策略

    提升抖音直播人气需优化标题封面、发布预热视频、增强互动、合理投放Dou+、固定直播时间并跨平台引流,系统化运营以增加曝光与留存。 1、立即进入“TikTok(抖音国际版)官网☜☜☜☜☜点击进入”; 2、立即进入“抖音极速版(领红包)入口☜☜☜☜☜点击进入”; 如果您在抖音直播时发现观看人数较少,难以…

    2026年9月25日 • 用户投稿
    000
  • PHP文件引入时参数传递机制详解与最佳实践

    在php中,直接通过url查询字符串方式向`require`或`include`引入的文件传递参数是无效的,这会导致“未定义变量”错误。本文将深入探讨php文件引入的原理,并提供三种正确的参数传递方法:利用作用域共享、手动填充`$_get`数组,以及推荐的通过函数或类进行封装,旨在帮助开发者构建更健…

    2026年9月25日
    000
  • win10怎么彻底关闭快速启动功能

    win10怎么彻底关闭快速启动功能win10怎么彻底关闭快速启动功能win10怎么彻底关闭快速启动功能win10怎么彻底关闭快速启动功能

    有的用户在完成win10系统的安装后,想要再次进入bios设置界面,却发现无法顺利进入。这是因为在win10中启用了全新的快速启动机制,导致开机时直接跳转至系统界面,而不会显示主板自检画面。因此,我们只需关闭该功能即可正常进入bios。 操作步骤: 方法一: 打开“开始菜单”,点击其中的“设置”图标…

    2026年9月25日 • 用户投稿
    200

发表回复

登录后才能评论
关注微信