使用 Selenium 和 Python 访问 Shadow DOM 中的元素

使用 Selenium 和 Python 访问 Shadow DOM 中的元素

本文旨在提供一个全面的教程,指导读者如何使用 selenium 和 python 自动化测试访问和操作 shadow dom 中的元素。由于标准 selenium 方法无法直接穿透 shadow dom,我们将重点介绍如何利用 javascript 执行器获取 shadow root,并在此基础上定位其内部的元素。文章将包含详细的步骤、代码示例以及获取必要信息(如 javascript 路径和 css 选择器)的实用技巧,帮助开发者有效解决 shadow dom 元素的定位难题。

理解 Shadow DOM 及其对自动化测试的挑战

Shadow DOM(影子 DOM)是 Web Components 标准的一部分,它允许开发人员创建封装的、独立的 DOM 子树,这些子树与主文档 DOM 隔离。这种封装性带来了许多好处,例如样式和行为的隔离,防止外部 CSS 规则意外影响组件内部,反之亦然。然而,这种隔离性也给传统的自动化测试工具(如 Selenium)带来了挑战。

当使用 Selenium 的 find_element 方法时,它通常只能在主文档 DOM 中查找元素。对于位于 Shadow DOM 内部的元素,这些方法会失败并抛出 NoSuchElementException,因为它们无法“看到”这些被封装的元素。为了克服这一限制,我们需要借助 JavaScript 执行器来间接访问 Shadow DOM。

访问 Shadow DOM 元素的策略

核心策略是分两步走:首先,通过执行 JavaScript 获取 Shadow DOM 的根节点(Shadow Root);然后,利用这个 Shadow Root 对象作为上下文,在其内部查找目标元素。

步骤一:获取 Shadow Root

要获取 Shadow Root,我们需要知道其宿主元素(Host Element)。宿主元素是主 DOM 中的一个普通元素,Shadow DOM 就依附于它。一旦找到宿主元素,就可以通过其 shadowRoot 属性来访问 Shadow Root。

立即学习“Python免费学习笔记(深入)”;

在 Selenium 中,我们可以使用 driver.execute_script() 方法来执行 JavaScript 代码。获取 Shadow Root 的典型 JavaScript 模式如下:

return document.querySelector('your_host_element_css_selector').shadowRoot;

这里的 ‘your_host_element_css_selector’ 是用于定位 Shadow DOM 宿主元素的 CSS 选择器。

实用技巧:如何获取 Shadow Root 的 JavaScript 路径(Chrome 浏览器

问小白 问小白

免费使用DeepSeek满血版

问小白 5331 查看详情 问小白 打开 Chrome 开发者工具(F12)。在“Elements”面板中,找到 Shadow DOM 的宿主元素。通常,它会有一个 #shadow-root 的标记。右键点击该宿主元素,选择“Copy” -> “Copy JS path”。复制的 JS path 可能会很长,例如 document.querySelector(“#app > my-component”).shadowRoot。我们需要对其进行一些修改:确保它以 return 开头。将双引号替换为单引号(如果需要,以避免 Python 字符串冲突)。确保路径指向的是 shadowRoot 属性。

示例代码:获取 Shadow Root

from selenium import webdriverfrom selenium.webdriver.common.by import Byfrom selenium.webdriver.support.ui import WebDriverWaitfrom selenium.webdriver.support import expected_conditions as EC# 初始化 WebDriverdriver = webdriver.Chrome()driver.get('https://your-target-url.com') # 替换为实际的 URLtry:    # 等待 Shadow DOM 的宿主元素出现    # 假设宿主元素的 CSS 选择器是 '#host-element'    host_element_selector = '#host-element'    WebDriverWait(driver, 10).until(        EC.presence_of_element_located((By.CSS_SELECTOR, host_element_selector))    )    # 通过 JavaScript 获取 Shadow Root    # 这里的 'return document.querySelector("#host-element").shadowRoot' 是一个示例    # 请根据实际页面结构调整 '#host-element'    shadow_root_script = f"return document.querySelector('{host_element_selector}').shadowRoot"    shadow_root = driver.execute_script(shadow_root_script)    if shadow_root:        print("成功获取 Shadow Root。")        # shadow_root 现在是一个 Selenium WebElement 对象,可以像常规元素一样使用    else:        print("未能获取 Shadow Root,宿主元素可能不存在或没有 Shadow DOM。")except Exception as e:    print(f"发生错误: {e}")finally:    # driver.quit() # 暂时不关闭,以便在下一步使用    pass

步骤二:在 Shadow Root 中定位目标元素

一旦获得了 shadow_root 对象,就可以像操作普通的 Selenium WebElement 一样,在其内部使用 find_element 或 find_elements 方法来定位 Shadow DOM 内部的元素。需要注意的是,在 Shadow Root 中,通常推荐使用 CSS 选择器进行定位。

实用技巧:如何获取元素的 CSS 选择器(Chrome 浏览器)

打开 Chrome 开发者工具(F12)。在“Elements”面板中,展开 Shadow DOM 结构,找到你想要定位的目标元素。右键点击该元素,选择“Copy” -> “Copy selector”。复制的 CSS 选择器可以直接用于 By.CSS_SELECTOR。

示例代码:在 Shadow Root 中定位元素

接着上面的代码片段:

# ... (前面的代码,直到获取 shadow_root) ...if shadow_root:    print("成功获取 Shadow Root。")    try:        # 在 Shadow Root 中定位目标元素        # 假设我们要找的是一个 ID 为 "instance" 的 input 元素        # 使用 By.ID 或 By.CSS_SELECTOR 都可以        target_element_in_shadow = shadow_root.find_element(By.ID, "instance")        # 或者 target_element_in_shadow = shadow_root.find_element(By.CSS_SELECTOR, '#instance')        if target_element_in_shadow:            print(f"成功定位到 Shadow DOM 中的元素: {target_element_in_shadow.tag_name}, ID: {target_element_in_shadow.get_attribute('id')}")            # 对定位到的元素进行操作,例如输入文本            target_element_in_shadow.send_keys("Hello Shadow DOM!")            print("已向元素输入文本。")        else:            print("未能在 Shadow Root 中定位到目标元素。")    except Exception as e:        print(f"在 Shadow Root 中定位元素时发生错误: {e}")else:    print("未能获取 Shadow Root,无法在其内部定位元素。")# ... (finally 块,关闭 driver) ...

完整示例代码

将上述步骤整合,形成一个完整的自动化脚本:

from selenium import webdriverfrom selenium.webdriver.common.by import Byfrom selenium.webdriver.support.ui import WebDriverWaitfrom selenium.webdriver.support import expected_conditions as EC# 定义目标 URL 和 Shadow DOM 宿主元素的 CSS 选择器# 请根据实际情况修改这些值LOGIN_URL = 'https://sso-login.revelup.com' # 示例 URL,请替换SHADOW_HOST_SELECTOR = '#login-container' # 假设 Shadow DOM 挂载在一个 ID 为 'login-container' 的元素上TARGET_INPUT_ID = 'instance' # Shadow DOM 内部目标 input 元素的 IDdef access_shadow_dom_element(url, shadow_host_selector, target_element_id):    driver = webdriver.Chrome()    driver.get(url)    driver.implicitly_wait(7) # 设置隐式等待,等待元素加载    try:        print(f"尝试访问 URL: {url}")        # 步骤 1: 获取 Shadow Root        # 首先等待 Shadow DOM 的宿主元素出现        print(f"等待 Shadow DOM 宿主元素 ({shadow_host_selector}) 出现...")        WebDriverWait(driver, 15).until(            EC.presence_of_element_located((By.CSS_SELECTOR, shadow_host_selector))        )        print("宿主元素已出现。")        # 构建 JavaScript 脚本来获取 Shadow Root        shadow_root_script = f"return document.querySelector('{shadow_host_selector}').shadowRoot"        shadow_root = driver.execute_script(shadow_root_script)        if shadow_root:            print("成功获取 Shadow Root。")            # 步骤 2: 在 Shadow Root 中定位目标元素            print(f"在 Shadow Root 中定位目标元素 (ID: {target_element_id})...")            # 使用 WebDriverWait 显式等待 Shadow DOM 内部元素出现            target_element = WebDriverWait(shadow_root, 10).until(                EC.presence_of_element_located((By.ID, target_element_id))            )            if target_element:                print(f"成功定位到 Shadow DOM 中的元素: {target_element.tag_name}, ID: {target_element.get_attribute('id')}")                # 对定位到的元素进行操作                target_element.send_keys("MySecretPassword")                print("已向目标元素输入文本。")                # 示例:获取输入框的值                print(f"输入框当前的值: {target_element.get_attribute('value')}")            else:                print("未能在 Shadow Root 中定位到目标元素。")        else:            print("未能获取 Shadow Root,请检查宿主选择器或页面结构。")    except Exception as e:        print(f"自动化过程中发生错误: {e}")    finally:        print("关闭 WebDriver。")        driver.quit()# 调用函数执行自动化流程if __name__ == "__main__":    access_shadow_dom_element(LOGIN_URL, SHADOW_HOST_SELECTOR, TARGET_INPUT_ID)

注意事项与总结

CSS 选择器是关键: 在 Shadow DOM 中定位元素时,CSS 选择器是最可靠和推荐的方法。确保你获取的 CSS 选择器是准确且唯一的。等待机制: 即使使用了 implicitly_wait,也强烈建议对 Shadow DOM 的宿主元素和 Shadow DOM 内部的元素使用 WebDriverWait 进行显式等待。这可以避免在元素尚未完全加载时尝试定位而导致的错误。JavaScript 路径的准确性: 获取 Shadow Root 的 JavaScript 路径必须非常精确。任何微小的错误都可能导致 execute_script 返回 None 或抛出 JavaScript 错误。嵌套 Shadow DOM: 如果存在多层嵌套的 Shadow DOM,你需要逐层获取 Shadow Root。例如,先获取第一层 Shadow Root,然后在这个 Shadow Root 对象上执行 JavaScript 来获取第二层 Shadow Root,以此类推。跨浏览器兼容性: 虽然本文主要以 Chrome 为例,但这种通过 execute_script 访问 shadowRoot 的方法在支持 Shadow DOM 的现代浏览器中通常是通用的。

通过掌握上述方法,你可以有效地使用 Selenium 和 Python 应对 Shadow DOM 带来的自动化挑战,确保测试脚本能够稳定地与现代 Web 应用进行交互。

以上就是使用 Selenium 和 Python 访问 Shadow DOM 中的元素的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/593439.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2025年11月10日 16:59:39
下一篇 2025年11月10日 17:01:12

相关推荐

  • CSS mask属性无法获取图片:为什么我的图片不见了?

    CSS mask属性无法获取图片 在使用CSS mask属性时,可能会遇到无法获取指定照片的情况。这个问题通常表现为: 网络面板中没有请求图片:尽管CSS代码中指定了图片地址,但网络面板中却找不到图片的请求记录。 问题原因: 此问题的可能原因是浏览器的兼容性问题。某些较旧版本的浏览器可能不支持CSS…

    2025年12月24日
    900
  • 如何用dom2img解决网页打印样式不显示的问题?

    用dom2img解决网页打印样式不显示的问题 想将网页以所见即打印的的效果呈现,需要采取一些措施,特别是在使用了bootstrap等大量采用外部css样式的框架时。 问题根源 在常规打印操作中,浏览器通常会忽略css样式等非必要的页面元素,导致打印出的结果与网页显示效果不一致。这是因为打印机制只识别…

    2025年12月24日
    800
  • 如何用 CSS 模拟不影响其他元素的链接移入效果?

    如何模拟 css 中链接的移入效果 在 css 中,模拟移入到指定链接的效果尤为复杂,因为链接的移入效果不影响其他元素。要实现这种效果,最简单的方法是利用放大,例如使用 scale 或 transform 元素的 scale 属性。下面提供两种方法: scale 属性: .goods-item:ho…

    2025年12月24日
    700
  • Uniapp 中如何不拉伸不裁剪地展示图片?

    灵活展示图片:如何不拉伸不裁剪 在界面设计中,常常需要以原尺寸展示用户上传的图片。本文将介绍一种在 uniapp 框架中实现该功能的简单方法。 对于不同尺寸的图片,可以采用以下处理方式: 极端宽高比:撑满屏幕宽度或高度,再等比缩放居中。非极端宽高比:居中显示,若能撑满则撑满。 然而,如果需要不拉伸不…

    2025年12月24日
    400
  • PC端H5项目如何实现适配:流式布局、响应式设计和两套样式?

    PC端的适配方案及PC与H5兼顾的实现方案探讨 在开发H5项目时,常用的屏幕适配方案是postcss-pxtorem或postcss-px-to-viewport,通常基于iPhone 6标准作为设计稿。但对于PC端网项目,处理不同屏幕大小需要其他方案。 PC端屏幕适配方案 PC端屏幕适配一般采用流…

    2025年12月24日
    300
  • CSS 元素设置 10em 和 transition 后为何没有放大效果?

    CSS 元素设置 10em 和 transition 后为何无放大效果? 你尝试设置了一个 .box 类,其中包含字体大小为 10em 和过渡持续时间为 2 秒的文本。当你载入到页面时,它没有像 YouTube 视频中那样产生放大效果。 原因可能在于你将 CSS 直接写在页面中 在你的代码示例中,C…

    2025年12月24日
    400
  • 如何实现类似横向U型步骤条的组件?

    横向U型步骤条寻求替代品 希望找到类似横向U型步骤条的组件或 CSS 实现。 潜在解决方案 根据给出的参考图片,类似的组件有: 图片所示组件:图片提供了组件的外观,但没有提供具体的实现方式。参考链接:提供的链接指向了 SegmentFault 上的另一个问题,其中可能包含相关的讨论或解决方案建议。 …

    2025年12月24日
    800
  • 如何让小说网站控制台显示乱码,同时网页内容正常显示?

    如何在不影响用户界面的情况下实现控制台乱码? 当在小说网站上下载小说时,大家可能会遇到一个问题:网站上的文本在网页内正常显示,但是在控制台中却是乱码。如何实现此类操作,从而在不影响用户界面(UI)的情况下保持控制台乱码呢? 答案在于使用自定义字体。网站可以通过在服务器端配置自定义字体,并通过在客户端…

    2025年12月24日
    800
  • 如何优化CSS Grid布局中子元素排列和宽度问题?

    css grid布局中的优化问题 在使用css grid布局时可能会遇到以下问题: 问题1:无法控制box1中li的布局 box1设置了grid-template-columns: repeat(auto-fill, 20%),这意味着容器将自动填充尽可能多的20%宽度的列。当li数量大于5时,它们…

    2025年12月24日
    800
  • SASS 中的 Mixins

    mixin 是 css 预处理器提供的工具,虽然它们不是可以被理解的函数,但它们的主要用途是重用代码。 不止一次,我们需要创建多个类来执行相同的操作,但更改单个值,例如字体大小的多个类。 .fs-10 { font-size: 10px;}.fs-20 { font-size: 20px;}.fs-…

    2025年12月24日
    000
  • 如何在地图上轻松创建气泡信息框?

    地图上气泡信息框的巧妙生成 地图上气泡信息框是一种常用的交互功能,它简便易用,能够为用户提供额外信息。本文将探讨如何借助地图库的功能轻松创建这一功能。 利用地图库的原生功能 大多数地图库,如高德地图,都提供了现成的信息窗体和右键菜单功能。这些功能可以通过以下途径实现: 高德地图 JS API 参考文…

    2025年12月24日
    400
  • 如何使用 scroll-behavior 属性实现元素scrollLeft变化时的平滑动画?

    如何实现元素scrollleft变化时的平滑动画效果? 在许多网页应用中,滚动容器的水平滚动条(scrollleft)需要频繁使用。为了让滚动动作更加自然,你希望给scrollleft的变化添加动画效果。 解决方案:scroll-behavior 属性 要实现scrollleft变化时的平滑动画效果…

    2025年12月24日
    000
  • CSS mask 属性无法加载图片:浏览器问题还是代码错误?

    CSS mask 属性请求图片失败 在使用 CSS mask 属性时,您遇到了一个问题,即图片没有被请求获取。这可能是由于以下原因: 浏览器问题:某些浏览器可能在处理 mask 属性时存在 bug。尝试更新到浏览器的最新版本。代码示例中的其他信息:您提供的代码示例中还包含其他 HTML 和 CSS …

    2025年12月24日
    000
  • 如何为滚动元素添加平滑过渡,使滚动条滑动时更自然流畅?

    给滚动元素平滑过渡 如何在滚动条属性(scrollleft)发生改变时为元素添加平滑的过渡效果? 解决方案:scroll-behavior 属性 为滚动容器设置 scroll-behavior 属性可以实现平滑滚动。 html 代码: click the button to slide right!…

    2025年12月24日
    500
  • 如何用 CSS 实现链接移入效果?

    css 中实现链接移入效果的技巧 在 css 中模拟链接的移入效果可能并不容易,因为它们不会影响周围元素。但是,有几个方法可以实现类似的效果: 1. 缩放 最简单的方法是使用 scale 属性,它会放大元素。以下是一个示例: 立即学习“前端免费学习笔记(深入)”; .goods-item:hover…

    2025年12月24日
    000
  • 网页使用本地字体:为什么 CSS 代码中明明指定了“荆南麦圆体”,页面却仍然显示“微软雅黑”?

    网页中使用本地字体 本文将解答如何将本地安装字体应用到网页中,避免使用 src 属性直接引入字体文件。 问题: 想要在网页上使用已安装的“荆南麦圆体”字体,但 css 代码中将其置于第一位的“font-family”属性,页面仍显示“微软雅黑”字体。 立即学习“前端免费学习笔记(深入)”; 答案: …

    2025年12月24日
    000
  • 如何选择元素个数不固定的指定类名子元素?

    灵活选择元素个数不固定的指定类名子元素 在网页布局中,有时需要选择特定类名的子元素,但这些元素的数量并不固定。例如,下面这段 html 代码中,activebar 和 item 元素的数量均不固定: *n *n 如果需要选择第一个 item元素,可以使用 css 选择器 :nth-child()。该…

    2025年12月24日
    200
  • 如何用 CSS 实现类似卡券的缺口效果?

    类似卡券的布局如何实现 想要实现类似卡券的布局,可以使用遮罩(mask)来实现缺口效果。 示例代码: .card { -webkit-mask: radial-gradient(circle at 20px, #0000 20px, red 0) -20px;} 效果: 立即学习“前端免费学习笔记(…

    2025年12月24日
    000
  • 使用 SVG 如何实现自定义宽度、间距和半径的虚线边框?

    使用 svg 实现自定义虚线边框 如何实现一个具有自定义宽度、间距和半径的虚线边框是一个常见的前端开发问题。传统的解决方案通常涉及使用 border-image 引入切片图片,但是这种方法存在引入外部资源、性能低下的缺点。 为了避免上述问题,可以使用 svg(可缩放矢量图形)来创建纯代码实现。一种方…

    2025年12月24日
    100
  • 如何用纯代码实现自定义宽度和间距的虚线边框?

    自定义宽度和间距的虚线边框 提问: 如何创建一个自定义宽度和间距的虚线边框,如下图所示: 元素宽度:8px元素高度:1px间距:2px圆角:4px 解答: 传统的解决方案通常涉及使用 border-image 引入切片的图片来实现。但是,这需要引入外部资源。本解答将提供一种纯代码的方法,使用 svg…

    2025年12月24日
    000

发表回复

登录后才能评论
关注微信