使用 collections.ChainMap 实现深度字典合并

使用 collections.chainmap 实现深度字典合并

本文探讨了如何利用 Python 的 collections.ChainMap 实现深度字典合并。标准 ChainMap 仅提供浅层合并,即遇到重复键时只取第一个值。针对嵌套字典场景,我们通过自定义 DeepChainMap 类并重写其 __getitem__ 方法,使其能够递归地合并相同键下的字典值,从而实现复杂的深度合并逻辑,有效处理多层嵌套的数据结构。

理解 collections.ChainMap 及其局限性

collections.ChainMap 是 Python collections 模块提供的一个类,它将多个字典或映射组合成一个单一的可更新视图。它维护一个映射列表,并在查找键时按照列表的顺序从左到右进行搜索,返回第一个找到的值。这对于需要按优先级合并配置或查找变量的场景非常有用。

考虑以下两个字典 a 和 b:

a = {'123': {'player': 1, 'opponent': 2},     '18': {'player': 10, 'opponent': 12}}b = {'123': {'winner': 1},     '180': {'winner': 2}}

如果使用标准的 ChainMap 进行合并:

from collections import ChainMapmerged_map = ChainMap(a, b)print(dict(merged_map))

输出结果为:

{'123': {'player': 1, 'opponent': 2}, '180': {'winner': 2}, '18': {'player': 10, 'opponent': 12}}

可以看到,对于键 ‘123’,ChainMap 仅仅返回了字典 a 中对应的值 {‘player’: 1, ‘opponent’: 2},而忽略了字典 b 中 ‘123’ 键下的 {‘winner’: 1}。这是因为 ChainMap 实现了浅层合并,它在遇到重复键时,只会返回映射列表中第一个找到的键值对,不会进一步合并键对应的值(如果它们也是字典)。

然而,我们期望的输出是:

{'123': {'player': 1, 'opponent': 2, 'winner': 1}, '18': {'player': 10, 'opponent': 12}, '180': {'winner': 2}}

这要求当多个字典中存在相同的键,并且这些键对应的值本身也是字典时,我们需要将这些嵌套的字典进行递归合并,而非简单地取第一个。

实现自定义 DeepChainMap 进行深度合并

为了实现这种深度合并行为,我们需要创建一个 ChainMap 的子类,并重写其 __getitem__ 方法。__getitem__ 是 Python 对象在通过 obj[key] 访问元素时调用的特殊方法。通过自定义此方法,我们可以在键查找时引入递归合并逻辑。

以下是 DeepChainMap 的实现:

from collections import ChainMapclass DeepChainMap(ChainMap):    """    ChainMap 的变体,支持对嵌套字典进行递归深度合并。    """    def __getitem__(self, key):        """        重写 __getitem__ 方法,实现深度合并逻辑。        当查找到的第一个值是字典时,递归地将所有映射中        该键对应的字典值合并为一个新的 DeepChainMap。        """        # 收集所有映射中与给定键关联的值        # 注意:这里会收集所有找到的值,即使它们不是字典        values = (mapping[key] for mapping in self.maps if key in mapping)        try:            # 获取第一个找到的值            first = next(values)        except StopIteration:            # 如果在任何映射中都未找到该键,则抛出 KeyError            return self.__missing__(key)        # 如果第一个找到的值是字典类型,则进行递归合并        if isinstance(first, dict):            # 使用当前 DeepChainMap 类,将第一个字典和后续找到的所有字典            # 作为新的映射列表,递归创建并返回一个新的 DeepChainMap 实例。            # 这样就实现了对嵌套字典的深度合并。            return self.__class__(first, *values)        # 如果第一个找到的值不是字典,则直接返回该值(标准 ChainMap 行为)        return first    def __repr__(self):        """        重写 __repr__ 方法,使其在打印时更清晰,直接显示为字典形式。        """        return repr(dict(self))

代码解析:

__getitem__(self, key) 方法:values = (mapping[key] for mapping in self.maps if key in mapping): 这一行是关键。它不是简单地返回第一个找到的值,而是创建一个生成器表达式,迭代 self.maps(即 ChainMap 内部维护的字典列表),收集所有映射中与 key 关联的值。first = next(values): 尝试从 values 生成器中获取第一个值。except StopIteration: return self.__missing__(key): 如果 values 为空(即 key 在所有映射中都不存在),则调用 __missing__ 方法(通常会抛出 KeyError),保持与标准字典和 ChainMap 一致的错误行为。if isinstance(first, dict): return self.__class__(first, *values): 这是实现深度合并的核心逻辑。如果 first 值是一个字典,这意味着我们需要进一步合并它。我们通过 self.__class__(first, *values) 递归地创建了一个新的 DeepChainMap 实例。这个新的 DeepChainMap 的映射列表由 first 字典和 values 生成器中剩余的所有字典组成。当访问这个新的 DeepChainMap 内部的键时,会再次触发 __getitem__ 方法,从而实现多层嵌套字典的深度合并。return first: 如果 first 值不是字典(例如,是字符串、整数、列表等),则直接返回它,保持 ChainMap 的默认行为。__repr__(self) 方法:return repr(dict(self)): 这个方法是为了让 DeepChainMap 实例在被 print() 或在交互式环境中显示时,能够以更直观的字典形式展现,方便调试和理解。

示例用法

现在,我们可以使用 DeepChainMap 来实现我们期望的深度合并:

# 示例字典数据a = {'123': {'player': 1,             'opponent': 2},     '18': {'player': 10,            'opponent': 12}    }b = {'123': {'winner': 1},     '180': {'winner': 2}    }# 使用自定义的 DeepChainMap 进行合并deep_merged_map = DeepChainMap(a, b)# 打印合并后的结果print(deep_merged_map)

输出结果:

{'123': {'winner': 1, 'player': 1, 'opponent': 2}, '180': {'winner': 2}, '18': {'player': 10, 'opponent': 12}}

可以看到,对于键 ‘123’,a 和 b 中对应的嵌套字典 {‘player’: 1, ‘opponent’: 2} 和 {‘winner’: 1} 已经被成功地合并成 {‘winner’: 1, ‘player’: 1, ‘opponent’: 2}。同时,其他不冲突的键 ’18’ 和 ‘180’ 也被正确地包含在最终结果中。

注意事项与总结

合并顺序与优先级: DeepChainMap 继承了 ChainMap 的特性,其合并顺序仍然是从左到右。这意味着在深度合并嵌套字典时,如果多个字典中存在相同的内层键,靠前的字典中的值会优先被保留或合并。在上述示例中,{‘winner’: 1} 来自 b,{‘player’: 1, ‘opponent’: 2} 来自 a。最终 ‘winner’ 键在 ‘player’ 和 ‘opponent’ 之后出现,这是因为在 DeepChainMap(a, b) 中,a 字典中的 ‘123’ 被作为第一个映射传递给内层递归的 DeepChainMap。非字典值的处理: 本文提供的 DeepChainMap 实现只针对值为字典的情况进行深度合并。如果相同键对应的值不是字典(例如,都是整数、字符串或列表),它将遵循 ChainMap 的默认行为,即返回第一个找到的值。如果需要对其他类型(如列表)进行特殊的深度合并(例如,列表拼接),则需要进一步扩展 __getitem__ 中的逻辑。写入操作: 本文的 DeepChainMap 主要侧重于读取(__getitem__)时的深度合并行为。ChainMap 默认的 __setitem__ 和 __delitem__ 操作只作用于其映射列表中的第一个可写字典。如果需要对深度合并后的结构进行写入或删除操作,并希望这些操作能够影响到原始的嵌套字典,则需要额外重写 __setitem__ 和 __delitem__ 方法,并实现相应的递归写入/删除逻辑。性能考量: 每次 __getitem__ 访问嵌套字典时都可能创建新的 DeepChainMap 实例,这在非常深层或频繁访问的场景下可能会有轻微的性能开销。但在大多数常规应用中,这种开销通常可以接受。

通过自定义 ChainMap 的 __getitem__ 方法,我们成功地将一个只支持浅层合并的工具扩展为能够处理复杂嵌套字典的深度合并器。这展示了 Python 灵活的面向对象特性和特殊方法(dunder methods)在构建自定义数据结构时的强大能力。

以上就是使用 collections.ChainMap 实现深度字典合并的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1366986.html

赞 (0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
解决Windows环境下Python pip install jq失败的方案
上一篇 2025年12月14日 07:01:47
Polars 中高效计算分组内时间序列差值
下一篇 2025年12月14日 07:02:00

相关推荐

  • MySQL如何使用外键约束删除 级联删除与SET NULL策略

    MySQL如何使用外键约束删除 级联删除与SET NULL策略MySQL如何使用外键约束删除 级联删除与SET NULL策略MySQL如何使用外键约束删除 级联删除与SET NULL策略MySQL如何使用外键约束删除 级联删除与SET NULL策略

    外键约束在mysql中用于维护数据完整性,级联删除和set null是两种处理删除操作的策略。1. 创建父表并定义主键;2. 创建子表时通过foreign key指定外键,并使用on delete cascade或on delete set null设定删除策略;3. 插入测试数据验证约束效果;4.…

    2026年9月28日 • 用户投稿
    000
  • 使用存储过程生成ID时出现重复值的解决方案

    使用存储过程生成ID时出现重复值的解决方案使用存储过程生成ID时出现重复值的解决方案使用存储过程生成ID时出现重复值的解决方案使用存储过程生成ID时出现重复值的解决方案

    在高并发环境中,使用存储过程生成ID时出现重复值是一个常见的问题。虽然在Java应用程序中使用了Spring的TransactionTemplate,并设置了SERIALIZABLE隔离级别,但仍然可能出现ID冲突。问题的根源可能在于事务管理不当,以及数据库表的锁定机制。 事务管理 首先,需要确认U…

    2026年9月28日 • 用户投稿
    100
  • ChatGPT如何优化剧本创作 ChatGPT戏剧冲突生成技巧

    ChatGPT如何优化剧本创作 ChatGPT戏剧冲突生成技巧ChatGPT如何优化剧本创作 ChatGPT戏剧冲突生成技巧ChatGPT如何优化剧本创作 ChatGPT戏剧冲突生成技巧ChatGPT如何优化剧本创作 ChatGPT戏剧冲突生成技巧

    本文将探讨如何利用ChatGPT来优化剧本创作,并分享ChatGPT在生成戏剧冲突方面的技巧。我们将首先概述ChatGPT在剧本创作中的潜力,然后深入讲解如何通过与ChatGPT的互动来打磨故事情节,特别是如何生成具有吸引力的戏剧冲突,为创作者提供实用可行的指导。 ☞☞☞AI 智能聊天, 问答助手,…

    2026年9月28日 • 用户投稿
    000
  • CCleaner怎么备份注册表_CCleaner备份注册表的正确操作流程

    CCleaner怎么备份注册表_CCleaner备份注册表的正确操作流程CCleaner怎么备份注册表_CCleaner备份注册表的正确操作流程CCleaner怎么备份注册表_CCleaner备份注册表的正确操作流程CCleaner怎么备份注册表_CCleaner备份注册表的正确操作流程

    开启CCleaner注册表备份功能可防止清理出错,需在“设置”中勾选“修复前备份注册表”并指定存储路径,扫描修复时会自动生成.reg备份文件,异常时双击该文件导入即可恢复系统。 CCleaner 备份注册表是为了防止清理或修复操作导致系统出现问题,提前保存当前注册表状态,以便需要时可恢复。虽然 CC…

    2026年9月28日 • 用户投稿
    000
  • 别人堵车我chill?国庆宅家的正确姿势竟是躺平式充电……

    别人堵车我chill?国庆宅家的正确姿势竟是躺平式充电……别人堵车我chill?国庆宅家的正确姿势竟是躺平式充电……别人堵车我chill?国庆宅家的正确姿势竟是躺平式充电……别人堵车我chill?国庆宅家的正确姿势竟是躺平式充电……

    中秋遇上国庆,假期模式即将开启。与其在高速上寸步难行、在景区里人挤人,不如安心宅在家,享受一段自在又充实的时光。我已经用华为阅读精心挑选了一份实用又合口味的书单,还在华为视频收藏了一堆经典影视佳作,让这个长假既能彻底放松,又能悄悄提升自我,实现“躺平也能进步”的理想状态。 开通华为阅读会员后,仿佛打…

    2026年9月28日 • 用户投稿
    100
  • 提高效率的幕布快捷键大全

    提高效率的幕布快捷键大全提高效率的幕布快捷键大全提高效率的幕布快捷键大全提高效率的幕布快捷键大全

    掌握幕布快捷键可显著提升笔记效率,本文介绍Mac环境下基础文本格式(如Command+B加粗)、调整层级(Tab缩进)、移动管理主题(Command+D复制)、专注模式切换及内容编辑(Shift+Enter添加描述)等核心操作。 如果您正在使用幕布进行笔记整理或大纲规划,却发现频繁操作鼠标拖慢了您的…

    2026年9月28日 • 用户投稿
    100
  • 抖音怎么在电脑上直播?抖音不够1000粉丝怎么开橱窗

    抖音怎么在电脑上直播?抖音不够1000粉丝怎么开橱窗抖音怎么在电脑上直播?抖音不够1000粉丝怎么开橱窗抖音怎么在电脑上直播?抖音不够1000粉丝怎么开橱窗抖音怎么在电脑上直播?抖音不够1000粉丝怎么开橱窗

    随着抖音的火爆,越来越多的人想要在电脑上直播,分享自己的生活和才艺。但是,电脑上如何进行抖音直播呢?别急,今天就来给大家详细讲解一下电脑上抖音直播的步骤和技巧。 一、准备工作 1. 注册抖音账号 在电脑上直播之前,首先需要在抖音APP上注册一个账号。如果还没有账号,可以下载抖音APP进行注册。 2.…

    2026年9月28日 • 用户投稿
    000
  • Java控制台图案生成:基于用户输入的字符交替模式实现

    Java控制台图案生成:基于用户输入的字符交替模式实现Java控制台图案生成:基于用户输入的字符交替模式实现Java控制台图案生成:基于用户输入的字符交替模式实现Java控制台图案生成:基于用户输入的字符交替模式实现

    本文将详细介绍如何在Java中实现一个动态字符图案生成程序。该程序根据用户输入的整数值,逐行打印字符。每行字符的数量与行号相同,同时字符会根据行号的奇偶性在“+”和“-”之间交替。我们将通过嵌套循环和条件判断来构建这一逻辑,并提供完整的Java代码示例,帮助读者掌握此类图案生成技巧。 动态字符图案生…

    2026年9月28日 • 用户投稿
    000
  • AI Overviews如何设置数据脱敏 AI Overviews隐私保护处理流程

    AI Overviews如何设置数据脱敏 AI Overviews隐私保护处理流程AI Overviews如何设置数据脱敏 AI Overviews隐私保护处理流程AI Overviews如何设置数据脱敏 AI Overviews隐私保护处理流程AI Overviews如何设置数据脱敏 AI Overviews隐私保护处理流程

    本篇文章将详细介绍AI Overviews中数据脱敏的设置方法和隐私保护处理流程,帮助您理解并实现有效的隐私保护措施。我们将从数据脱敏的基本概念入手,逐步讲解实现数据脱敏的具体操作步骤,并阐述相关的隐私保护处理流程,确保您的AI Overviews在使用过程中符合隐私规范。 ☞☞☞AI 智能聊天, …

    2026年9月28日 • 用户投稿
    100
  • win10 DISM命令修复失败怎么办_部署映像服务和管理工具错误处理

    win10 DISM命令修复失败怎么办_部署映像服务和管理工具错误处理win10 DISM命令修复失败怎么办_部署映像服务和管理工具错误处理win10 DISM命令修复失败怎么办_部署映像服务和管理工具错误处理win10 DISM命令修复失败怎么办_部署映像服务和管理工具错误处理

    1、确保DISM命令格式正确并以管理员身份运行;2、更新系统至最新版本解决兼容性问题;3、先执行SFC扫描修复基础文件;4、必要时通过Windows安装U盘启动进入恢复环境使用DISM和SFC联合修复系统。 如果您在尝试使用DISM命令修复Windows 10系统时遭遇失败,可能是由于命令输入错误、…

    2026年9月28日 • 用户投稿
    200
  • sublime终端乱码问题_解决Sublime内置终端中文乱码

    sublime终端乱码问题_解决Sublime内置终端中文乱码sublime终端乱码问题_解决Sublime内置终端中文乱码sublime终端乱码问题_解决Sublime内置终端中文乱码sublime终端乱码问题_解决Sublime内置终端中文乱码

    解决Sublime内置终端中文乱码需统一编码为UTF-8:1. 将文件保存为UTF-8编码;2. 设置Build System的环境变量PYTHONIOENCODING为utf-8;3. 在Windows下通过chcp 65001切换控制台代码页至UTF-8;4. 或使用外部终端运行脚本,避免输出面…

    2026年9月28日 • 用户投稿
    100
  • 如何使用 SSHGUARD 阻止 SSH 暴力攻击

    如何使用 SSHGUARD 阻止 SSH 暴力攻击如何使用 SSHGUARD 阻止 SSH 暴力攻击如何使用 SSHGUARD 阻止 SSH 暴力攻击如何使用 SSHGUARD 阻止 SSH 暴力攻击

    ◆ 概述 sshguard是一个入侵防御实用程序,它可以解析日志并使用系统防火墙自动阻止行为不端的 ip 地址(或其子网)。最初旨在为 openssh 服务提供额外的保护层,sshguard 还保护范围广泛的服务,例如 vsftpd 和 postfix。它可以识别多种日志格式,包括 syslog、s…

    2026年9月28日 • 用户投稿
    100
  • 开放协作,共筑新章:openFuyao代码仓全面开源,多样化算力集群软件开源生态开启新篇

    开放协作,共筑新章:openFuyao代码仓全面开源,多样化算力集群软件开源生态开启新篇开放协作,共筑新章:openFuyao代码仓全面开源,多样化算力集群软件开源生态开启新篇开放协作,共筑新章:openFuyao代码仓全面开源,多样化算力集群软件开源生态开启新篇开放协作,共筑新章:openFuyao代码仓全面开源,多样化算力集群软件开源生态开启新篇

    [中国,上海,2025年9月18-20日]以“跃升行业智能化”为主题的“华为全联接大会2025”在上海隆重召开。大会上,openfuyao社区正式宣布其代码仓库全面开源,华为常务董事汪涛、华为鲲鹏计算业务总裁李义以及鲲鹏计算产品部部长刘林超分别在主题演讲中深入分享了社区在开源生态建设、技术演进成果及…

    2026年9月28日 • 用户投稿
    200
  • 2025年最新十大免费自动生成美女图片的AI工具排行榜

    答案是2025年值得关注的免费AI美女图片生成工具包括“星绘”智能画廊和“幻影之笔”自由创作平台:前者界面简洁、擅长亚洲风格女性形象生成,出图稳定且细节出色,适合新手快速获得高质量图片;后者支持高级提示词输入、负面提示和局部重绘,风格多元,适合掌握技巧后进行复杂角色与场景创作。两者均提供基础免费服务…

    2026年9月28日
    000
  • 骁龙X2 Elite正式发布:共3个版本 最高配达18核

    骁龙X2 Elite正式发布:共3个版本 最高配达18核骁龙X2 Elite正式发布:共3个版本 最高配达18核骁龙X2 Elite正式发布:共3个版本 最高配达18核骁龙X2 Elite正式发布:共3个版本 最高配达18核

    在今日的骁龙峰会上,高通不仅推出了第五代骁龙8至尊版移动平台,还正式发布了全新的pc处理器——骁龙x2 elite。该芯片延续了基于arm架构的第三代oryon cpu设计,旨在进一步拓展其在windows笔记本市场中的竞争力。 此次发布的骁龙X2 Elite共包含三个型号:X2E-80-100、X…

    2026年9月28日 • 用户投稿
    100
  • 微信公众号第一篇文章怎么写_微信公众号首篇文章撰写教程

    微信公众号第一篇文章怎么写_微信公众号首篇文章撰写教程微信公众号第一篇文章怎么写_微信公众号首篇文章撰写教程微信公众号第一篇文章怎么写_微信公众号首篇文章撰写教程微信公众号第一篇文章怎么写_微信公众号首篇文章撰写教程

    首篇文章需明确内容定位、选题方向、排版设计与推广策略。应聚焦垂直领域,选择能体现定位且具吸引力的实用型选题,控制篇幅在1500-2000字,避免理论化与抄袭;通过秀米或135编辑器优化排版,使用高清相关配图并注意版权;发布后分享至朋友圈、微信群及互推公众号,细水长流积累粉丝;制定更新计划,持续输出原…

    2026年9月28日 • 用户投稿
    100
  • 多模态AI如何处理声学特征 多模态AI环境音识别技术

    多模态AI如何处理声学特征 多模态AI环境音识别技术多模态AI如何处理声学特征 多模态AI环境音识别技术多模态AI如何处理声学特征 多模态AI环境音识别技术多模态AI如何处理声学特征 多模态AI环境音识别技术

    本文将深入探讨多模态AI如何处理声学特征,重点介绍其在环境音识别技术中的应用。我们将从声学特征的提取入手,阐述多模态AI如何融合听觉信息与其他模态信息,以提升环境音识别的准确性和鲁棒性。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 声学特…

    2026年9月28日 • 用户投稿
    100
  • 深入理解RESTful API的无状态性与数据持久化实践

    深入理解RESTful API的无状态性与数据持久化实践深入理解RESTful API的无状态性与数据持久化实践深入理解RESTful API的无状态性与数据持久化实践深入理解RESTful API的无状态性与数据持久化实践

    本教程深入探讨RESTful API的无状态性核心原则,阐明为何不应在服务器内存中维护跨API调用的数据状态。我们将详细介绍RESTful架构的无状态约束,分析在服务器端存储会话或资源状态的弊端,并推荐使用数据库等外部持久化机制来可靠地管理数据,确保API的可伸缩性、可靠性和一致性。 理解RESTf…

    2026年9月28日 • 用户投稿
    100
  • sublime怎么安装markdown预览插件_Sublime Markdown实时预览插件安装教程

    sublime怎么安装markdown预览插件_Sublime Markdown实时预览插件安装教程sublime怎么安装markdown预览插件_Sublime Markdown实时预览插件安装教程sublime怎么安装markdown预览插件_Sublime Markdown实时预览插件安装教程sublime怎么安装markdown预览插件_Sublime Markdown实时预览插件安装教程

    最直接的方式是通过Package Control安装MarkdownPreview或OmniMarkupPreviewer插件,先确保安装Package Control,再通过命令面板搜索并安装插件,最后使用快捷命令在浏览器中实时预览Markdown渲染效果。 在Sublime Text里安装Mar…

    2026年9月28日 • 用户投稿
    100
  • Excel数据怎么分组统计_Excel分类统计与汇总操作技巧

    Excel数据怎么分组统计_Excel分类统计与汇总操作技巧Excel数据怎么分组统计_Excel分类统计与汇总操作技巧Excel数据怎么分组统计_Excel分类统计与汇总操作技巧Excel数据怎么分组统计_Excel分类统计与汇总操作技巧

    数据透视表适合分析大量数据,按行和值字段自动汇总;组合功能可手动分级显示排序后的数据;SUMIF、COUNTIF等函数实现条件统计;分类汇总功能一键插入汇总行。根据场景选择方法可提升效率。 在Excel中进行数据分组统计和分类汇总,是日常工作中处理报表、分析数据的常用操作。掌握这些技巧能大幅提升工作…

    2026年9月28日 • 用户投稿
    100

发表回复

登录后才能评论
关注微信