Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $YECBGYFECGEAFWHA as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2

Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $BBWFDDBHHYHDXXAB as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2
使用 Pandas 在 Excel 中添加基于列比较的状态列_创想鸟

使用 Pandas 在 Excel 中添加基于列比较的状态列

使用 pandas 在 excel 中添加基于列比较的状态列

本文档旨在指导您如何使用 Pandas 库在 Excel 文件中添加一个 “Status” 列,该列的值基于对不同 Excel 文件中特定列的比较结果。我们将详细介绍如何读取 Excel 数据,比较指定列,并根据比较结果生成 “Pass” 或 “Fail” 状态,最后将结果写入新的 Excel 文件。同时,还将展示如何使用样式突出显示比较结果,以便更直观地查看数据差异。

1. 准备工作

在开始之前,请确保您已经安装了 Pandas 库。如果没有安装,可以使用以下命令进行安装:

pip install pandas

此外,您需要准备两个 Excel 文件,例如 source.xlsx 和 target.xlsx,它们分别包含需要比较的数据。确保这两个文件包含一个共同的键列,用于合并数据。

2. 代码实现

以下代码展示了如何使用 Pandas 实现上述功能:

import pandas as pdclass ExcelComparator:    def __init__(self, src_file_name, src_sheet_name, src_pk, src_cols_to_compare, tgt_cols_to_compare, tgt_file_name,                 tgt_sheet_name, tgt_pk, target_excel):        """        初始化 ExcelComparator 类。        Args:            src_file_name (str): 源 Excel 文件名。            src_sheet_name (str): 源 Excel 工作表名。            src_pk (str): 源 Excel 主键列名。            src_cols_to_compare (list): 源 Excel 需要比较的列名列表。            tgt_cols_to_compare (list): 目标 Excel 需要比较的列名列表。            tgt_file_name (str): 目标 Excel 文件名。            tgt_sheet_name (str): 目标 Excel 工作表名。            tgt_pk (str): 目标 Excel 主键列名。            target_excel (str): 目标 Excel 文件名。        """        self.src_file_name = src_file_name        self.src_sheet_name = src_sheet_name        self.src_pk = src_pk        self.src_cols_to_compare = src_cols_to_compare        self.tgt_cols_to_compare = tgt_cols_to_compare        self.tgt_file_name = tgt_file_name        self.tgt_sheet_name = tgt_sheet_name        self.tgt_pk = tgt_pk        self.target_excel = target_excel    def highlight_cells(self, row):        """        根据比较结果突出显示单元格。        Args:            row (pd.Series): DataFrame 的一行数据。        Returns:            list: 包含单元格样式的列表。        """        styles = [''] * len(row)        pk_cols = [col for col in row.index if col in [self.src_pk, self.tgt_pk]]        for i, col in enumerate(row.index):            if i % 2 == 0 and col not in pk_cols:                src_col = col                tgt_col = row.index[i - 1]  # Adjusted to get the previous column                if row[src_col] == row[tgt_col]:                    styles[i], styles[i - 1] = 'background-color:lightgreen', 'background-color:lightgreen'                elif pd.isnull(row[src_col]) or pd.isnull(row[tgt_col]):                    styles[i], styles[i - 1] = 'background-color:yellow', 'background-color:yellow'                else:                    styles[i], styles[i - 1] = 'background-color:lightcoral', 'background-color:lightcoral'        return styles    def calculate_status(self, row):        """        计算状态列的值,如果所有比较的列都匹配,则为 'Pass',否则为 'Fail'。        Args:            row (pd.Series): DataFrame 的一行数据。        Returns:            str: 'Pass' 或 'Fail'。        """        for i in range(len(row.index) - 1, 0, -2):            src_col = row.index[i]            tgt_col = row.index[i - 1]            if row[src_col] != row[tgt_col]:                return 'Fail'        return 'Pass'    def read_and_compare(self):        """        读取 Excel 数据,比较指定列,并添加状态列。        """        src_df = pd.read_excel(self.src_file_name, sheet_name=self.src_sheet_name)        tgt_df = pd.read_excel(self.tgt_file_name, sheet_name=self.tgt_sheet_name)        result = src_df.merge(tgt_df, how='inner', left_on=self.src_pk, right_on=self.tgt_pk)        result_columns = [self.src_pk] + [col for pair in zip(self.src_cols_to_compare, self.tgt_cols_to_compare) for col                                         in pair]        result = result[result_columns]        result['Status'] = result.apply(self.calculate_status, axis=1)        result.style.apply(self.highlight_cells, axis=1).to_excel(self.target_excel)# Example usagecomparator = ExcelComparator(    src_file_name='source.xlsx',    src_sheet_name='Sheet1',    src_pk='ID',    src_cols_to_compare=['Name', 'Salary'],    tgt_cols_to_compare=['FirstName', 'Sal'],    tgt_file_name='target.xlsx',    tgt_sheet_name='Sheet1',    tgt_pk='EMP_ID',    target_excel='result.xlsx')comparator.read_and_compare()

3. 代码详解

ExcelComparator 类:

__init__ 方法:初始化类的各种参数,包括源文件和目标文件的文件名、工作表名、主键列名以及需要比较的列名。highlight_cells 方法:根据比较结果,为单元格添加背景颜色。绿色表示匹配,黄色表示空值,红色表示不匹配。calculate_status 方法:计算每一行的状态,如果所有比较的列都匹配,则状态为 “Pass”,否则为 “Fail”。read_and_compare 方法:读取源文件和目标文件的数据,使用主键列进行合并,选择需要的列,计算状态列,并使用样式突出显示单元格,最后将结果写入新的 Excel 文件。

示例用法:

创建 ExcelComparator 类的实例,并传入相应的参数。调用 read_and_compare 方法,执行比较操作并生成结果文件。

4. 注意事项

确保源文件和目标文件存在,并且包含指定的工作表。确保主键列在两个文件中都存在,并且数据类型一致。确保需要比较的列在两个文件中都存在,并且数据类型可以进行比较。可以根据实际需求修改代码,例如修改比较的列名、修改状态的判断逻辑、修改单元格的样式等。代码中的 highlight_cells 方法使用了 style.apply 函数,可以根据需要自定义样式。

5. 总结

本文档详细介绍了如何使用 Pandas 库在 Excel 文件中添加基于列比较的状态列。通过定义 ExcelComparator 类,我们可以方便地读取 Excel 数据,比较指定列,并根据比较结果生成 “Pass” 或 “Fail” 状态。此外,我们还展示了如何使用样式突出显示比较结果,以便更直观地查看数据差异。希望本文档能够帮助您更好地使用 Pandas 处理 Excel 数据。

以上就是使用 Pandas 在 Excel 中添加基于列比较的状态列的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1368214.html

赞 (0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
使用 Pandas 合并 Excel 数据并添加状态列
上一篇 2025年12月14日 08:35:42
使用 Pandas 比较 Excel 数据并添加状态列
下一篇 2025年12月14日 08:35:51

相关推荐

  • 卢伟冰:功能手机、智能手机之后 手机行业正进入新周期

    9月4日,小米集团总裁卢伟冰表示,继功能机时代与智能机时代之后,全球手机产业正迈入一个全新时代。 卢伟冰今日在社交平台发文提到:“我从2002年进入手机行业,有幸完整见证了功能手机和智能手机两大发展阶段。如今,AI时代已经到来,整个行业正在酝酿深刻变革,步入全新的发展周期。” 回望过去,功能手机时期…

    2026年9月21日
    200
  • Java 正则表达式:查找双引号内所有指定字符串的出现次数

    本文旨在解决在 Java 中使用正则表达式查找双引号内特定字符串(例如 “variant”)的所有出现次数的问题。我们将提供一个完整的解决方案,包括正则表达式的构建、代码示例以及详细的解释,帮助开发者准确高效地完成此类任务。 在 Java 中,使用正则表达式查找字符串中特定模…

    2026年9月21日
    000
  • MySQL 大型历史数据表结构设计与优化指南

    本文旨在为处理大量客户历史交易数据的MySQL数据库设计提供专业指导。我们将探讨如何构建高效、可扩展的表结构,重点关注主键设计、数据分区、实时数据摄入以及性能优化策略,以确保系统能够稳定支持百万级乃至亿级数据量的查询需求。 MySQL大型历史数据表结构设计与优化 在处理大量历史数据,特别是涉及到多用…

    2026年9月21日
    000
  • MySQL重复数据检测与清理逻辑_Sublime脚本批量处理历史冗余记录

    MySQL重复数据检测与清理逻辑_Sublime脚本批量处理历史冗余记录MySQL重复数据检测与清理逻辑_Sublime脚本批量处理历史冗余记录MySQL重复数据检测与清理逻辑_Sublime脚本批量处理历史冗余记录MySQL重复数据检测与清理逻辑_Sublime脚本批量处理历史冗余记录

    处理mysql重复数据的核心步骤是识别并清理,可使用group by或窗口函数定位重复项,再通过分批删除或倒腾法安全清理;sublime text可用于高效生成和编辑sql语句。1. 识别重复数据常用group by+having或row_number()窗口函数;2. 清理策略包括分批删除、使用临…

    2026年9月21日 • 用户投稿
    100
  • 如何用PyTorch训练AI大模型?构建高效神经网络的完整教程

    如何用PyTorch训练AI大模型?构建高效神经网络的完整教程如何用PyTorch训练AI大模型?构建高效神经网络的完整教程如何用PyTorch训练AI大模型?构建高效神经网络的完整教程如何用PyTorch训练AI大模型?构建高效神经网络的完整教程

    PyTorch大模型训练需综合运用分布式训练、内存优化与高效计算策略。首先采用DistributedDataParallel实现多GPU并行,配合DistributedSampler确保数据均衡;通过混合精度训练、梯度累积和激活检查点缓解显存压力;使用torch.compile优化模型计算效率;选择…

    2026年9月21日 • 用户投稿
    100
  • MySQL自动化性能测试方案_MySQL持续监控调优数据库效率

    MySQL自动化性能测试方案_MySQL持续监控调优数据库效率MySQL自动化性能测试方案_MySQL持续监控调优数据库效率MySQL自动化性能测试方案_MySQL持续监控调优数据库效率MySQL自动化性能测试方案_MySQL持续监控调优数据库效率

    mysql自动化性能测试和持续监控的核心在于构建闭环反馈系统,包含模拟真实负载、全面数据采集、自动化执行与分析、数据驱动的持续调优四大环节。①测试环境需与生产一致并隔离,使用docker、虚拟机或云沙盒,解决数据同步与脱敏问题;②负载生成工具如sysbench、jmeter、locust或自定义脚本…

    2026年9月21日 • 用户投稿
    200
  • CyberLinkMediaSuite如何制作AI视频?多功能工具快速剪辑的方法

    CyberLinkMediaSuite如何制作AI视频?多功能工具快速剪辑的方法CyberLinkMediaSuite如何制作AI视频?多功能工具快速剪辑的方法CyberLinkMediaSuite如何制作AI视频?多功能工具快速剪辑的方法CyberLinkMediaSuite如何制作AI视频?多功能工具快速剪辑的方法

    答案:CyberLink MediaSuite(核心为PowerDirector)通过AI艺术风格转换、智能对象选取、AI天空替换、音频降噪与运动追踪等功能,显著提升视频制作效率与创意表现。结合模板应用、快捷键操作、媒体库管理及代理编辑等实战技巧,可实现快速剪辑与专业输出,适用于Vlog创作、教育视…

    2026年9月21日 • 用户投稿
    300
  • Win10与Ubuntu 18.04双系统安装。(Win10引导Linux)[通俗易懂]

    Win10与Ubuntu 18.04双系统安装。(Win10引导Linux)[通俗易懂]Win10与Ubuntu 18.04双系统安装。(Win10引导Linux)[通俗易懂]Win10与Ubuntu 18.04双系统安装。(Win10引导Linux)[通俗易懂]Win10与Ubuntu 18.04双系统安装。(Win10引导Linux)[通俗易懂]

    大家好,很高兴再次与大家见面,我是你们的老朋友全栈君。 作为一个初学者,为了满足自己的求知欲,我按照几位大神写的教程尝试了一遍安装过程,现在来和大家分享一下。 1、Win10安装(如果已经安装,请跳过) 1)制作系统U盘(参考微信公众号“软件安装管家”): https://www.php.cn/li…

    2026年9月21日 • 用户投稿
    400
  • 百家号视频怎么隐藏?百家号怎么设置仅自己可见

    随着短视频平台的快速发展,其已成为人们获取资讯和休闲娱乐的重要方式。作为国内知名的自媒体平台之一,百家号吸引了大量用户。然而,在享受便捷的同时,隐私安全问题也日益突出。本文将介绍百家号视频隐藏的方法,帮助用户更好地保护个人内容,维护隐私安全。 一、百家号视频隐藏方法 设置隐私权限 在百家号后台,用户…

    2026年9月21日
    200
  • MySQL数据库如何设计适合大数据量的表结构_案例分析?

    MySQL数据库如何设计适合大数据量的表结构_案例分析?MySQL数据库如何设计适合大数据量的表结构_案例分析?MySQL数据库如何设计适合大数据量的表结构_案例分析?MySQL数据库如何设计适合大数据量的表结构_案例分析?

    设计适合大数据量的mysql表结构,核心在于数据类型选对、索引用好、适当拆分。1. 合理选择字段类型,如根据数据范围选用tinyint/smallint代替bigint,固定值字段用enum类型,大文本字段单独拆表;2. 精准建立索引,高频查询字段建联合索引并遵循最左前缀原则,避免低区分度字段建索引…

    2026年9月21日 • 用户投稿
    100
  • windows10如何查看S.M.A.R.T.硬盘状态_windows10硬盘S.M.A.R.T.状态查看方法

    电脑运行慢、蓝屏或文件损坏可能是硬盘故障前兆,可通过S.M.A.R.T.技术检测健康状况。1、使用WMIC命令行工具输入“wmic diskdrive get model,status”查看状态,显示Pred Fail需立即备份数据;2、CrystalDiskInfo可深度分析S.M.A.R.T.参…

    2026年9月21日
    200
  • Photopea的AI功能怎么裁剪图片?快速实现高效图片裁剪技巧

    Photopea的AI功能怎么裁剪图片?快速实现高效图片裁剪技巧Photopea的AI功能怎么裁剪图片?快速实现高效图片裁剪技巧Photopea的AI功能怎么裁剪图片?快速实现高效图片裁剪技巧Photopea的AI功能怎么裁剪图片?快速实现高效图片裁剪技巧

    Photopea的AI功能通过智能选择工具与内容感知技术结合,实现高效图片裁剪。首先使用对象选择、快速选择或魔棒工具智能识别主体或背景,再通过“选择并遮住”精细调整边缘,尤其适用于复杂轮廓如发丝。随后可应用图层蒙版透明化背景,并用裁剪工具调整画布范围。结合内容感知填充可移除干扰元素并自动补全画面,内…

    2026年9月21日 • 用户投稿
    300
  • PHP框架中间件有什么用处_PHP框架中间件设计与实现

    PHP框架中间件是处理请求和响应的过滤器,用于实现身份验证、日志记录、CORS等通用逻辑,核心价值在于解耦和提升可维护性。通过定义中间件接口、具体中间件类及管道调度器可实现自定义中间件,如身份验证或CORS处理。在Laravel中可通过Kernel.php配置全局、分组或路由级中间件,执行顺序按注册…

    2026年9月21日
    100
  • Java中字符到数字转换:解决for循环提前返回的常见陷阱

    本文探讨java中`for`循环在字符到数字转换时,因`return`语句放置不当导致程序提前终止、无法完整处理字符串的问题。我们将分析这种常见陷阱,并提供修正方案,演示如何正确利用循环填充数组,并在循环结束后统一返回最终结果,确保每个字符都能被准确映射和组合。 引言:字符到数字的映射需求 在编程实…

    2026年9月21日
    100
  • 梦幻号虚拟主播电商运营宝典(附新手教程+配套工具清单)

    虚拟主播电商的核心在于“内容驱动销售,人设凝聚用户”,要让“梦幻号”真正动起来并实现带货,必须先赋予其鲜明的人设,包括清晰的定位标签(如美食家、科技宅)、独特的人格魅力(性格、口头禅、小缺点)和与产品的强关联性,使其具备辨识度和故事感,从而建立用户信任;接着通过obs studio、vtube st…

    2026年9月21日
    100
  • deepseek下载速度优化_从deepseek下载速度优化官网获取

    deepseek下载速度优化入口在官网https://www.deepseek.com,进入后可通过设置调整响应模式、使用智能路由和数据压缩技术提升速度。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ deepseek下载速度优化入口地址在…

    2026年9月21日
    100
  • Java多线程API调用中Future.get()返回null的解决方案

    本文旨在解决%ignore_a_1%api调用中`future.get()`方法返回`null`的常见问题。当使用`callable`和`executorservice`并发执行api请求并尝试获取结果时,如果流读取逻辑不当,可能导致获取到的数据为空。文章将详细解释问题根源,并提供使用`string…

    2026年9月21日
    100
  • mysql如何排查排序异常

    排查MySQL排序异常需先确认ORDER BY是否生效,检查子查询、UNION及应用层逻辑是否覆盖排序;通过EXPLAIN分析是否使用索引排序,避免Using filesort;确保字段类型、字符集和排序规则(collation)符合预期,处理NULL值和大小写敏感性;关注sort_buffer_s…

    2026年9月21日
    000
  • 即梦AI运镜控制怎么控制_即梦AI视频镜头移动技巧详解

    掌握即梦AI运镜需四步:一、用“镜头缓慢推进”等预设提示词生成标准运动;二、通过动效画板框选主体并绘制运动路径;三、设置首尾帧引导转场,实现穿越或循环效果;四、结合“希区柯克式变焦”“时间冻结环绕”等高级技巧增强视觉表现。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 Dee…

    2026年9月21日
    000
  • 三星电视携手京东开启艺术视听盛典以科技美学重塑家居生活新模式

    三星电视携手京东开启艺术视听盛典以科技美学重塑家居生活新模式三星电视携手京东开启艺术视听盛典以科技美学重塑家居生活新模式三星电视携手京东开启艺术视听盛典以科技美学重塑家居生活新模式三星电视携手京东开启艺术视听盛典以科技美学重塑家居生活新模式

    随着消费理念升级与需求日益多样化,电视已不再仅仅是观看节目和影音娱乐的工具,而是逐渐演变为承载家居美学、传递情感温度、连接智慧生活的艺术载体。在这一变革浪潮中,三星率先引领艺术电视领域的创新风向,theframe画壁艺术电视与theserif画境艺术电视成功打破科技与艺术之间的界限,将电视升华为可观…

    2026年9月21日 • 用户投稿
    100

发表回复

登录后才能评论
关注微信