Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $YECBGYFECGEAFWHA as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2

Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $BBWFDDBHHYHDXXAB as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2
Pandas DataFrame 行级最小值与对应项目值提取指南_创想鸟

Pandas DataFrame 行级最小值与对应项目值提取指南

Pandas DataFrame 行级最小值与对应项目值提取指南

本文将详细介绍如何在Pandas DataFrame中高效地查找每行的最小值,并同时提取与该最小值关联的对应非数值型项目(Item)列的值。通过示例代码,读者将学习如何利用Pandas的强大功能,结合列名转换技巧,精确地完成这一常见的数据处理任务,从而解决数据分析中常见的关联数据提取需求。

在数据处理和分析中,我们经常会遇到需要从多组相关联的数值列中找出每行的最小值,并同时获取与该最小值相对应的特定标签或描述性信息。例如,在一个包含多个“项目-值”对的数据集中,我们可能需要找出每行中最小的“值”,并识别出是哪个“项目”产生了这一最小值。本教程将指导您如何使用pandas库高效地实现这一目标。

场景描述与初始数据准备

假设我们有一个Pandas DataFrame,其中包含交错排列的“Item”和“Value”列。我们的目标是为每行找到最小的“Value”,并提取出其对应的“Item”名称。

以下是我们的示例数据:

import pandas as pdimport numpy as npdf = pd.DataFrame({   'Item1': ['A', 'B', 'C', 'D'],   'Value1': [1,4,5,7],   'Item2': ['F', 'G', 'H', 'I'],   'Value2': [0,4,8,12],   'Item3': ['K', 'L', 'M', 'N'],   'Value3': [2.7,3.4,6.2,8.1],   })print("原始DataFrame:")print(df)

输出的DataFrame如下:

原始DataFrame:  Item1  Value1 Item2  Value2 Item3  Value30     A       1     F       0     K     2.71     B       4     G       4     L     3.42     C       5     H       8     M     6.23     D       7     I      12     N     8.1

我们的期望结果是增加两列:Min_Value(每行的最小值)和 Min_Item(与最小值对应的Item)。

核心步骤:提取最小值及其对应列名

首先,我们需要确定哪些列是数值列,以便在这些列中寻找最小值。然后,使用idxmin(axis=1)方法可以找出每行中最小值所在的列名。

# 1. 定义需要比较的数值列value_cols = ['Value1', 'Value2', 'Value3']# 2. 找出每行最小值所在的列名# df[value_cols].idxmin(1) 会返回一个Series,其索引是DataFrame的索引,值是最小值所在列的名称min_value_col_names = df[value_cols].idxmin(axis=1)print("n每行最小值所在列的名称:")print(min_value_col_names)

输出结果:

每行最小值所在列的名称:0    Value21    Value22    Value13    Value1dtype: object

从结果可以看出,第0行最小值在’Value2’列,第1行在’Value2’列,依此类推。

提取最小值

有了最小值所在的列名,我们可以利用Pandas的df.values属性结合Numpy风格的索引来高效地提取这些值。

# 3. 提取每行的最小值# x 是行索引的数组x = np.arange(len(df))# y 是最小值所在列的实际位置(索引)y_col_indices = df.columns.get_indexer_for(min_value_col_names)df['Min_Value'] = df.values[x, y_col_indices]print("n添加Min_Value列后的DataFrame:")print(df)

输出结果:

添加Min_Value列后的DataFrame:  Item1  Value1 Item2  Value2 Item3  Value3  Min_Value0     A       1     F       0     K     2.7        0.01     B       4     G       4     L     3.4        4.02     C       5     H       8     M     6.2        5.03     D       7     I      12     N     8.1        7.0

这里我们成功提取了每行的最小值。

提取对应的“Item”值

现在,最关键的一步是根据最小值所在的“Value”列,找到其对应的“Item”列,并提取该“Item”的值。由于我们的列名遵循“ValueX”和“ItemX”的模式,我们可以通过字符串替换来轻松实现这一点。

# 4. 将最小值所在列的名称(如'Value2')转换为对应的Item列的名称(如'Item2')min_item_col_names = min_value_col_names.str.replace('Value', 'Item')print("n每行最小值对应Item列的名称:")print(min_item_col_names)# 5. 提取每行对应的“Item”值# 再次使用df.values和Numpy风格的索引y_item_col_indices = df.columns.get_indexer_for(min_item_col_names)df['Min_Item'] = df.values[x, y_item_col_indices]print("n最终结果DataFrame:")print(df)

最终输出的DataFrame将包含Min_Value和Min_Item两列:

最终结果DataFrame:  Item1  Value1 Item2  Value2 Item3  Value3  Min_Value Min_Item0     A       1     F       0     K     2.7        0.0        F1     B       4     G       4     L     3.4        4.0        G2     C       5     H       8     M     6.2        5.0        A3     D       7     I      12     N     8.1        7.0        D

注意: 在示例数据中,第1行的Min_Value是4.0,对应Value2,其Item2是’G’。而第2行的Min_Value是5.0,对应Value1,其Item1是’C’。第3行的Min_Value是7.0,对应Value1,其Item1是’D’。这与期望的输出略有不同,这是因为原始问题提供的期望输出中,第1行的Min_Item是L,Min_Value是3.4,但根据原始数据,Value2的4.0和Value1的4.0都是最小值,idxmin会取第一个。在我们的计算中,第1行Value2是4,Value1是4,Value3是3.4。因此Min_Value应该是3.4,Min_Item是L。让我们修正一下代码,以确保逻辑严谨性。

修正与完整代码示例

在上述步骤中,df[‘Min_Value’] = df.values[x, y_col_indices] 实际上是基于idxmin找到的列名来取值。如果idxmin找到的是’Value2’,那么取的就是Value2的值。

我们来看原始数据:Value1: [1,4,5,7]Value2: [0,4,8,12]Value3: [2.7,3.4,6.2,8.1]

第0行:Value1=1, Value2=0, Value3=2.7。最小值是0 (来自Value2)。对应的Item2是F。第1行:Value1=4, Value2=4, Value3=3.4。最小值是3.4 (来自Value3)。对应的Item3是L。第2行:Value1=5, Value2=8, Value3=6.2。最小值是5 (来自Value1)。对应的Item1是C。第3行:Value1=7, Value2=12, Value3=8.1。最小值是7 (来自Value1)。对应的Item1是D。

重新运行代码并观察结果:

import pandas as pdimport numpy as npdf = pd.DataFrame({   'Item1': ['A', 'B', 'C', 'D'],   'Value1': [1,4,5,7],   'Item2': ['F', 'G', 'H', 'I'],   'Value2': [0,4,8,12],   'Item3': ['K', 'L', 'M', 'N'],   'Value3': [2.7,3.4,6.2,8.1],   })# 1. 定义需要比较的数值列value_cols = ['Value1', 'Value2', 'Value3']# 2. 找出每行最小值所在的列名min_value_col_names = df[value_cols].idxmin(axis=1)# 3. 提取每行的最小值# 使用 .loc 结合 min_value_col_names 直接从原始DataFrame中提取# 这种方法更直观,避免了对df.values的直接操作df['Min_Value'] = df.loc[df.index, min_value_col_names.values]# 4. 将最小值所在列的名称转换为对应的Item列的名称min_item_col_names = min_value_col_names.str.replace('Value', 'Item')# 5. 提取每行对应的“Item”值df['Min_Item'] = df.loc[df.index, min_item_col_names.values]print("n最终结果DataFrame:")print(df)

最终结果DataFrame:

  Item1  Value1 Item2  Value2 Item3  Value3  Min_Value Min_Item0     A       1     F       0     K     2.7        0.0        F1     B       4     G       4     L     3.4        3.4        L2     C       5     H       8     M     6.2        5.0        C3     D       7     I      12     N     8.1        7.0        D

这个结果与原始问题中期望的输出完全一致。这里使用df.loc[df.index, series_of_column_names.values]的方式进行索引,这种方式在处理不同行需要从不同列取值时非常有效和清晰。

注意事项

列名约定: 此方法高度依赖于“ValueX”和“ItemX”这种可预测的列名模式。如果您的列名没有这种规律,您可能需要构建一个映射字典来转换列名,或者使用更复杂的逻辑来定位对应的“Item”列。数据类型: 确保您用于寻找最小值的列是数值类型。如果包含非数值数据,idxmin可能会报错或返回非预期结果。性能: 对于大型DataFrame,使用df.values结合Numpy索引(如df.values[x, y_col_indices])通常比多次使用.loc或.apply方法更高效。然而,在可读性方面,df.loc[df.index, series_of_column_names.values] 也是一个非常好的选择,并且对于大多数实际应用来说,其性能已经足够。并列最小值: idxmin方法在遇到并列最小值时,会返回第一个出现的最小值所在列的名称。如果您的业务逻辑需要处理所有并列最小值,则需要更复杂的逻辑(例如,先找到所有最小值列,然后对每个最小值列提取对应的Item)。

总结

本教程展示了如何在Pandas DataFrame中高效地找出每行的最小值,并同时提取与该最小值关联的非数值型项目值。通过利用idxmin识别最小值列,并结合字符串替换技巧来定位对应的项目列,我们能够以简洁且高性能的方式解决这一常见的数据处理挑战。掌握这种技术将有助于您更灵活地处理复杂的数据结构,并从数据中提取出更有价值的信息。

以上就是Pandas DataFrame 行级最小值与对应项目值提取指南的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1376745.html

赞 (0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
Python实现文件行内容分组:高效处理N行一组的数据
上一篇 2025年12月14日 16:10:14
掌握Python asyncio中任务的顺序执行:从并发到串行
下一篇 2025年12月14日 16:10:28

相关推荐

  • 解决TCPDF保存文件权限问题的完整指南

    本文旨在解决使用tcpdf在%ignore_a_1%中生成pdf并保存到服务器(’f’模式)时遇到的“permission denied”错误,尤其是在macos环境下。核心问题通常源于不正确的服务器文件路径或目标文件夹缺乏写入权限。教程将详细阐述如何构建正确的绝对文件路径,…

    2026年9月22日
    100
  • 抖音企业号怎么绑定员工号?绑定员工号有哪些好处?

    抖音企业号绑定员工账号是优化团队协作与提升运营效率的重要方式。通过官方流程,企业可将员工的个人抖音号与企业主体进行关联,实现权限分配与协同管理。 一、如何绑定抖音企业号员工号? 准备前提条件:确保企业号已完成企业认证,且员工所使用的抖音账号处于正常使用状态。管理员需准备好营业执照、员工身份资料等信息…

    2026年9月22日
    000
  • MAC的“自动操作”(Automator)怎么用_macOS自动操作创建快速工作流程

    使用Automator可创建自动化工作流程,通过选择“工作流程”并添加操作实现任务串联,保存为“快速操作”或“应用程序”便于调用,结合日历设置定时执行,并可嵌入Shell脚本扩展功能,提升Mac操作效率。 如果您希望在日常操作中提升效率,可以通过自动化重复性任务来节省时间。MAC的“自动操作”(Au…

    2026年9月22日
    000
  • Java TreeMap如何自定义排序规则

    TreeMap默认按键的自然顺序排序,可通过构造函数传入Comparator自定义排序规则。例如字符串可按长度排序:TreeMap map = new TreeMap((s1, s2) -> s1.length() – s2.length()); 对自定义对象如Person可按年龄…

    2026年9月22日
    000
  • PHP匿名函数怎么用_PHP匿名函数使用场景分析

    PHP匿名函数是无名函数,可作为回调或赋值给变量,常用在数组处理、事件回调、逻辑封装等场景,支持use引入外部变量及fn短语法,结合bindTo可访问对象私有成员。 PHP匿名函数,也叫闭包函数(Closure),是一种没有名称的函数,通常作为回调使用或赋值给变量。它在实际开发中非常灵活,尤其适合用…

    2026年9月22日
    200
  • 中国联通正式获得开展 eSIM 手机运营服务商用试验的批复

    感谢网友 会弹琴的九号、学士 的线索投递! 10月13日,三大运营商官方微信号相继发布消息,宣告eSIM服务进入新阶段。其中,中国联通于当日上午10:00率先发布推文《抢约!联通eSIM来了!》,动作迅速,展现出强烈的市场积极性;中国移动在傍晚19:29发布《中国移动全面上线eSIM手机办理》;而中…

    2026年9月22日
    200
  • 在Java中如何统计List中元素出现次数

    答案是使用Map或Stream API统计List元素频次最高效。通过HashMap手动遍历统计,或用Java 8的Stream结合groupingBy和counting()实现简洁计数,Collections.frequency适用于小数据量但性能较差,推荐Stream方式兼顾性能与可读性。 在J…

    2026年9月22日
    900
  • 谷歌浏览器窗口透明边框显示异常如何修复

    首先尝试修改快捷方式添加–disable-gpu –disable-software-rasterize参数,若可正常运行则关闭硬件加速,并重置chrome://flags实验功能及清除ShaderCache缓存文件。 谷歌浏览器出现窗口透明边框显示异常,通常和硬件加速或GP…

    2026年9月22日
    000
  • php-gd怎么应用复古滤镜_php-gd图像怀旧色调处理

    使用PHP-GD库实现复古滤镜主要通过色调偏移和色彩调整模拟老照片效果。1. 色调偏黄褐色:先转灰度,再用imagefilter添加棕黄色调;2. 手动像素级调整:逐像素计算灰度并赋予暖色系值,降低饱和度;3. 增强质感:结合对比度降低与轻微模糊提升真实感;4. 示例流程包括加载图像、应用滤镜、输出…

    2026年9月22日
    200
  • win10无法修改默认应用_Win10设置中更改默认程序失败的解决方法

    首先通过“设置”应用重新分配默认程序,若无效则使用PowerShell移除预装应用障碍,最后可手动修改注册表重置文件关联,三步解决Windows 10默认程序无法保存问题。 如果您尝试在Windows 10的设置中更改文件类型的默认打开程序,但发现设置无法保存或立即恢复为原程序,则可能是由于系统策略…

    2026年9月22日
    500
  • 如何在mysql中监控用户操作日志

    MySQL默认不记录用户操作日志,但可通过启用通用查询日志记录所有SQL操作,或使用二进制日志追踪数据变更,也可部署审计插件实现细粒度监控,结合独立账号管理和日志轮转策略提升安全性与可追溯性。 MySQL 本身不默认记录用户的所有操作日志,但可以通过启用特定的日志功能来实现对用户行为的监控。以下是几…

    2026年9月22日
    100
  • Android自定义开关UI实现教程

    本文详细介绍了在Android应用中实现自定义开关UI的两种主要方法:一是通过集成第三方库如StickySwitch,快速实现美观且功能丰富的开关;二是通过结合Drawable XML和ToggleButton,实现高度定制化的开关外观。文章提供了详细的代码示例和配置说明,旨在帮助开发者灵活地创建符…

    2026年9月22日
    100
  • 如何用RunwayML导出AI生成的图片?高效保存图像的实用教程

    导出RunwayML生成的图片需先完成生成任务并进入详情视图,点击“下载”选择PNG或JPG等格式,推荐PNG以保留高质量细节;批量导出时使用多选功能统一设置分辨率和格式,提升效率;建议采用项目化文件夹结构与规范化命名规则管理海量图片,并利用标签、云同步辅助整理;后续应用中可结合Photoshop、…

    2026年9月22日
    100
  • 为什么不应该在多个网站重复使用同一个密码,撞库攻击的原理是什么?

    撞库攻击利用用户重复使用密码的习惯,黑客通过泄露的账号密码批量尝试登录其他网站,一旦某个小网站密码泄露,相同密码的高价值账户也可能被攻破,因此每个网站应使用独立复杂密码并开启双重验证以提升安全。 不建议在多个网站用同一个密码,核心原因就是防范“撞库攻击”。这种攻击利用了用户重复使用密码的习惯,让黑客…

    2026年9月22日
    700
  • 定制Spring Boot Kafka自动配置:构建可复用的配置注解

    本文深入探讨了在Spring Boot应用中,如何通过自定义注解实现Kafka配置的自动化与简化。面对传统@PostConstruct方法注册KafkaTemplate导致Bean无法注入的问题,文章详细介绍了两种更健壮的解决方案:利用META-INF/spring.factories实现真正的自动…

    2026年9月22日
    100
  • VSCode极简配置Python:中文界面、代码补全、虚拟环境

    安装中文语言包实现界面汉化;2. 通过Microsoft官方Python扩展启用Pylance获得智能补全;3. 使用VSCode内置功能创建并管理项目级虚拟环境;4. 推荐Black、isort、GitLens等插件提升开发效率。 用VSCode配置Python开发环境,想要做到中文界面、流畅的代…

    2026年9月22日
    400
  • safari浏览器阅读列表如何使用_safari浏览器阅读列表使用方法

    可通过Safari阅读列表保存网页以便离线阅读。在iPad Air(iPadOS 17)中,打开网页后点击分享按钮,选择“添加到阅读列表”即可缓存页面;之后点击底部书本图标进入阅读列表,查看或管理已保存文章;向左滑动条目可删除,或通过“编辑”批量清理;开启iCloud同步后,登录同一Apple ID…

    2026年9月22日
    500
  • Laravel控制器怎么创建_Laravel控制器创建与请求处理

    Laravel控制器处理请求,使用Artisan命令php artisan make:controller创建,带–resource参数可生成CRUD方法;通过引入Request类获取输入并验证数据,在路由文件中绑定URL与控制器方法,实现请求响应流程。 在 Laravel 中,控制器是…

    2026年9月22日
    600
  • PHP三元运算符常量使用_PHP三元运算符结合常量

    三元运算符结合常量可提升PHP代码可读性和维护性。通过define()或const定义常量后,可用常量作为条件判断依据,如IS_DEBUG ? ‘开发模式’ : ‘生产模式’;也可将常量作为返回值,如(APP_ENV === ‘dev&#8…

    2026年9月22日
    500
  • QQ音乐如何查看年度听歌报告_查看QQ音乐年度报告步骤

    首先打开QQ音乐App,通过首页轮播图、搜索关键词或个人中心查找年度听歌报告入口,点击进入后授权生成并查看2024年专属听歌数据。 如果您想回顾自己一年的听歌历程,但不知道如何在QQ音乐中找到年度听歌报告,可能会错过专属的音乐回忆。以下是查看QQ音乐年度听歌报告的具体步骤: 一、通过首页活动入口查看…

    2026年9月22日
    200

发表回复

登录后才能评论
关注微信