Pandas DataFrame:高效获取行级最小值及其对应关联列值

Pandas DataFrame:高效获取行级最小值及其对应关联列值

本教程详细介绍了如何在 Pandas DataFrame 中高效地查找每一行的最小值,并进一步提取与该最小值对应的非数值型关联列值(例如,项目名称)。文章通过一个具体的示例,展示了如何利用 idxmin、str.replace 和 get_indexer_for 等 Pandas 功能,以简洁且性能优越的方式实现这一常见的数据处理需求,避免了复杂的迭代或 apply 操作。

引言

在数据分析中,我们经常需要从 dataframe 的多列中找出每行的最小值。然而,除了最小值本身,有时我们还需要知道是哪一列或哪个“项目”对应了这个最小值。例如,在一个包含多个产品值及其对应产品名称的 dataframe 中,我们可能需要找出每行中最低的价格以及对应的产品名称。本教程将展示如何利用 pandas 的强大功能,以一种高效且优雅的方式解决这个问题。

示例数据准备

首先,我们创建一个示例 Pandas DataFrame,其中包含数值列(如 Value1, Value2, Value3)和与之关联的非数值型列(如 Item1, Item2, Item3)。

import pandas as pddf = pd.DataFrame({   'Item1': ['A', 'B', 'C', 'D'],   'Value1': [1,4,5,7],   'Item2': ['F', 'G', 'H', 'I'],   'Value2': [0,4,8,12],   'Item3': ['K', 'L', 'M', 'N'],   'Value3': [2.7,3.4,6.2,8.1],})print("原始 DataFrame:")print(df)

输出的原始 DataFrame 如下:

原始 DataFrame:  Item1  Value1 Item2  Value2 Item3  Value30     A       1     F       0     K     2.71     B       4     G       4     L     3.42     C       5     H       8     M     6.23     D       7     I      12     N     8.1

我们的目标是添加两列:Min_Value (每行的最小值) 和 Min_Item (对应最小值的项目名称)。

步骤一:查找每行的最小值及其所在列名

首先,我们需要确定哪些列参与最小值的比较。在这个例子中,是 Value1, Value2, Value3。

# 定义参与比较的数值列value_cols = ['Value1', 'Value2', 'Value3']# 使用 idxmin(axis=1) 找出每行最小值所在的列名# 结果是一个 Series,其索引是 DataFrame 的行索引,值是最小值所在列的名称(如 'Value1', 'Value2')min_value_col_names = df[value_cols].idxmin(axis=1)# 获取行索引序列,用于后续的基于 NumPy 数组的索引row_indices = range(len(df))# 利用 df.values 和 get_indexer_for 提取最小值# df.values 将 DataFrame 转换为 NumPy 数组,可以进行高效的整数位置索引# df.columns.get_indexer_for(min_value_col_names) 将列名 Series 转换为对应的整数列索引 Seriesdf['Min_Value'] = df.values[row_indices, df.columns.get_indexer_for(min_value_col_names)]print("n添加 Min_Value 后的 DataFrame:")print(df)

此时 DataFrame 会新增 Min_Value 列:

添加 Min_Value 后的 DataFrame:  Item1  Value1 Item2  Value2 Item3  Value3  Min_Value0     A       1     F       0     K     2.7        0.01     B       4     G       4     L     3.4        3.42     C       5     H       8     M     6.2        5.03     D       7     I      12     N     8.1        7.0

步骤二:提取对应最小值的关联列值(项目名称)

关键在于如何将 min_value_col_names (例如 ‘Value1’) 转换为其对应的项目列名 (例如 ‘Item1’)。这里我们可以利用字符串替换功能。

# 将最小值所在列的名称(如 'Value1')转换为对应的项目列名(如 'Item1')# 假设项目列名和值列名之间存在 'Value' 到 'Item' 的简单映射关系min_item_col_names = min_value_col_names.str.replace('Value', 'Item')# 再次利用 df.values 和 get_indexer_for 提取对应的项目名称df['Min_Item'] = df.values[row_indices, df.columns.get_indexer_for(min_item_col_names)]print("n最终结果 DataFrame:")print(df)

最终输出的 DataFrame 将包含 Min_Value 和 Min_Item 两列,符合我们的预期:

最终结果 DataFrame:  Item1  Value1 Item2  Value2 Item3  Value3  Min_Value Min_Item0     A       1     F       0     K     2.7        0.0        F1     B       4     G       4     L     3.4        3.4        L2     C       5     H       8     M     6.2        5.0        C3     D       7     I      12     N     8.1        7.0        D

完整代码示例

为了方便理解和使用,下面是实现上述功能的完整代码块:

import pandas as pd# 示例 DataFramedf = pd.DataFrame({   'Item1': ['A', 'B', 'C', 'D'],   'Value1': [1,4,5,7],   'Item2': ['F', 'G', 'H', 'I'],   'Value2': [0,4,8,12],   'Item3': ['K', 'L', 'M', 'N'],   'Value3': [2.7,3.4,6.2,8.1],})# 1. 定义参与比较的数值列value_cols = ['Value1', 'Value2', 'Value3']# 2. 获取每行最小值所在列的名称# axis=1 表示按行操作min_value_col_names = df[value_cols].idxmin(axis=1)# 3. 获取行索引序列,用于基于 NumPy 数组的索引row_indices = range(len(df))# 4. 提取每行的最小值# df.values 将 DataFrame 转换为 NumPy 数组,支持高效的整数位置索引# df.columns.get_indexer_for() 将列名 Series 转换为对应的整数列索引 Seriesdf['Min_Value'] = df.values[row_indices, df.columns.get_indexer_for(min_value_col_names)]# 5. 将最小值所在列的名称转换为对应的项目列名# 假设项目列名和值列名之间存在 'Value' 到 'Item' 的简单映射关系min_item_col_names = min_value_col_names.str.replace('Value', 'Item')# 6. 提取对应的项目名称df['Min_Item'] = df.values[row_indices, df.columns.get_indexer_for(min_item_col_names)]print("最终处理结果 DataFrame:")print(df)

关键概念解析

df[cols].idxmin(axis=1): 这个方法用于找出指定列 cols 中每行最小值的列名。axis=1 指示按行操作。它返回一个 Series,其索引是原始 DataFrame 的行索引,值是最小值所在列的名称。df.values: 将 Pandas DataFrame 转换为底层的 NumPy 数组。NumPy 数组支持非常高效的整数位置索引,这对于大规模数据处理至关重要。df.columns.get_indexer_for(labels): 这个方法接收一个标签(列名或索引名)列表或 Series,并返回这些标签在 DataFrame 列索引中的整数位置。例如,df.columns.get_indexer_for([‘Value1’, ‘Item2’]) 可能会返回 [1, 2](如果 ‘Value1′ 是第1列,’Item2’ 是第2列)。这使得我们可以使用整数位置来高效地从 df.values 中提取数据。Series.str.replace(‘old’, ‘new’): 这是 Pandas Series 字符串方法的强大功能之一,允许我们对 Series 中的每个字符串元素执行字符串替换操作。在此例中,它将 ‘ValueX’ 转换为 ‘ItemX’,实现了列名映射。

注意事项与总结

命名约定: 本教程的方法高度依赖于数值列 (ValueX) 和关联列 (ItemX) 之间的命名约定。如果你的列名没有这种规律性(例如,PriceA, ProductA_Name),你需要采用更复杂的映射逻辑(如使用字典进行 map 操作)。性能: 这种方法通过利用 Pandas 和 NumPy 的底层优化,避免了显式的 Python 循环或 df.apply() 函数(尤其是在处理大型 DataFrame 时,apply 可能会较慢),因此在性能上非常高效。灵活性: 这种模式可以推广到其他类似的需求,例如查找最大值及其关联列,或者根据特定条件查找值及其关联信息。

通过上述步骤,我们不仅找到了每行的最小值,还成功地提取了与之对应的关联信息,这在实际数据分析工作中是非常有用的技巧。掌握这种高效的 Pandas 索引和字符串处理方法,将大大提升你的数据处理能力。

以上就是Pandas DataFrame:高效获取行级最小值及其对应关联列值的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1376707.html

赞 (0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
PyTorch DataLoader 目标形状异常解析与正确处理方法
上一篇 2025年12月14日 16:08:10
解决Python mysqlclient 安装中的 mysql.h 缺失问题
下一篇 2025年12月14日 16:08:21

相关推荐

  • 怎么用豆包AI帮我写Redis操作代码 Redis操作代码的AI编写技巧

    怎么用豆包AI帮我写Redis操作代码 Redis操作代码的AI编写技巧怎么用豆包AI帮我写Redis操作代码 Redis操作代码的AI编写技巧怎么用豆包AI帮我写Redis操作代码 Redis操作代码的AI编写技巧怎么用豆包AI帮我写Redis操作代码 Redis操作代码的AI编写技巧

    明确提问和引导是用豆包ai写好redis操作代码的关键。1. 先说明使用的编程语言和redis客户端库,如python的redis-py、node.js的ioredis或go的go-redis;2. 指定具体操作类型,如字符串、哈希、列表等,并说明是读还是写操作;3. 结合业务场景提问,例如缓存、限…

    2026年9月28日 • 用户投稿
    500
  • 飞书账号登录异常如何解决

    飞书账号登录异常如何解决飞书账号登录异常如何解决飞书账号登录异常如何解决飞书账号登录异常如何解决

    飞书登录异常多因密码错误、网络问题或安全策略触发。2. 应检查网络稳定性并更新至最新客户端版本。3. 确认账号信息准确,通过“忘记密码”重置或使用验证码登录。4. 账号可能因频繁失败被锁定,需等待或解封,企业限制则联系IT。5. 尝试短信验证、扫码或第三方方式登录,并换设备或网页端测试。6. 仍无法…

    2026年9月28日 • 用户投稿
    600
  • 360极速浏览器如何完全清除浏览数据_彻底清理缓存历史记录等上网痕迹

    360极速浏览器如何完全清除浏览数据_彻底清理缓存历史记录等上网痕迹360极速浏览器如何完全清除浏览数据_彻底清理缓存历史记录等上网痕迹360极速浏览器如何完全清除浏览数据_彻底清理缓存历史记录等上网痕迹360极速浏览器如何完全清除浏览数据_彻底清理缓存历史记录等上网痕迹

    首先通过设置菜单清除浏览数据,进入“更多工具”选择“清除上网痕迹”,勾选历史记录、缓存、Cookie等项后立即清除;其次手动删除用户数据文件夹,关闭浏览器后在%localappdata%360ChromeChromeUser Data路径下重命名或删除Default文件夹;再使用CCleaner等系…

    2026年9月28日 • 用户投稿
    000
  • Ollama 上线 “Web search” API,为 LLM 集成实时网络搜索能力

    Ollama 上线 “Web search” API,为 LLM 集成实时网络搜索能力Ollama 上线 “Web search” API,为 LLM 集成实时网络搜索能力Ollama 上线 “Web search” API,为 LLM 集成实时网络搜索能力Ollama 上线 “Web search” API,为 LLM 集成实时网络搜索能力

    ollama 正式发布“web search”api,使大语言模型具备实时获取互联网信息的能力,显著提升回答准确率并有效降低幻觉现象。 该功能以 REST API 形式开放,并已深度集成至 Ollama 的 Python 和 JavaScript SDK 中,便于开发者在各类应用中快速接入与调用。同…

    2026年9月28日 • 用户投稿
    100
  • 拼多多拼团无法参加怎么办

    拼多多拼团无法参加怎么办拼多多拼团无法参加怎么办拼多多拼团无法参加怎么办拼多多拼团无法参加怎么办

    先检查账号和商品状态,确认账号未受限、支付方式已绑定且商品可参团;再尝试加入其他正在进行的团或让朋友分享链接;排除网络问题并更新APP版本;最后联系客服解决系统故障导致的拼团失败。 遇到拼多多拼团无法参加的情况,别急着放弃。大部分问题都能通过几个简单步骤解决,从检查基础设置到联系客服都有对应办法。 …

    2026年9月28日 • 用户投稿
    100
  • 苹果用户DeepSeek轻松上手操作指南

    苹果用户DeepSeek轻松上手操作指南苹果用户DeepSeek轻松上手操作指南苹果用户DeepSeek轻松上手操作指南苹果用户DeepSeek轻松上手操作指南

    苹果用户可在官网下载deepseek并手动信任安装;登录推荐用微信或邮箱;功能使用需根据需求切换模式和设置。具体步骤为:1. 访问官网下载对应ios/mac版本,前往设备管理中信任开发者证书;2. 登录时选择微信扫码或邮箱注册,团队用户可选企业账号;3. 使用前调整设置,如切换模型模式、开启历史记录…

    2026年9月28日 • 用户投稿
    200
  • 飞书桌面端闪退问题 飞书程序错误修复办法

    飞书桌面端闪退问题 飞书程序错误修复办法飞书桌面端闪退问题 飞书程序错误修复办法飞书桌面端闪退问题 飞书程序错误修复办法飞书桌面端闪退问题 飞书程序错误修复办法

    飞书桌面端闪退多由兼容性、缓存或系统冲突引起,可依次尝试:设置兼容模式运行、更新或重装最新版飞书、回退系统更新;清除AppData路径下的缓存文件;以管理员身份运行sfc和DISM命令修复系统文件;关闭安全软件测试并添加飞书白名单;检查隐私权限设置。按顺序排查基本可解决。 飞书桌面端闪退确实挺烦人,…

    2026年9月27日 • 用户投稿
    100
  • 夸克会员有什么用_夸克会员权益与功能详解

    夸克会员有什么用_夸克会员权益与功能详解夸克会员有什么用_夸克会员权益与功能详解夸克会员有什么用_夸克会员权益与功能详解夸克会员有什么用_夸克会员权益与功能详解

    夸克SVIP会员提供6TB云存储、下载速率高达50MB/s、多格式在线预览、智能剪贴板捕获、自动备份手机相册与聊天记录、回收站保留60天及批量文件管理功能,全面提升使用体验。 如果您在使用夸克时发现部分文件下载缓慢、存储空间不足或无法访问某些高级功能,这可能是因为您尚未开通会员服务。以下是关于夸克会…

    2026年9月27日 • 用户投稿
    100
  • 在抖音的小程序中,如何取消订单?简单操作指南

    在抖音的小程序中,如何取消订单?简单操作指南在抖音的小程序中,如何取消订单?简单操作指南在抖音的小程序中,如何取消订单?简单操作指南在抖音的小程序中,如何取消订单?简单操作指南

    抖音小程序为用户带来了流畅的购物体验,但有时因各种原因您可能需要取消已下单的商品。本文将为您详细介绍如何快速、顺利地完成订单取消流程。 登录抖音小程序 请先打开抖音APP,进入对应的小程序页面,并确保已使用您的账号成功登录,以便查看个人订单信息。 查找目标订单 进入“我的订单”页面: 在小程序首页,…

    2026年9月27日 • 用户投稿
    000
  • sublime怎么记住上一次打开的文件_Sublime记忆上次会话与文件设置

    sublime怎么记住上一次打开的文件_Sublime记忆上次会话与文件设置sublime怎么记住上一次打开的文件_Sublime记忆上次会话与文件设置sublime怎么记住上一次打开的文件_Sublime记忆上次会话与文件设置sublime怎么记住上一次打开的文件_Sublime记忆上次会话与文件设置

    Sublime Text 能自动恢复上次打开的文件和布局,需确保设置正确。首先在 Preferences → Settings 用户配置中添加 “remember_open_files”: true 和 “hot_exit”: false,前者保证恢复…

    2026年9月27日 • 用户投稿
    000
  • Safari浏览器下载的文件在哪里找_Safari浏览器下载文件存储位置查找路径

    Safari浏览器下载的文件在哪里找_Safari浏览器下载文件存储位置查找路径Safari浏览器下载的文件在哪里找_Safari浏览器下载文件存储位置查找路径Safari浏览器下载的文件在哪里找_Safari浏览器下载文件存储位置查找路径Safari浏览器下载的文件在哪里找_Safari浏览器下载文件存储位置查找路径

    首先通过“文件”App的iCloud云盘中“下载”文件夹查找Safari下载内容,其次可在Safari浏览器内点击页面设置按钮查看下载记录,最后进入设置App修改Safari默认下载位置以实现灵活管理。 如果您在使用Safari浏览器下载文件后无法找到其存储位置,可能是由于系统默认将文件保存至特定目…

    2026年9月27日 • 用户投稿
    100
  • 规划指南vs随性秘籍:右滑直达华为负一屏搞定你的国庆假期!

    规划指南vs随性秘籍:右滑直达华为负一屏搞定你的国庆假期!规划指南vs随性秘籍:右滑直达华为负一屏搞定你的国庆假期!规划指南vs随性秘籍:右滑直达华为负一屏搞定你的国庆假期!规划指南vs随性秘籍:右滑直达华为负一屏搞定你的国庆假期!

    国庆长假即将到来,最近南方的小伙伴们肯定还无心假期,都在忐忑等待全球最强台风“桦加沙”的到来。目前广东多地都因台风过境而宣布实时“五停”,大家台风天气记得做好防护,不出门不上路,保障人身安全。为了便于让广大居民在家了解台风情况,华为手机负一屏已上线台风动态卡片功能,用户桌面右滑可以快速查看台风等级、…

    2026年9月27日 • 用户投稿
    100
  • 如何免费查询抖音店铺名字大全?推荐技巧

    如何免费查询抖音店铺名字大全?推荐技巧如何免费查询抖音店铺名字大全?推荐技巧如何免费查询抖音店铺名字大全?推荐技巧如何免费查询抖音店铺名字大全?推荐技巧

    想要免费获取抖音店铺名字灵感并掌握高效查询技巧,不妨参考以下实用方法: 1. 善用抖音内置搜索 抖音平台本身就是一个巨大的命名灵感库。只需几步即可挖掘热门名称: 打开抖音App,点击顶部搜索栏。输入行业关键词,如“女装店”、“奶茶店”、“手作饰品”等。浏览搜索结果中的账号昵称与店铺名,筛选出风格契合…

    2026年9月27日 • 用户投稿
    100
  • edge提示“由你的组织管理”怎么解除_edge解除“由你的组织管理”提示的方法

    edge提示“由你的组织管理”怎么解除_edge解除“由你的组织管理”提示的方法edge提示“由你的组织管理”怎么解除_edge解除“由你的组织管理”提示的方法edge提示“由你的组织管理”怎么解除_edge解除“由你的组织管理”提示的方法edge提示“由你的组织管理”怎么解除_edge解除“由你的组织管理”提示的方法

    首先删除注册表中HKEY_LOCAL_MACHINE和HKEY_CURRENT_USER下的Edge策略项,再通过gpedit.msc禁用组策略设置,接着重置Edge浏览器,排查卸载第三方管理软件,最后手动清除Local State文件中的管理配置。 如果您在使用 Microsoft Edge 浏览…

    2026年9月27日 • 用户投稿
    100
  • linux脚本怎么写

    linux脚本怎么写linux脚本怎么写linux脚本怎么写linux脚本怎么写

    编写 Linux 脚本涉及以下步骤:选择脚本语言(例如 Bash、Python)创建脚本文件并添加 Shebang 行(例如,#!/bin/bash)编写脚本内容,包括变量、命令、循环和条件语句赋予执行权限(chmod +x script.sh)运行脚本(./script.sh)脚本结构通常包括:S…

    2026年9月27日 • 用户投稿
    100
  • 星巴克点单抖音怎么弄的?快速了解方法与实用技巧

    星巴克点单抖音怎么弄的?快速了解方法与实用技巧星巴克点单抖音怎么弄的?快速了解方法与实用技巧星巴克点单抖音怎么弄的?快速了解方法与实用技巧星巴克点单抖音怎么弄的?快速了解方法与实用技巧

    引言: 在移动互联网高速发展的今天,抖音已成为大众记录生活、分享日常的重要社交平台。不少用户开始关注:是否可以直接在抖音上点星巴克咖啡?答案是肯定的!本文将为您详细介绍如何通过抖音轻松完成星巴克点单,并提供实用操作技巧与相关知识,助您畅享便捷又有趣的消费体验。 一、星巴克为何选择抖音点单?背后趋势解…

    2026年9月27日 • 用户投稿
    000
  • 库迪咖啡的抖音优惠券:小程序核销操作步骤

    库迪咖啡的抖音优惠券:小程序核销操作步骤库迪咖啡的抖音优惠券:小程序核销操作步骤库迪咖啡的抖音优惠券:小程序核销操作步骤库迪咖啡的抖音优惠券:小程序核销操作步骤

    如今,抖音已成为社交平台中的热门应用,而库迪咖啡作为深受大众喜爱的连锁咖啡品牌,近期在抖音上线了多项吸引人的优惠券活动,引发众多咖啡爱好者争相参与。如果你也想获取并使用这些超值福利,却还不清楚具体如何操作,接下来将为你详细解析通过抖音小程序领取及核销优惠券的完整流程。 1. 启动抖音App 请确认你…

    2026年9月27日 • 用户投稿
    100
  • Sublime运行Python代码中文乱码_修改默认编码格式解决方案

    Sublime运行Python代码中文乱码_修改默认编码格式解决方案Sublime运行Python代码中文乱码_修改默认编码格式解决方案Sublime运行Python代码中文乱码_修改默认编码格式解决方案Sublime运行Python代码中文乱码_修改默认编码格式解决方案

    答案是修改文件编码声明、配置Sublime构建系统、更改系统区域设置或输出到文件。首先在Python文件首行添加# — coding: utf-8 –,然后在Sublime中创建自定义构建系统并设置环境变量PYTHONIOENCODING为utf-8,接着可调整Windows…

    2026年9月27日 • 用户投稿
    100
  • sublime怎么关联文件类型_Sublime Text设置特定文件扩展名的默认语法

    sublime怎么关联文件类型_Sublime Text设置特定文件扩展名的默认语法sublime怎么关联文件类型_Sublime Text设置特定文件扩展名的默认语法sublime怎么关联文件类型_Sublime Text设置特定文件扩展名的默认语法sublime怎么关联文件类型_Sublime Text设置特定文件扩展名的默认语法

    在Sublime Text中设置特定文件扩展名的默认语法:打开文件后点击右下角语法名称,选择所需模式并设为该扩展名默认;2. 可通过编辑Packages/User/Preferences.sublime-settings文件添加extensions映射,指定.log用Plain Text、.myco…

    2026年9月27日 • 用户投稿
    200
  • 豆包AI如何实现自动化部署?CI/CD流程优化方案

    豆包AI如何实现自动化部署?CI/CD流程优化方案豆包AI如何实现自动化部署?CI/CD流程优化方案豆包AI如何实现自动化部署?CI/CD流程优化方案豆包AI如何实现自动化部署?CI/CD流程优化方案

    豆包ai的自动化部署通过标准化流程和工具链整合实现,其核心是利用ci/cd机制打通开发、测试、构建、发布等环节。1. ci/cd是指持续集成与持续交付/部署,确保代码提交后自动构建、测试并部署到相应环境,提升效率并减少人为错误。2. 关键步骤包括:代码提交触发ci、自动构建镜像、运行测试、部署至目标…

    2026年9月27日 • 用户投稿
    200

发表回复

登录后才能评论
关注微信