使用 Pandas 查找每个 Code 对应的 Rank 最小的 Smth

使用 pandas 查找每个 code 对应的 rank 最小的 smth

本文介绍了如何使用 Pandas 处理两个 DataFrame,根据 df1 的 ‘code’ 列,在 df1 的 ‘smth’ 列中查找 df2 中 ‘rank’ 最小的 ‘smth’ 值,并将结果输出到一个新的 DataFrame 中。文章提供了详细的代码示例,并解释了关键步骤,帮助读者理解和应用 Pandas 进行数据处理和分析。

在数据分析任务中,经常会遇到需要根据多个 DataFrame 的信息进行筛选和聚合的情况。本文将介绍如何使用 Pandas 解决一个具体的问题:给定两个 DataFrame,df1 和 df2,目标是对于 df1 中每个 ‘code’,找到在 df1 的 ‘smth’ 列中,对应于 df2 中 ‘rank’ 最小的 ‘smth’ 值,并将包含该 ‘smth’ 值的 df1 行提取出来。

数据准备

首先,我们需要创建示例 DataFrame。以下代码创建了 df1 和 df2,模拟了实际数据场景。

import pandas as pddata1 = {'smth': ['RB', 'Supp', 'DX RT', 'Fk', 'CZFO', 'Supp_t', 'RK', 'rec', 'commerc', 'Supp_t'],          'code': ['HC-1343958', 'HC-1343958', 'HC-1340305', 'HC-1340305', 'HC-1107001', 'HC-1107001', 'HC-1107001', 'HC-1135154', 'HC-1135154', 'HC-1135154'],          'product_name': ['ERXY3-400', 'ERXY3-400', 'BWH/S 100 Level PRO', 'BWH/S 100 Level PRO', 'GWH 12 Fonte', 'GWH 12 Fonte', 'GWH 12 Fonte', 'BEC/ETER-1500', 'BEC/ETER-1503', 'BEC/ETER-1505'],          'digit': [3, 2, 20, 1, 1, 17, 78, 246, 10, 23],          'changes': [1, 1, 1, 1, 1, 1, 1, 1, 1, 1]}data2 = {'smth': ['rec', 'Supp', 'Supp_t', 'RK', 'CZFO', 'RB'], 'rank': [2, 4, 6, 8, 9, 10]}df1 = pd.DataFrame(data1)df2 = pd.DataFrame(data2)print("df1:")print(df1)print("\ndf2:")print(df2)

解决方案

为了解决这个问题,可以采用以下步骤:

AppMall应用商店 AppMall应用商店

AI应用商店,提供即时交付、按需付费的人工智能应用服务

AppMall应用商店 56 查看详情 AppMall应用商店 创建映射关系: 将 df2 转换为一个字典,其中 ‘smth’ 作为键,’rank’ 作为值。映射 ‘rank’ 值: 使用 df1[‘smth’].map(m) 将 df1 的 ‘smth’ 列映射为对应的 ‘rank’ 值。分组并找到最小值: 使用 groupby(df1[‘code’]).idxmin() 根据 ‘code’ 列进行分组,并找到每个组中 ‘rank’ 值最小的索引。布尔索引: 使用 df1.index.isin(idxmin) 创建一个布尔索引,用于选择 df1 中 ‘rank’ 最小的行。

以下是完整的代码实现:

m = dict(df2.values) # 将 df2 转换为字典idxmin = df1['smth'].map(m).groupby(df1['code']).idxmin() # 映射 rank 值并分组找到最小值索引out = df1[df1.index.isin(idxmin)] # 使用布尔索引选择结果print("\nResult DataFrame:")print(out)

这段代码首先将 df2 转换为一个字典 m,方便后续查找 ‘smth’ 对应的 ‘rank’ 值。然后,使用 df1[‘smth’].map(m) 将 df1 的 ‘smth’ 列映射为对应的 ‘rank’ 值。接着,使用 groupby(df1[‘code’]).idxmin() 根据 ‘code’ 列进行分组,并找到每个组中 ‘rank’ 值最小的索引。最后,使用 df1.index.isin(idxmin) 创建一个布尔索引,用于选择 df1 中 ‘rank’ 最小的行,并将结果存储在 out DataFrame 中。

代码解释

m = dict(df2.values): 这行代码将 df2 转换为一个字典。df2.values 返回一个包含 DataFrame 值的 NumPy 数组,然后 dict() 函数将其转换为字典。例如,df2 转换为 {‘rec’: 2, ‘Supp’: 4, ‘Supp_t’: 6, ‘RK’: 8, ‘CZFO’: 9, ‘RB’: 10}。df1[‘smth’].map(m): 这行代码使用 map() 函数将 df1 的 ‘smth’ 列中的每个值映射到字典 m 中对应的值。如果 ‘smth’ 列中的值在字典 m 中不存在,则映射结果为 NaN。groupby(df1[‘code’]).idxmin(): 这行代码首先使用 groupby(df1[‘code’]) 根据 df1 的 ‘code’ 列对 df1[‘smth’].map(m) 的结果进行分组。然后,对于每个分组,idxmin() 函数返回 ‘rank’ 值最小的索引。df1[df1.index.isin(idxmin)]: 这行代码使用布尔索引来选择 df1 中 ‘rank’ 最小的行。df1.index.isin(idxmin) 返回一个布尔数组,其中 True 表示 df1 的索引在 idxmin 中,False 表示不在。然后,将此布尔数组用作 df1 的索引,以选择对应的行。

总结

本文介绍了如何使用 Pandas 解决一个实际的数据处理问题,即根据一个 DataFrame 的信息,在另一个 DataFrame 中查找满足特定条件的行。通过使用 map()、groupby() 和布尔索引等 Pandas 功能,可以高效地完成这类任务。在实际应用中,可以根据具体需求调整代码,例如处理缺失值、添加其他筛选条件等。

以上就是使用 Pandas 查找每个 Code 对应的 Rank 最小的 Smth的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/578702.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
Kubernetes Pod标准输入流管理:启动与数据注入教程
上一篇 2025年11月10日 09:40:23
linux系统中输入法的安装与切换
下一篇 2025年11月10日 09:40:27

相关推荐

  • 数据库运维开发环境的调试模式演进

    数据库运维开发环境的调试模式演进数据库运维开发环境的调试模式演进数据库运维开发环境的调试模式演进数据库运维开发环境的调试模式演进

    这是学习笔记的第2393篇文章。 昨日,同事反馈了一个问题,原本的办公机环境中的虚拟机可以将办公机的IP暴露出来,提供数据库运维的API服务。例如,办公机的IP为192.168.10.100,而使用VirtualBox的虚拟机采用主机模式,其IP可能为192.168.56.100,那么192.168…

    2026年9月21日 用户投稿
    100
  • VSCode编写Java代码方法_VSCode搭建Java开发环境实战教程

    答案:在VSCode中配置Java开发环境需安装JDK并设置环境变量,再安装VSCode及Java扩展包,即可实现Java项目的创建、编写、运行与调试。它轻量、启动快,支持多语言和丰富扩展,集成Maven/Gradle,适合日常开发。 在VSCode里编写Java代码,说白了,就是把这个轻量级的代码…

    2026年9月21日
    100
  • Linux interfaces 虚拟网络类型了解01

    Linux interfaces 虚拟网络类型了解01Linux interfaces 虚拟网络类型了解01Linux interfaces 虚拟网络类型了解01Linux interfaces 虚拟网络类型了解01

    在osi模型的定义中,数据链路层和物理层,以及传输层和网络层执行的任务在概念上相似:它们都提供了数据传输的方式,即沿着特定路径将数据从源点传输到目的地的方法。然而,数据链路层和物理层负责跨物理路径的通信服务,而传输层和网络层则提供由多个数据链路组成的逻辑路径或虚拟路径的通信服务。 Bridge操作指…

    2026年9月21日 用户投稿
    100
  • VSCode侧边栏怎么去掉_VSCode侧边栏隐藏教程

    隐藏VSCode侧边栏可通过Ctrl + B(Windows/Linux)或Cmd + B(macOS)快捷键快速切换,也可通过菜单栏“视图 > 外观 > 切换侧边栏可见性”或命令面板执行“View: Toggle Sidebar Visibility”实现。推荐使用快捷键操作,效率最高…

    2026年9月21日
    100
  • MobileCLIP2— 苹果开源的端侧多模态模型

    MobileCLIP2— 苹果开源的端侧多模态模型MobileCLIP2— 苹果开源的端侧多模态模型MobileCLIP2— 苹果开源的端侧多模态模型MobileCLIP2— 苹果开源的端侧多模态模型

    ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 可图大模型 可图大模型(Kolors)是快手大模型团队自研打造的文生图AI大模型 32 查看详情 MobileCLIP2是什么 mobileclip2是由苹果研究团队开发的新一代高效多模态模型,…

    2026年9月21日 用户投稿
    300
  • MySQL用户权限体系配置思路_Sublime中编辑多用户分权管理脚本

    MySQL用户权限体系配置思路_Sublime中编辑多用户分权管理脚本MySQL用户权限体系配置思路_Sublime中编辑多用户分权管理脚本MySQL用户权限体系配置思路_Sublime中编辑多用户分权管理脚本MySQL用户权限体系配置思路_Sublime中编辑多用户分权管理脚本

    最小权限原则是mysql用户权限配置的核心,确保每个用户仅拥有必要权限以提升安全性与可维护性。1.明确需求:根据用户角色分配如只读、增删改查或结构修改权限;2.创建用户并编写sql脚本进行权限管理,替代手动输入命令,提高效率与一致性;3.使用sublime text等编辑器提升脚本编写效率,利用语法…

    2026年9月21日 用户投稿
    100
  • 如何备份VSCode的全部设置和扩展?

    备份VSCode全部设置和扩展需保存配置文件与扩展目录;2. 配置文件位于各系统指定路径的User文件夹内,包含settings.json和keybindings.json;3. 通过code –list-extensions导出扩展列表并用xargs批量重装可恢复扩展;4. 推荐直接复…

    2026年9月21日
    100
  • Linux如何恢复被删除的用户数据

    恢复Linux被删数据需立即停用磁盘并使用photorec或extundelete等工具,结合快照或备份可提高恢复成功率。 恢复Linux中被删除的用户数据,并非易事,但并非完全不可能。可能性取决于数据被删除的方式、删除后系统是否被继续使用,以及是否采取了合适的预防措施。核心在于理解数据删除的机制,…

    2026年9月21日
    300
  • 如何通过命令行参数启动VSCode?

    掌握VSCode命令行用法可提升开发效率,需先安装code命令到PATH,之后可用code .打开目录、code 文件名打开文件、code –diff比较文件、–disable-extensions排查问题,并支持别名与Shell结合使用。 通过命令行启动 VSCode 是一…

    2026年9月21日
    200
  • 如何在Laravel中配置数据库连接?

    在laravel中配置数据库连接需要以下步骤:1. 编辑.env文件,设置db_connection、db_host、db_port、db_database、db_username、db_password。2. 确保config/database.php文件正确引用.env文件中的配置。3. 利用环…

    2026年9月21日
    100
  • 在VSCode中如何安全地切换分支而不丢失当前修改?

    先处理未提交修改再切换分支。可通过提交更改、使用Stash保存临时修改,或选择性暂存部分文件来安全切换,并在切换后恢复贮藏的更改,避免代码丢失。 在 VSCode 中切换分支时,如果当前有未提交的修改,直接切换可能会导致冲突或代码丢失。要安全切换分支,关键是先处理好当前的更改。以下是几种稳妥的方法。…

    2026年9月21日
    100
  • 如何自定义代码的格式化规则?

    自定义代码格式化规则需选择合适工具并配置文件实现统一风格。1. 根据语言选用主流工具如Prettier、Black、clang-format等;2. 在项目根目录创建对应配置文件如.prettierrc、.eslintrc.js或pyproject.toml,定义缩进、引号、行宽等规则;3. 将配置…

    2026年9月21日
    100
  • 如何利用Draw.io Integration扩展在VSCode中绘制并嵌入架构图?

    安装Draw.io Integration扩展后,可在VSCode中直接创建编辑图表。右键选择“Create Diagram with Draw.io”新建.diagram文件,双击打开内置编辑器,拖拽组件绘制流程图、架构图等。保存后自动生成Base64编码的嵌入代码,粘贴至Markdown即可预览…

    2026年9月21日
    200
  • VSCode怎么生成项目模板_VSCode使用自定义代码片段创建项目模板教程

    答案:VSCode可通过自定义代码片段高效生成文件模板,结合工作区设置与脚手架工具实现项目初始化。利用用户代码片段(User Snippets)定义常用代码结构,如React组件或HTML骨架,通过prefix触发,支持制表位快速编辑;推荐将团队共享片段设为工作区级并提交至Git,确保规范统一;配合…

    2026年9月21日
    700
  • Linux如何查看命令别名alias使用方法

    直接输入 alias 命令可列出当前会话所有别名,如需查看特定命令是否为别名可用 type 命令;别名通过简化常用命令提升效率并减少错误,临时别名在当前会话生效,永久别名需写入 ~/.bashrc 或 ~/.zshrc 文件,删除则用 unalias 命令;别名适用于简单命令替换,函数支持参数与逻辑…

    2026年9月21日
    100
  • 如何为VSCode配置一个高效的PHP开发环境?

    搭建高效PHP开发环境需配置VSCode扩展与工具链:①安装PHP Intelephense实现智能补全;②配置Xdebug实现断点调试;③集成PHP CS Fixer或Prettier实现保存时自动格式化;④利用GitLens和集成终端提升协作与操作效率,一次性配置可长期提升编码质量与开发速度。 …

    2026年9月21日
    100
  • 外媒称虚幻5是PS5 Pro的克星:多款大作的优化已“翻车”

    外媒称虚幻5是PS5 Pro的克星:多款大作的优化已“翻车”外媒称虚幻5是PS5 Pro的克星:多款大作的优化已“翻车”外媒称虚幻5是PS5 Pro的克星:多款大作的优化已“翻车”外媒称虚幻5是PS5 Pro的克星:多款大作的优化已“翻车”

    作为PS5的强化版本,PS5 Pro的目标是缩小与当代PC在硬件性能上的差距,借助PSSR技术为玩家带来更流畅的帧率、更强的视觉表现力以及更细腻的图像质量。然而,根据外媒twistedvoxel的最新报道,多款大型游戏的表现问题表明,虚幻五引擎可能正成为PS5 Pro难以攻克的技术瓶颈。 以恐怖大作…

    2026年9月21日 用户投稿
    200
  • ThinkPHP生产环境部署的注意事项

    在生产环境中部署thinkphp应用需要注意以下几点:1.确保服务器环境满足thinkphp要求,使用php 7.2+和支持的web服务器;2.配置php.ini和application/config.php文件,关闭调试模式,设置合适的日志级别和数据库连接;3.采取安全措施,保护应用目录结构,使用…

    2026年9月21日
    200
  • Valkey 9.0.0 正式 GA,Linux 基金会维护的 Redis 分支

    由 linux 基金会主导维护的 redis 分支——开源内存数据库 valkey 9.0.0 正式发布,现已进入通用可用(ga)阶段。本次版本带来了多项关键性的性能提升与功能增强,重点聚焦于更高效的集群数据迁移、精细化的哈希字段管理能力,以及对大规模分布式部署场景的深度优化。 原子化槽位迁移(At…

    2026年9月21日
    100
  • 如何调整VSCode的设置以获得最佳性能?

    合理配置VSCode可显著提升性能。1. 禁用不必要扩展,减少后台资源占用;2. 在settings.json中设置files.watcherExclude和search.exclude以降低CPU负载;3. 启用editor.renderLineHighlight和largeFileOptimiz…

    2026年9月20日
    500

发表回复

登录后才能评论
关注微信