Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $YECBGYFECGEAFWHA as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2

Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $BBWFDDBHHYHDXXAB as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2
使用Pandas进行二进制数组交替“1”的矢量化处理_创想鸟

使用Pandas进行二进制数组交替“1”的矢量化处理

使用Pandas进行二进制数组交替“1”的矢量化处理

本文详细介绍了如何利用Pandas库的矢量化操作,高效地处理两个二进制数组,以确保数组中的“1”元素在逻辑上实现交替出现,避免连续出现在同一数组中。通过布尔索引、shift()方法和loc更新,该方案显著提升了处理效率,取代了传统迭代方法的性能瓶颈。

问题背景与挑战

在处理二进制序列数据时,有时会遇到一种特定需求:给定两个由0和1组成的数组(例如,a和b),要求“1”的出现必须在两个数组之间交替进行。具体来说,如果一个“1”出现在数组a中,那么下一个“1”(无论出现在a或b中)必须出现在数组b中;反之亦然。如果连续两个“1”都出现在同一个数组中,那么前一个“1”应该被置为0。

例如,对于输入:a = [1, 0, 0, 1, 0, 0, 0, 0, 0, 1, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0]b = [0, 1, 0, 0, 1, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 1, 0, 0, 1]

我们期望的输出是:a = [1, 0, 0, 1, 0, 0, 0, 0, 0, 1, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0]b = [0, 1, 0, 0, 1, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 1]

其中,原始b数组中索引为16的“1”被移除,因为其后紧跟着索引为19的“1”,违反了交替规则(两个“1”连续出现在b中,中间没有a的“1”)。

传统的解决方案可能涉及将数组转换为Pandas DataFrame,然后通过迭代DataFrame的行来检查和修改。然而,这种基于循环的迭代方法在处理大型数据集时效率低下,无法充分利用现代计算资源的并行处理能力。因此,我们需要一种矢量化的方法来显著提升性能。

矢量化解决方案:基于Pandas的实现

Pandas库提供了强大的矢量化操作能力,可以高效地处理这类问题。以下是利用Pandas实现交替“1”逻辑的步骤:

步骤一:识别有效行

首先,我们需要将输入的两个数组转换为一个Pandas DataFrame。然后,筛选出那些至少包含一个“1”的行,因为只有这些行才可能参与到“1”的交替逻辑中。

import pandas as pdimport numpy as np# 示例数据a = [1, 0, 0, 1, 0, 0, 0, 0, 0, 1, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0]b = [0, 1, 0, 0, 1, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 1, 0, 0, 1]df = pd.DataFrame({"A": a, "B": b})# 筛选出至少包含一个“1”的行df_active = df[(df.A > 0) | (df.B > 0)].copy()print("--- 步骤一:识别有效行 ---")print(df_active)

输出示例 (df_active):

    A  B0   1  01   0  13   1  04   0  19   1  016  0  119  0  1

从df_active中可以看出,在这些有效行中,A列和B列的“1”是互斥的(即同一行中不会A和B同时为1)。这一观察简化了后续的交替逻辑判断。

步骤二:应用交替逻辑

根据问题描述,如果“1”连续出现在同一个数组中,则前一个“1”需要被移除。在df_active中,由于A和B的“1”是互斥的,这意味着如果B列的值在相邻的有效行中是连续的“1”(例如,B在当前行是1,在下一行也是1),那么就违反了交替规则。我们可以利用Pandas的shift()方法来实现这一检查。

df_active.B.shift(-1)会获取B列的下一个元素。通过比较当前行的B值与下一行的B值是否不同,我们可以判断是否符合交替规则。如果df_active.B != df_active.B.shift(-1)为False,则表示B列在当前行和下一行都是相同的“1”,即违反了规则。

# 应用交替逻辑:筛选出B列值与下一行B列值不同的行# (在A和B互斥的前提下,这等同于检查A和B的交替性)df_filtered = df_active[df_active.B != df_active.B.shift(-1)].copy()print("n--- 步骤二:应用交替逻辑后的有效行 ---")print(df_filtered)

输出示例 (df_filtered):

    A  B0   1  01   0  13   1  04   0  19   1  019  0  1

可以看到,索引为16的行已被移除,因为它在df_active中的B列值为1,且其下一行(索引19)的B列值也为1,违反了B列的交替性。

步骤三:更新原始DataFrame

最后一步是将筛选后的结果应用回原始的DataFrame df。所有在df_active中存在但未被df_filtered保留的行的“1”都应该被置为0。

# 获取在df_active中但不在df_filtered中的行的索引indices_to_zero = df_active.index.difference(df_filtered.index)# 在原始DataFrame中将这些行的A和B列置为0df.loc[indices_to_zero, ['A', 'B']] = 0print("n--- 最终结果 ---")print(df)

最终输出 (df):

    A  B0   1  01   0  12   0  03   1  04   0  15   0  06   0  07   0  08   0  09   1  010  0  011  0  012  0  013  0  014  0  015  0  016  0  0  # 原本是1,现在被置为017  0  018  0  019  0  1

完整示例代码

import pandas as pdimport numpy as npdef vectorize_alternating_ones(a_list, b_list):    """    矢量化处理两个二进制数组,确保“1”在数组间交替出现。    参数:    a_list (list): 第一个二进制数组。    b_list (list): 第二个二进制数组。    返回:    pandas.DataFrame: 处理后的DataFrame。    """    df = pd.DataFrame({"A": a_list, "B": b_list})    # 步骤一:识别有效行 (至少包含一个“1”的行)    df_active = df[(df.A > 0) | (df.B > 0)].copy()    # 步骤二:应用交替逻辑    # 在有效行中,如果A和B的1是互斥的,则检查B的交替性即可。    # df_active.B != df_active.B.shift(-1) 会筛选出B列与下一行B列不同的行。    # 如果当前行B是1,下一行B也是1,则此条件为False,该行将被过滤。    df_filtered = df_active[df_active.B != df_active.B.shift(-1)].copy()    # 步骤三:更新原始DataFrame    # 获取在df_active中但未被df_filtered保留的行的索引    indices_to_zero = df_active.index.difference(df_filtered.index)    # 在原始DataFrame中将这些行的A和B列置为0    df.loc[indices_to_zero, ['A', 'B']] = 0    return df# 示例数据a = [1, 0, 0, 1, 0, 0, 0, 0, 0, 1, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0]b = [0, 1, 0, 0, 1, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 1, 0, 0, 1]result_df = vectorize_alternating_ones(a, b)print(result_df)

核心概念解析

Pandas 矢量化操作: Pandas的核心优势在于其底层基于NumPy,能够对整个Series或DataFrame执行操作,而无需显式编写Python循环。这极大地提高了数据处理的速度和效率,尤其是在处理大规模数据集时。布尔索引: df[(df.A > 0) | (df.B > 0)] 是一种强大的数据筛选技术。它通过一个布尔条件(由>、|等操作符生成)来选择DataFrame的行。只有条件为True的行才会被保留。shift() 方法: Series.shift(periods=1, fill_value=None) 方法可以将Series中的数据向上或向下移动指定的periods(周期数)。shift(-1)表示将数据向上移动一位,即获取“下一个”元素。这在处理时间序列数据或需要比较相邻元素时非常有用。loc 和 isin:df.loc 是Pandas中基于标签(或布尔数组)进行选择和更新数据的首选方式。它允许我们通过行标签和列标签精确地定位数据。Series.isin(values) 方法返回一个布尔Series,指示Series中的每个元素是否包含在values中。在这里,df.index.isin(df_filtered.index) 用于找出df_active中哪些索引存在于df_filtered中。difference()方法则直接获取了两个索引集合的差集,更直接地找到了需要置零的行索引。

注意事项与扩展

数据结构假设: 本教程的解决方案是基于示例数据中一个重要观察:在df_active(即包含“1”的行)中,A列和B列的“1”是互斥的,即同一行中A和B不会同时为1。在这种情况下,只需检查其中一列(如B列)的交替性,即可推断出另一列的交替性。如果数据结构允许A和B同时为1,或者“1”的交替规则更为复杂,则可能需要调整df_active.B != df_active.B.shift(-1)这一逻辑,例如,可能需要同时检查A和B列的交替模式。性能优势: 矢量化解决方案避免了显式的Python循环,将大部分计算推送到底层的C语言实现(通过NumPy和Pandas),从而在处理大规模数据时提供了显著的性能提升。可读性和维护性: 尽管矢量化代码可能初看起来不如迭代代码直

以上就是使用Pandas进行二进制数组交替“1”的矢量化处理的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1375265.html

赞 (0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
Python 交互式压缩:实时跟踪文件压缩进度
上一篇 2025年12月14日 14:51:35
Python中第一类和第二类椭圆积分的级数展开与Scipy库的正确使用
下一篇 2025年12月14日 14:51:46

相关推荐

  • Sublime编写后端单元测试脚本实践_确保接口逻辑与数据准确可靠

    Sublime编写后端单元测试脚本实践_确保接口逻辑与数据准确可靠Sublime编写后端单元测试脚本实践_确保接口逻辑与数据准确可靠Sublime编写后端单元测试脚本实践_确保接口逻辑与数据准确可靠Sublime编写后端单元测试脚本实践_确保接口逻辑与数据准确可靠

    单元测试在sublime中编写是可行且高效的。首先,sublime轻便快速,适合习惯其环境的开发者;其次,通过安装anaconda或sublimerepl插件可提升脚本运行与调试效率;最后,配置构建系统后可一键运行测试,结合终端命令还可执行整个目录下的测试用例,使工具虽非ide但具备完整测试能力。 …

    2026年10月1日 • 用户投稿
    000
  • Claude支持自动化测试吗 Claude软件质量保障应用指南

    Claude支持自动化测试吗 Claude软件质量保障应用指南Claude支持自动化测试吗 Claude软件质量保障应用指南Claude支持自动化测试吗 Claude软件质量保障应用指南Claude支持自动化测试吗 Claude软件质量保障应用指南

    本文将围绕Claude在软件质量保障领域的应用展开叙述。虽然Claude本身不能像传统的自动化测试框架那样直接执行测试,但它能够作为强大的辅助工具,在测试流程的多个环节中发挥重要作用。下文将通过分步讲解的方式,介绍如何利用Claude生成测试用令、辅助编写脚本代码以及分析测试结果,从而有效提升软件质…

    2026年10月1日 • 用户投稿
    100
  • Sublime结合Postman调试REST接口流程_构建后端API调试闭环

    Sublime结合Postman调试REST接口流程_构建后端API调试闭环Sublime结合Postman调试REST接口流程_构建后端API调试闭环Sublime结合Postman调试REST接口流程_构建后端API调试闭环Sublime结合Postman调试REST接口流程_构建后端API调试闭环

    使用 sublime 和 postman 联合调试 rest 接口,是一种轻量高效的开发方式。1. sublime 作为轻量编辑器,通过插件支持语法高亮、快速运行脚本、集成终端和 git 版本控制,提升 api 开发效率;2. postman 可构造各类 http 请求、管理环境变量、执行自动化测试…

    2026年10月1日 • 用户投稿
    200
  • java使用教程如何使用正则表达式匹配字符串 java使用教程的正则应用基础教程​

    java使用教程如何使用正则表达式匹配字符串 java使用教程的正则应用基础教程​java使用教程如何使用正则表达式匹配字符串 java使用教程的正则应用基础教程​java使用教程如何使用正则表达式匹配字符串 java使用教程的正则应用基础教程​java使用教程如何使用正则表达式匹配字符串 java使用教程的正则应用基础教程​

    在java中使用正则表达式需先通过pattern.compile()编译正则字符串生成pattern对象,再调用其matcher()方法结合目标字符串创建matcher对象;2. matcher对象通过find()查找子串匹配、matches()判断全串匹配、group()获取匹配内容、start(…

    2026年10月1日 • 用户投稿
    600
  • Sublime任务自动化 Sublime定时执行脚本方法

    Sublime任务自动化 Sublime定时执行脚本方法Sublime任务自动化 Sublime定时执行脚本方法Sublime任务自动化 Sublime定时执行脚本方法Sublime任务自动化 Sublime定时执行脚本方法

    sublime text自身不支持定时任务,但可通过操作系统的调度工具实现脚本的定时执行。具体步骤如下:1. 利用sublime的构建系统、宏和插件实现内部自动化;2. 在windows上使用任务计划程序配置定时任务,设置触发器和启动程序;3. 在macos或linux上使用cron编写定时任务命令…

    2026年10月1日 • 用户投稿
    200
  • 使用线性搜索在两个 ArrayList 中查找元素

    使用线性搜索在两个 ArrayList 中查找元素使用线性搜索在两个 ArrayList 中查找元素使用线性搜索在两个 ArrayList 中查找元素使用线性搜索在两个 ArrayList 中查找元素

    本文介绍了如何在 Java 中使用线性搜索算法比较两个字符串类型的 ArrayList,以判断一个列表(例如购物清单)中的所有元素是否都存在于另一个列表(例如食品储藏室清单)中。我们将探讨如何通过循环遍历和条件判断来实现此功能,并提供使用 HashSet 优化搜索效率的替代方案。 线性搜索实现 线性…

    2026年10月1日 • 用户投稿
    000
  • Sublime集成第三方API聚合平台应用_从天气查询到支付接口对接实例

    Sublime集成第三方API聚合平台应用_从天气查询到支付接口对接实例Sublime集成第三方API聚合平台应用_从天气查询到支付接口对接实例Sublime集成第三方API聚合平台应用_从天气查询到支付接口对接实例Sublime集成第三方API聚合平台应用_从天气查询到支付接口对接实例

    sublime虽是文本编辑器,但可通过写调用代码实现api对接。1. 利用build system配置python环境,使用requests库发送get/post请求。2. 借助api聚合平台获取标准化接口,简化接入流程。3. 调试时注意密钥保密、签名正确、处理ssl证书与异常返回值,确保请求稳定。…

    2026年10月1日 • 用户投稿
    200
  • 有老外以为《古剑》是类魂 游戏博主反驳:根本不是

    有老外以为《古剑》是类魂 游戏博主反驳:根本不是有老外以为《古剑》是类魂 游戏博主反驳:根本不是有老外以为《古剑》是类魂 游戏博主反驳:根本不是有老外以为《古剑》是类魂 游戏博主反驳:根本不是

    近日,烛龙游戏正式公布了单机arpg新作《古剑》。作为《古剑奇谭》系列的最新正统续作,本作将采用买断制模式,登陆pc及主机平台。 在Reddit等海外游戏论坛上,部分国外玩家误认为《古剑》是一款类魂游戏,并发表评论称:“未来十年我们会看到大量使用虚幻引擎制作的中国‘类魂’仿制品。”对此,知名游戏博主…

    2026年10月1日 • 用户投稿
    100
  • Sublime代码缩略图 Sublime侧边栏预览功能配置

    Sublime代码缩略图 Sublime侧边栏预览功能配置Sublime代码缩略图 Sublime侧边栏预览功能配置Sublime代码缩略图 Sublime侧边栏预览功能配置Sublime代码缩略图 Sublime侧边栏预览功能配置

    如何让sublime text的minimap显示更多信息?1.安装sublimelinter插件;2.根据编程语言安装对应linter(如flake8、eslint);3.在preferences中配置linter规则。如何调整minimap设置?1.修改preferences中的show_min…

    2026年10月1日 • 用户投稿
    100
  • 《守望先锋2》艺术图再陷AI制作争议 暴雪坚决否认

    《守望先锋2》艺术图再陷AI制作争议 暴雪坚决否认《守望先锋2》艺术图再陷AI制作争议 暴雪坚决否认《守望先锋2》艺术图再陷AI制作争议 暴雪坚决否认《守望先锋2》艺术图再陷AI制作争议 暴雪坚决否认

    《守望先锋2》的开发商暴雪针对“游戏中新推出的喷漆内容由人工智能生成”的质疑做出回应,明确否认了这一说法。 近期,不少《守望先锋2》玩家在X平台和Reddit等社交论坛上表达疑虑,指出游戏中描绘“探奇”、“朱诺”以及新英雄“无漾”的卡通风格喷漆存在疑似AI创作的特征。有玩家以“探奇与朱诺背靠背”的喷…

    2026年10月1日 • 用户投稿
    000
  • mlop.ai: 全部开源的超高效实验追踪及数据管理平台

    mlop.ai: 全部开源的超高效实验追踪及数据管理平台mlop.ai: 全部开源的超高效实验追踪及数据管理平台mlop.ai: 全部开源的超高效实验追踪及数据管理平台mlop.ai: 全部开源的超高效实验追踪及数据管理平台

    mlop使用教程 (开源WandB平替) 在ai模型开发中,我们常面临训练过程黑箱、团队协作低效、实验难以复现等痛点。 mlop.ai 是一个主流解决方案的平替(如ClearML, Comet, WandB),并专为中国企业提供优化支持。 上车仅需五行代码代码语言:python代码运行次数:0运行复…

    2026年10月1日 • 用户投稿
    200
  • 如何通过实际游戏判断CPU多线程优化的程度?

    游戏多线程优化好则帧数随核心增加而提升,CPU利用率均衡;优化差则帧数低、波动大,核心利用率不均,易卡顿。 简单来说,通过观察游戏在不同线程数量下的帧数变化和CPU利用率,就能大致判断CPU多线程优化程度。优化好的游戏,线程越多,帧数提升越明显。 观察游戏帧数和CPU利用率变化是关键。 游戏多线程优…

    2026年10月1日
    600
  • 修改my.cnf配置文件解决MySQL存储乱码问题

    mysql存储中文出现乱码问题,主要原因是字符集未正确配置。1. 在my.cnf中将默认字符集设为utf8mb4,确保客户端和服务器端使用utf8mb4;2. 检查并修改数据库、表及字段的字符集为utf8mb4;3. 应用连接mysql时指定字符集为utf8mb4;4. 注意重启服务、工具连接方式、…

    2026年10月1日
    100
  • 在Sublime中配置Python虚拟环境|确保项目隔离更专业

    在Sublime中配置Python虚拟环境|确保项目隔离更专业在Sublime中配置Python虚拟环境|确保项目隔离更专业在Sublime中配置Python虚拟环境|确保项目隔离更专业在Sublime中配置Python虚拟环境|确保项目隔离更专业

    在sublime text中配置python虚拟环境是为了避免项目依赖混乱和版本冲突,通过venv模块创建虚拟环境后,在tools > build system中新建编译系统并指定虚拟环境路径即可完成配置。1. 使用python -m venv venv命令创建虚拟环境;2. 根据系统激活环境…

    2026年10月1日 • 用户投稿
    200
  • 服务端 JSON 响应中返回 UI 字段属性的最佳实践

    服务端 JSON 响应中返回 UI 字段属性的最佳实践服务端 JSON 响应中返回 UI 字段属性的最佳实践服务端 JSON 响应中返回 UI 字段属性的最佳实践服务端 JSON 响应中返回 UI 字段属性的最佳实践

    本文探讨了在服务端 JSON 响应中返回 UI 字段属性(如 mandatory, editable, disabled 等)的最佳实践。核心观点是,虽然从服务端返回 value 值是合理的,但其他属性的决策应基于业务逻辑的复杂度和前后端职责划分的考量。服务端控制部分业务逻辑可简化前端,但可能增加服…

    2026年10月1日 • 用户投稿
    800
  • java代码怎样用数组实现顺序栈 java代码顺序栈结构的实用实现教程​

    java代码怎样用数组实现顺序栈 java代码顺序栈结构的实用实现教程​java代码怎样用数组实现顺序栈 java代码顺序栈结构的实用实现教程​java代码怎样用数组实现顺序栈 java代码顺序栈结构的实用实现教程​java代码怎样用数组实现顺序栈 java代码顺序栈结构的实用实现教程​

    数组实现顺序栈的核心原因是其访问效率高、内存连续、实现简单,适合数据规模可预估且对性能要求高的场景;1. 数组通过索引直接访问栈顶元素,时间复杂度为o(1),具备良好的缓存局部性;2. 其固定容量的局限性可通过动态扩容、预分配、错误处理或改用链表等策略应对;3. 实际应用包括函数调用模拟、括号匹配、…

    2026年10月1日 • 用户投稿
    200
  • Sublime多语言支持 Sublime配置不同编程语言环境

    Sublime多语言支持 Sublime配置不同编程语言环境Sublime多语言支持 Sublime配置不同编程语言环境Sublime多语言支持 Sublime配置不同编程语言环境Sublime多语言支持 Sublime配置不同编程语言环境

    Sublime Text在多语言支持方面,其实它本身就是个“多面手”。它不像某些IDE那样,一上来就给你预设了一堆环境,而是通过其强大的扩展性和灵活的配置,让你根据需要去“武装”它,把它打造成一个能处理各种编程语言的个性化利器。对我来说,Sublime的魅力就在于这种高度的定制化,它像一块空白画布,…

    2026年10月1日 • 用户投稿
    100
  • 如何收集 Maven 项目中使用的所有第三方 Jar 包

    如何收集 Maven 项目中使用的所有第三方 Jar 包如何收集 Maven 项目中使用的所有第三方 Jar 包如何收集 Maven 项目中使用的所有第三方 Jar 包如何收集 Maven 项目中使用的所有第三方 Jar 包

    本文将介绍如何利用 Maven 提供的强大功能,轻松获取项目中所有第三方 Jar 包的列表。 Maven 是一个强大的项目管理工具,它可以帮助我们管理项目的依赖关系。当我们构建一个复杂的项目时,通常会依赖许多第三方库。了解项目中使用了哪些第三方 Jar 包,对于项目的维护、安全审计和许可证管理至关重…

    2026年10月1日 • 用户投稿
    100
  • 用豆包AI实现Python多进程编程

    用豆包AI实现Python多进程编程用豆包AI实现Python多进程编程用豆包AI实现Python多进程编程用豆包AI实现Python多进程编程

    使用豆包ai辅助python多进程编程的关键在于明确需求并善用其生成代码的能力。多进程主要用于cpu密集型任务,如图像处理、模型推理等,能有效绕过gil限制。要高效使用豆包ai,1. 明确具体需求,如“并行处理多个csv文件”;2. 让ai生成模板代码,并替换为自身逻辑;3. 注意结果返回方式,可用…

    2026年10月1日 • 用户投稿
    200
  • Java中如何动态删除List中符合条件的元素

    正确删除List中元素应使用Iterator的remove()方法或Java 8的removeIf()方法。使用Iterator时需调用其remove()确保安全删除,避免ConcurrentModificationException;removeIf()通过Lambda表达式简化代码,内部已处理并…

    2026年10月1日
    100

发表回复

登录后才能评论
关注微信