NumPy高效切片：无循环处理变长起始/结束索引的技巧

程序猿 • 2025年12月14日 22:48:53 • 用户投稿 • 阅读 0

本教程详细介绍了如何在numpy中，不使用传统for循环的情况下，对一维数组进行多段切片。当需要从一个数组中提取n个固定长度为m的子序列，且每个子序列的起始和结束索引不同时，我们可以利用numpy的广播机制或`np.linspace`函数生成一个二维索引数组，进而通过高级索引操作实现高效、简洁且高性能的数据提取。

在数据处理和科学计算中，我们经常需要从大型数组中提取多个不连续的子序列。当这些子序列的起始和结束索引各不相同，但它们的长度保持一致时，传统的方法通常是使用循环结构逐个提取。然而，对于大规模数据集，Python的for循环效率低下，无法充分利用NumPy底层优化的C语言实现。本文将探讨如何利用NumPy的高级索引和矢量化操作，避免显式循环，以更高效、更“NumPyic”的方式完成这一任务。

传统循环方法及其局限性

假设我们有一个一维NumPy数组a，以及两组分别代表切片起始和结束位置的索引starts和ends。我们希望从a中提取N个子数组，每个子数组的长度为M（即ends[i] – starts[i] = M）。

以下是使用for循环实现此操作的示例：

import numpy as np# 为了结果可复现，设置随机种子np.random.seed(42)# 原始一维数组a = np.random.randn(10)print(f"原始数组 a: {a}n")# 定义多个切片的起始和结束索引starts = np.array([1, 2])ends = np.array([3, 4])# 验证每个切片的长度MM = ends[0] - starts[0]print(f"切片起始索引: {starts}")print(f"切片结束索引: {ends}")print(f"每个切片的固定长度 M: {M}n")# 使用 for 循环进行切片all_slices_for_loop = []for s, e in zip(starts, ends):  all_slices_for_loop.append(a[s:e])all_slices_for_loop = np.stack(all_slices_for_loop, axis=0)print(f"通过 for 循环得到的切片结果 (形状 {all_slices_for_loop.shape}):n{all_slices_for_loop}")

输出示例：

原始数组 a: [ 0.49671415 -0.1382643  1.64768854  0.76743472 -1.28020898  0.03602528 -0.21798363  0.50275798 -0.36239599  0.86518764]切片起始索引: [1 2]切片结束索引: [3 4]每个切片的固定长度 M: 2通过 for 循环得到的切片结果 (形状 (2, 2)):[[-0.1382643   1.64768854] [ 1.64768854  0.76743472]]

尽管此方法直观易懂，但当starts和ends数组包含大量索引对时，for循环会带来显著的性能开销，因为它涉及多次Python解释器与NumPy底层库之间的上下文切换。

NumPy 高级索引实现

要避免for循环，核心思想是构建一个二维索引数组idx，其形状为(N, M)，其中idx[i, j]表示第i个切片的第j个元素在原始数组a中的实际位置。一旦有了这样的索引数组，我们就可以直接使用a[idx]进行高级索引，一次性提取所有所需的子序列。

方法一：基于广播机制生成索引

这是最简洁且推荐的方法之一。它利用NumPy的广播机制，将起始索引数组扩展为列向量，然后与一个表示相对位移的行向量相加。

将starts数组转换为列向量： starts[:, None]会将形状为(N,)的数组转换为(N, 1)的二维数组。创建相对位移向量： np.arange(M)会生成一个形状为(M,)的数组，包含[0, 1, …, M-1]。利用广播相加： (N, 1)的数组与(M,)的数组相加时，NumPy会将其广播为(N, M)的形状，从而生成最终的索引数组。

# 沿用之前的 a, starts, ends, M# 方法一：利用广播机制生成索引数组# starts[:, None] 将 starts 从 (N,) 变为 (N, 1)# np.arange(M) 生成 [0, 1, ..., M-1]# 两者相加利用广播机制，生成 (N, M) 的索引数组idx_broadcast = starts[:, None] + np.arange(M)print(f"方法一生成的索引数组 idx_broadcast (形状 {idx_broadcast.shape}):n{idx_broadcast}n")# 使用高级索引提取数据result_broadcast = a[idx_broadcast]print(f"方法一得到的切片结果 (形状 {result_broadcast.shape}):n{result_broadcast}")# 验证结果与 for 循环一致assert np.array_equal(result_broadcast, all_slices_for_loop)print("n方法一结果与 for 循环结果一致。")

输出示例：

方法一生成的索引数组 idx_broadcast (形状 (2, 2)):[[1 2] [2 3]]方法一得到的切片结果 (形状 (2, 2)):[[-0.1382643   1.64768854] [ 1.64768854  0.76743472]]方法一结果与 for 循环结果一致。

这种方法简洁、高效，并且易于理解其内部机制。

方法二：利用 np.linspace 生成索引

np.linspace函数通常用于生成等间隔的数值序列。在本场景中，我们可以巧妙地利用它来生成每个切片的索引。

将starts和ends转换为NumPy数组： 确保它们是NumPy数组类型，以便np.linspace可以接收。调用np.linspace：start参数传入starts数组。stop参数传入ends数组。num参数设置为M（切片长度）。dtype=int确保生成的索引是整数。endpoint=False至关重要，因为它表示生成的序列不包含stop值，这符合Python切片“左闭右开”的特性。transpose() (.T) 操作可能需要，具体取决于starts和ends的维度以及希望linspace如何处理它们。在当前例子中，linspace(starts, ends, …)会尝试在列方向上生成序列，因此需要转置来得到行方向的切片索引。

# 沿用之前的 a, starts, ends, M# 方法二：利用 np.linspace 生成索引数组# np.linspace(starts, ends, num=M, dtype=int, endpoint=False)# 这里的 starts 和 ends 都是 (N,) 数组，linspace 会对每对 (starts[i], ends[i]) 生成 M 个点# 最终生成的是一个 (M, N) 的数组，需要转置为 (N, M)idx_linspace = np.linspace(starts, ends, num=M, dtype=int, endpoint=False).Tprint(f"方法二生成的索引数组 idx_linspace (形状 {idx_linspace.shape}):n{idx_linspace}n")# 使用高级索引提取数据result_linspace = a[idx_linspace]print(f"方法二得到的切片结果 (形状 {result_linspace.shape}):n{result_linspace}")# 验证结果与 for 循环一致assert np.array_equal(result_linspace, all_slices_for_loop)print("n方法二结果与 for 循环结果一致。")

输出示例：

方法二生成的索引数组 idx_linspace (形状 (2, 2)):[[1 2] [2 3]]方法二得到的切片结果 (形状 (2, 2)):[[-0.1382643   1.64768854] [ 1.64768854  0.76743472]]方法二结果与 for 循环结果一致。

np.linspace方法虽然也能达到目的，但其参数（尤其是endpoint=False和可能的.T）需要更精确的理解和调整，相比之下，广播机制的方法通常更直观。

注意事项与总结

性能优势： 两种高级索引方法都将Python级别的循环替换为NumPy底层的C语言实现，极大地提升了处理大规模数据时的性能。这是NumPy进行矢量化计算的核心优势。固定切片长度M： 本教程介绍的方法假定所有切片的长度M是固定的。如果切片长度不固定，则无法直接生成一个规则的(N, M)索引数组。在这种情况下，可能需要使用列表推导式生成一个包含NumPy数组的列表，或者考虑NumPy的object数组来存储不同长度的切片。索引数组的数据类型： 生成的索引数组idx必须是整数类型（dtype=int），NumPy才能正确地将其解释为位置索引。可读性与维护性： 矢量化代码通常比循环代码更简洁，一旦理解了NumPy的广播和高级索引机制，代码的可读性和维护性也会更好。适用场景： 这种技术特别适用于批处理场景，例如在时间序列数据中提取多个固定长度的窗口，或在信号处理中提取多个帧。

通过掌握NumPy的广播机制和高级索引，您可以编写出更高效、更具表现力的Python代码，从而更好地利用NumPy的强大功能进行数据处理和分析。在处理需要从数组中提取多个规则子序列的场景时，务必优先考虑这些无循环的矢量化解决方案。

以上就是NumPy高效切片：无循环处理变长起始/结束索引的技巧的详细内容，更多请关注创想鸟其它相关文章！

版权声明：本文内容由互联网用户自发贡献，该文观点仅代表作者本人。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容，请发送邮件至 chuangxiangniao@163.com 举报，一经查实，本站将立刻删除。
发布者：程序猿，转转请注明出处：https://www.chuangxiangniao.com/p/1381264.html

打赏

微信扫一扫

支付宝扫一扫

0 0

关于作者

程序猿签约作者

414.1K 文章

0 评论

2 粉丝

这个人很懒，什么都没有留下～

使用 Polars LazyFrame 进行列级乘法

上一篇 2025年12月14日 22:48:47

Pandas query方法：处理含空格列名的实用指南

下一篇 2025年12月14日 22:48:58

好文分享

如何解决本地图片在使用 mask JS 库时出现的跨域错误？

如何跨越localhost使用本地图片？问题: 在本地使用mask js库时，引入本地图片会报跨域错误。解决方案: 要解决此问题，需要使用本地服务器启动文件，以http或https协议访问图片，而不是使用file://协议。例如： python -m http.server 8000 然后，可以…

程序猿
2025年12月24日
4000
好文分享

使用 Mask 导入本地图片时，如何解决跨域问题？

跨域疑难：如何解决 mask 引入本地图片产生的跨域问题？在使用 mask 导入本地图片时，你可能会遇到令人沮丧的跨域错误。为什么会出现跨域问题呢？让我们深入了解一下： mask 框架假设你以 http(s) 协议加载你的 html 文件，而当使用 file:// 协议打开本地文件时，就会产生跨域…

程序猿
2025年12月24日
3000
好文分享

正则表达式在文本验证中的常见问题有哪些？

正则表达式助力文本输入验证在文本输入框的验证中，经常遇到需要限定输入内容的情况。例如，输入框只能输入整数，第一位可以为负号。对于不会使用正则表达式的人来说，这可能是个难题。下面我们将提供三种正则表达式，分别满足不同的验证要求。 1. 可选负号，任意数量数字如果输入框中允许第一位为负号，后面可输入…

程序猿
2025年12月24日
3000
好文分享

为什么多年的经验让我选择全栈而不是平均栈

在全栈和平均栈开发方面工作了 6 年多，我可以告诉您，虽然这两种方法都是流行且有效的方法，但它们满足不同的需求，并且有自己的优点和缺点。这两个堆栈都可以帮助您创建 Web 应用程序，但它们的实现方式却截然不同。如果您在两者之间难以选择，我希望我在两者之间的经验能给您一些有用的见解。在这篇文章中，我…

程序猿
2025年12月24日
3000
好文分享

姜戈顺风

本教程演示如何在新项目中从头开始配置 django 和 tailwindcss。 django 设置创建一个名为 .venv 的新虚拟环境。 # windows$ python -m venv .venv$ .venvscriptsactivate.ps1(.venv) $# macos/linu…

程序猿
2025年12月24日
1000
好文分享

花 $o 学习这些编程语言或免费

→ Python → JavaScript → Java → C# → 红宝石 → 斯威夫特 → 科特林 → C++ → PHP → 出发 → R → 打字稿 []https://x.com/e_opore/status/1811567830594388315?t=_j4nncuiy2wfbm7ic…

程序猿
2025年12月24日
0000
好文分享

html5怎么导视频_html5用video标签导出或Canvas转DataURL获视频【导出】

HTML5无法直接导出video标签内容，需借助Canvas捕获帧并结合MediaRecorder API、FFmpeg.wasm或服务端协同实现。MediaRecorder适用于WebM格式前端录制；FFmpeg.wasm支持MP4等格式及精细编码控制；服务端方案适合高负载场景。如果您希望在网页…

程序猿
2025年12月23日
4000
好文分享

如何查看编写的html_查看自己编写的HTML文件效果【效果】

要查看HTML文件的浏览器渲染效果，需确保文件以.html为扩展名保存、用浏览器直接打开、利用开发者工具调试、必要时启用本地HTTP服务器、或使用编辑器实时预览插件。如果您编写了HTML代码，但无法直观看到其在浏览器中的实际渲染效果，则可能是由于文件未正确保存、未使用浏览器打开或文件扩展名设置错误…

程序猿
2025年12月23日
4000
好文分享

html5怎么加php_html5用Ajax与PHP后端交互实现数据传递【交互】

HTML5不能直接运行PHP，需通过Ajax与PHP通信：前端用fetch发送请求，PHP接收处理并返回JSON，前端解析响应更新DOM；注意跨域、编码、CSRF防护和输入过滤。 HTML5 本身是前端标记语言，不能直接运行 PHP 代码，但可以通过 Ajax（异步 JavaScript）与 PHP…

程序猿
2025年12月23日
3000
好文分享

html5 js怎么加_html5用script标签内嵌或外链引入JS代码【添加】

在HTML5中执行JavaScript需通过script标签：一、内联编写于head或body中；二、外链引入.js文件并建议放body末尾或加defer；三、defer按序执行，async独立执行；四、可动态创建script元素插入执行。如果您希望在HTML5页面中执行JavaScript代码，…

程序猿
2025年12月23日
0000
好文分享

node.js怎么运行html_node.js运行html步骤【指南】

答案是使用Node.js内置http模块、Express框架或第三方工具serve可快速搭建服务器预览HTML文件。首先通过http模块创建服务器并读取index.html返回响应；其次用Express初始化项目并配置静态文件服务；最后利用serve工具全局安装后一键启动服务器，三种方式均在浏览器访…

程序猿
2025年12月23日
4000
好文分享

html5能否插入带表单的文档_html5表单文档嵌入与数据提交【步骤】

HTML5中无法直接嵌入外部带表单的HTML文档并原生提交；可行方案有四：一、用iframe嵌入，需同源或CORS支持，并用postMessage通信；二、用fetch+DOMParser动态加载表单片段并手动绑定事件；三、在当前页面直接编写表单，最规范且兼容性好；四、用JavaScript+fet…

程序猿
2025年12月23日
1000
好文分享

360怎么装html5_360浏览器默认支持HTML5无需额外安装设置【说明】

HTML5是网页标准，非独立软件，360浏览器7.0+已原生支持；需确认内核为Blink/Chromium、关闭兼容模式、禁用强制兼容策略、重置Flash插件、清除HTML5本地存储、检查系统Media Foundation组件。如果您在使用360浏览器时发现HTML5网页功能异常（如视频无法播放…

程序猿
2025年12月23日
4000
好文分享

html5怎么打包运行_HT5用Webpack或Gulp打包后浏览器打开运行【打包】

应通过 HTTP 服务运行打包后的 HTML5 页面，而非双击打开：一、Webpack 配 webpack-dev-server 启动本地服务；二、Gulp 配 BrowserSync 提供实时重载；三、用 Python/Node.js 轻量 HTTP 工具托管 dist 目录；四、仅当必须双击运行…

程序猿
2025年12月23日
1000
好文分享

html5文件运行不出来怎么回事_析html5文件运行失败原因【解析】

首先检查文件扩展名和编码格式，确保为.html且使用UTF-8编码；接着验证HTML5结构完整性，包含及正确闭合的标签；然后排查外部资源路径是否正确，利用开发者工具查看404错误；排除浏览器兼容性问题，优先在现代浏览器中测试并避免未广泛支持的API；检查JavaScript语法错误与执行顺序，确保脚…

程序猿
2025年12月23日
1000
好文分享

html如何滑动_实现HTML页面或元素滑动效果【效果】

可通过CSS scroll-behavior实现平滑锚点跳转，JavaScript scrollTo精确控制滚动位置，CSS transform模拟高性能滑动动画，或使用Swiper等第三方库实现触摸拖拽、循环播放等高级交互功能。如果您希望在网页中实现页面或特定元素的滑动效果，可以通过CSS和Ja…

程序猿
2025年12月23日
3000
好文分享

html5怎么插入文档_HT5用object或iframe嵌入PDF/Word文档显示【插入】

可在HTML5中用iframe或object标签嵌入PDF，需设宽高及可访问路径；Word文档需借OneDrive等第三方服务代理渲染；须处理跨域限制并提供下载降级方案。如果您希望在HTML5页面中嵌入PDF或Word文档并直接显示，可以使用或标签实现。以下是几种可行的嵌入方法：一、使用ifra…

程序猿
2025年12月23日
3000
好文分享

html5能否让搜索框随滚动固定_html5positionfixed固定布局【攻略】

可使用CSS的position: fixed实现搜索框固定定位，或用position: sticky实现边界感知粘性效果，配合JavaScript动态控制、响应式适配及占位修复，确保滚动时稳定显示。如果您希望在网页滚动过程中让搜索框始终保持在可视区域的固定位置，HTML5 本身不提供直接的布局控制…

程序猿
2025年12月23日
3000
好文分享

如何操作html_操作HTML元素的常用方法【常用】

必须掌握操作HTML元素的五种核心方法：一、通过ID精准获取并修改单个元素；二、通过类名批量操作多个元素；三、用querySelector系列灵活选择任意CSS匹配元素；四、动态创建并插入新元素；五、安全移除或替换现有元素。如果您需要动态修改网页内容或响应用户交互，则必须掌握操作HTML元素的核心…

程序猿
2025年12月23日
9000
好文分享

html5框架怎么设置_HTML5用iframe或div框架集嵌入子页面设框架【设置】

HTML5中嵌入子页面的现代方案有四种：一、用iframe标签直接嵌入，支持安全与可访问性属性；二、用CSS Grid/Flexbox布局配合JavaScript动态加载HTML片段；三、用Shadow DOM封装自定义元素实现样式脚本隔离；四、用object标签嵌入HTML并提供fallback内…

程序猿
2025年12月23日
2000