Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $YECBGYFECGEAFWHA as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2

Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $BBWFDDBHHYHDXXAB as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2
MongoDB时间序列数据字段差值计算教程_创想鸟

MongoDB时间序列数据字段差值计算教程

mongodb时间序列数据字段差值计算教程

本教程详细介绍了如何在MongoDB中对时间序列数据进行字段差值计算。我们将利用聚合管道(Aggregation Pipeline)的强大功能,特别是$dateTrunc、$group和$setWindowFields操作符,实现按指定时间间隔(如每小时)和分类字段(如code)计算连续时间点上某个字段(如energy)的首次记录值之间的差值,从而有效分析数据变化趋势。

1. 引言

在处理时间序列数据时,我们经常需要分析数据在不同时间点之间的变化量。例如,计算每小时的能耗增量、每日的用户活跃度变化等。MongoDB的聚合管道提供了一套强大的工具集,能够高效地完成这类复杂的分析任务。本教程将以一个具体的案例为例,详细讲解如何利用聚合管道计算特定字段在不同时间戳之间的差值。

2. 问题描述与数据集

假设我们有一个存储设备能耗数据的MongoDB集合,其文档结构如下:

[  {     _id: 1,    "timestamp": "2023-05-15T10:00:00Z",    "code": "abc",    "energy": 2333  },  {     _id: 2,    "timestamp": "2023-05-15T10:10:00Z",    "code": "abc",    "energy": 2340  },  // ... 其他 'abc' 类型数据  {     _id: 6,    "timestamp": "2023-05-15T11:00:00Z",    "code": "abc",    "energy": 2370  },  {     _id: 7,    "timestamp": "2023-05-15T10:00:00Z",    "code": "def",    "energy": 3455  },  {     _id: 8,    "timestamp": "2023-05-15T10:10:00Z",    "code": "def",    "energy": 3460  },  // ... 其他 'def' 类型数据  {     _id: 12,    "timestamp": "2023-05-15T11:00:00Z",    "code": "def",    "energy": 3500  }]

我们的目标是:对于每种code(例如”abc”和”def”),计算其在每个小时开始时的energy值与前一个小时开始时的energy值之间的差。例如,计算 2023-05-15T11:00:00Z 的 energy 值减去 2023-05-15T10:00:00Z 的 energy 值。

期望的输出格式如下:

[  { "timestamp": "2023-05-15T11:00:00Z", "code": "abc", "energy": 37 },  { "timestamp": "2023-05-15T11:00:00Z", "code": "def", "energy": 45 }]

3. MongoDB聚合管道解决方案

我们将构建一个多阶段的聚合管道来解决这个问题。

3.1 聚合管道概览

完整的聚合管道如下:

db.collection.aggregate([  // 1. 初始排序:按代码和时间戳排序,确保后续分组和取首值正确  {    $sort: {      code: 1,      timestamp: 1    }  },  // 2. 分组并获取每小时的首个能量值:按代码和小时进行分组  {    $group: {      _id: {        code: "$code",        hour: {          $dateTrunc: {            date: "$timestamp",            unit: "hour"          }        }      },      energy: {        $first: "$energy"      }    }  },  // 3. 使用窗口函数计算前一个小时的能量值  {    $setWindowFields: {      partitionBy: "$_id.code", // 按代码分区      sortBy: {        "_id.hour": 1      }, // 在每个分区内按小时排序      output: {        prevEnergy: {          $push: "$energy",          window: {            documents: [              -1,              0            ]          }        }      }    }  },  // 4. 过滤结果:移除没有前一个小时数据的记录  {    $match: {      "prevEnergy.1": {        $exists: true      }    }  },  // 5. 最终投影:计算差值并格式化输出  {    $project: {      _id: 0,      timestamp: "$_id.hour",      code: "$_id.code",      energy: {        $subtract: [          {            $last: "$prevEnergy"          },          {            $first: "$prevEnergy"          }        ]      }    }  }])

3.2 阶段详解

阶段 1: $sort – 初始排序

{  $sort: {    code: 1,    timestamp: 1  }}

目的: 确保数据在进入 $group 阶段时,对于每个 code,其 timestamp 是按升序排列的。这对于后续使用 $first 操作符获取每个小时的第一个 energy 值至关重要。同时,按 code 排序也为后续的 partitionBy 提供了更好的数据局部性。

阶段 2: $group – 按小时和代码分组并获取首个值

{  $group: {    _id: {      code: "$code",      hour: {        $dateTrunc: {          date: "$timestamp",          unit: "hour"        }      }    },    energy: {      $first: "$energy"    }  }}

目的: 将原始文档按 code 和其 timestamp 所在的小时进行分组。_id: { code: “$code”, hour: { $dateTrunc: { date: “$timestamp”, unit: “hour” } } }: 定义分组键。$dateTrunc: 这个操作符用于将日期截断到指定的单位(例如,”hour”)。它会将 2023-05-15T10:10:00Z 和 2023-05-15T10:30:00Z 都截断为 2023-05-15T10:00:00Z。energy: { $first: “$energy” }: 在每个分组内,获取 energy 字段的第一个值。由于我们在前一阶段已经按 timestamp 进行了排序,这里 $first 就能准确地取出每个小时的第一个 energy 读数。

经过此阶段,数据将变为:

[  { "_id": { "code": "abc", "hour": ISODate("2023-05-15T10:00:00Z") }, "energy": 2333 },  { "_id": { "code": "abc", "hour": ISODate("2023-05-15T11:00:00Z") }, "energy": 2370 },  { "_id": { "code": "def", "hour": ISODate("2023-05-15T10:00:00Z") }, "energy": 3455 },  { "_id": { "code": "def", "hour": ISODate("2023-05-15T11:00:00Z") }, "energy": 3500 }]

阶段 3: $setWindowFields – 窗口函数计算

{  $setWindowFields: {    partitionBy: "$_id.code", // 按代码分区    sortBy: {      "_id.hour": 1    }, // 在每个分区内按小时排序    output: {      prevEnergy: {        $push: "$energy",        window: {          documents: [            -1,            0          ]        }      }    }  }}

目的: 这是实现“前一个小时”值计算的关键。$setWindowFields 允许我们在一个“窗口”内对文档执行聚合操作。partitionBy: “$_id.code”: 将文档分成独立的组,每个 code 对应一个分区。这意味着 abc 的计算不会影响 def 的计算。sortBy: { “_id.hour”: 1 }: 在每个分区内,按小时(即 _id.hour)升序排列文档。这是定义窗口顺序的基础。output: { prevEnergy: { $push: “$energy”, window: { documents: [-1, 0] } } }:prevEnergy: 定义一个新的字段来存储窗口计算的结果。$push: “$energy”: 将当前窗口内的 energy 值收集到一个数组中。window: { documents: [-1, 0] }: 定义窗口的范围。[-1, 0] 表示窗口包含当前文档(0)和其前一个文档(-1)。因此,prevEnergy 数组将包含当前小时的 energy 值和前一个小时的 energy 值。

经过此阶段,数据将变为(部分示例):

[  { "_id": { "code": "abc", "hour": ISODate("2023-05-15T10:00:00Z") }, "energy": 2333, "prevEnergy": [2333] }, // 第一个小时没有前一个值  { "_id": { "code": "abc", "hour": ISODate("2023-05-15T11:00:00Z") }, "energy": 2370, "prevEnergy": [2333, 2370] },  { "_id": { "code": "def", "hour": ISODate("2023-05-15T10:00:00Z") }, "energy": 3455, "prevEnergy": [3455] },  { "_id": { "code": "def", "hour": ISODate("2023-05-15T11:00:00Z") }, "energy": 3500, "prevEnergy": [3455, 3500] }]

阶段 4: $match – 过滤结果

{  $match: {    "prevEnergy.1": {      $exists: true    }  }}

目的: 过滤掉那些没有“前一个小时”数据的文档。”prevEnergy.1″: { $exists: true }: 检查 prevEnergy 数组的第二个元素(索引为1)是否存在。如果存在,说明这个数组至少有两个元素(当前值和前一个值),可以进行差值计算。对于每个 code 的第一个小时数据,prevEnergy 数组只有一个元素,因此会被过滤掉。

经过此阶段,数据将变为:

[  { "_id": { "code": "abc", "hour": ISODate("2023-05-15T11:00:00Z") }, "energy": 2370, "prevEnergy": [2333, 2370] },  { "_id": { "code": "def", "hour": ISODate("2023-05-15T11:00:00Z") }, "energy": 3500, "prevEnergy": [3455, 3500] }]

阶段 5: $project – 最终投影和计算差值

{  $project: {    _id: 0,    timestamp: "$_id.hour",    code: "$_id.code",    energy: {      $subtract: [        {          $last: "$prevEnergy"        },        {          $first: "$prevEnergy"        }      ]    }  }}

目的: 格式化输出,并执行最终的差值计算。_id: 0: 排除默认的 _id 字段。timestamp: “$_id.hour”: 将 _id.hour 字段重命名为 timestamp。code: “$_id.code”: 将 _id.code 字段重命名为 code。energy: { $subtract: [ { $last: “$prevEnergy” }, { $first: “$prevEnergy” } ] }:$subtract: 执行减法操作。$last: “$prevEnergy”: 获取 prevEnergy 数组的最后一个元素(即当前小时的 energy 值)。$first: “$prevEnergy”: 获取 prevEnergy 数组的第一个元素(即前一个小时的 energy 值)。计算 当前小时能量值 – 前一小时能量值。

最终输出将符合预期:

[  { "timestamp": ISODate("2023-05-15T11:00:00Z"), "code": "abc", "energy": 37 },  { "timestamp": ISODate("2023-05-15T11:00:00Z"), "code": "def", "energy": 45 }]

4. 注意事项与最佳实践

时间戳数据类型: 确保 timestamp 字段存储为 MongoDB 的 ISODate 类型。如果存储为字符串,需要先使用 $toDate 或在应用程序层进行转换。索引: 为了提高聚合查询的性能,特别是对于大型数据集,建议在 code 和 timestamp 字段上创建复合索引:db.collection.createIndex({ code: 1, timestamp: 1 })。数据稀疏性: 如果某些小时或某些 code 没有数据,此聚合管道将不会为这些缺失的时间点生成输出。这是符合逻辑的行为,因为没有数据就没有差值可计算。时间粒度调整: 如果需要计算每日、每周或每月差值,只需修改 $dateTrunc 操作符的 unit 参数即可(例如,”day”、”week”、”month”)。窗口定义灵活性: $setWindowFields 的 window 参数非常灵活,可以定义不同的窗口范围(例如,[0, 1] 获取当前和下一个文档,[UNBOUNDED, 0] 获取从开头到当前文档的所有数据),以支持更复杂的分析需求,如移动平均、累计和等。

5. 总结

通过结合 $sort、$group、

以上就是MongoDB时间序列数据字段差值计算教程的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1513981.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
MongoDB聚合管道:计算时间序列数据中字段的增量与差值
上一篇 2025年12月20日 08:08:07
MongoDB聚合管道:计算时间序列数据中特定字段的逐小时差值
下一篇 2025年12月20日 08:08:18

相关推荐

  • 用AI打造沉浸式蝴蝶号无人直播间操作实录

    用AI打造沉浸式蝴蝶号无人直播间操作实录用AI打造沉浸式蝴蝶号无人直播间操作实录用AI打造沉浸式蝴蝶号无人直播间操作实录用AI打造沉浸式蝴蝶号无人直播间操作实录

    用ai做蝴蝶号无人直播间确实可以“无人”,但关键在于流程跑通与细节做好。具体步骤包括:一、准备阶段要配齐账号、素材和工具,明确账号定位,建立丰富素材库,选对ai工具并从垂直领域测试;二、设计脚本时需预设规则匹配,整理常见问题与回答表格导入系统;三、实操上设置定时推流、语音讲解、弹幕监控和自动下播等流…

    2026年9月22日 用户投稿
    1200
  • PowerBI的AI混合工具怎么用?快速创建数据报表的详细操作方法

    PowerBI的AI混合工具通过Q&A、关键影响因素、异常检测和智能叙事等功能,降低数据分析门槛,加速从数据到决策的全过程。它让非技术人员用自然语言提问获取图表,自动识别数据异常与驱动因素,并生成文字解读,大幅提升分析效率。但需以高质量数据和合理建模为基础,结合业务逻辑验证结果,避免“垃圾进…

    2026年9月22日
    600
  • VSCode安装Go语言插件(图文详解,新手避坑指南)

    首先安装Go SDK并配置环境变量,再安装VSCode及Go插件,关键步骤是通过Go: Install/Update Tools命令安装gopls、dlv等核心工具链,确保代码补全、调试等功能正常;若遇问题,需检查Go版本、GOPROXY代理、权限及网络,结合输出面板错误信息定位解决。 配置VSCo…

    2026年9月22日
    400
  • Sublime用于MySQL分库分表设计逻辑_适合大型系统水平扩展需求

    Sublime用于MySQL分库分表设计逻辑_适合大型系统水平扩展需求Sublime用于MySQL分库分表设计逻辑_适合大型系统水平扩展需求Sublime用于MySQL分库分表设计逻辑_适合大型系统水平扩展需求Sublime用于MySQL分库分表设计逻辑_适合大型系统水平扩展需求

    分库分表通过拆分数据提升数据库性能与扩展性,常见策略包括垂直分表、水平分表和分库;sublime 可辅助设计逻辑。1. 垂直分表按字段拆分,降低单表复杂度;2. 水平分表按行拆分,提升查询效率;3. 分库减少单节点压力,增强系统吞吐能力。使用 sublime 可高效编写 sql 脚本、注释分片规则、…

    2026年9月22日 用户投稿
    500
  • 笔记—Linux安装OpenCV及VSCode的配置编译

    笔记—Linux安装OpenCV及VSCode的配置编译笔记—Linux安装OpenCV及VSCode的配置编译笔记—Linux安装OpenCV及VSCode的配置编译笔记—Linux安装OpenCV及VSCode的配置编译

    在学习新技能的过程中,我选择了在linux系统上进行操作,这对于从未接触过linux的人来说是一个绝佳的学习机会。这篇文章记录了我在linux上安装opencv的过程。 我选择的Linux发行版是Ubuntu 20.04.3,并将其安装在Virtual Box虚拟机中。Ubuntu的相关资料丰富,选…

    2026年9月22日 用户投稿
    100
  • 使用Sublime管理MySQL数据库结构_高效编辑表结构与字段定义脚本

    使用Sublime管理MySQL数据库结构_高效编辑表结构与字段定义脚本使用Sublime管理MySQL数据库结构_高效编辑表结构与字段定义脚本使用Sublime管理MySQL数据库结构_高效编辑表结构与字段定义脚本使用Sublime管理MySQL数据库结构_高效编辑表结构与字段定义脚本

    用 sublime text 管理 mysql 数据库结构脚本高效且灵活。1. 适合习惯文本编辑、需自定义流程的开发者;2. 启动快、资源占用低,支持多光标、正则替换,插件丰富,易配合 git;3. 建议每张表单独文件、按模块分目录、主脚本汇总建表语句,索引外键单独文件;4. 推荐插件有 sqlto…

    2026年9月22日 用户投稿
    000
  • windows怎么打开资源监视器_Windows资源监视器使用方法

    可通过任务管理器、运行命令、开始菜单搜索、命令提示符或创建桌面快捷方式五种方法打开资源监视器,实时监控CPU、内存、磁盘和网络使用情况,帮助排查Windows系统性能问题。 如果您在使用Windows系统时遇到性能问题,例如程序运行缓慢或CPU占用过高,可能需要查看系统资源的实时使用情况。资源监视器…

    2026年9月22日
    000
  • mac怎么清理DNS缓存_mac刷新DNS缓存命令

    刷新DNS缓存可解决网站加载缓慢或显示错误问题。在macOS Sonoma系统中,可通过终端执行“sudo dscacheutil -flushcache; sudo killall -HUP mDNSResponder”命令清理缓存,输入管理员密码后生效;或使用第三方工具如OnyX一键清理,适用于…

    2026年9月22日
    100
  • 米侠浏览器网页字体乱码怎么办 米侠浏览器字体显示异常修复方法

    字体乱码通常因编码错误、缓存问题或字体缺失引起。2. 首先尝试在米侠浏览器中切换网页编码为UTF-8、GBK或GB2312。3. 清除缓存、Cookie和网站数据可解决加载异常。4. 确保设备安装了常用中文字体如思源黑体或微软雅黑。5. 更新或重装最新版米侠浏览器以排除兼容性问题。6. 若仍无效,可…

    2026年9月22日
    100
  • 苹果手机打微信电话怎么录音_苹果手机微信通话录音方法

    由于iOS限制,苹果手机无法直接录音微信通话,可通过三种方式解决:一、使用屏幕录制功能,开启麦克风权限后录屏,再将视频转为音频;二、借助“TapeACall”等第三方应用,提前开启录音并切换至微信通话;三、使用外接录音设备,如录音笔或蓝牙耳机,在通话时同步录音,避免系统限制。 如果您尝试在苹果手机上…

    2026年9月22日
    200
  • Spring Boot集成MongoDB Atlas:正确配置与故障排除

    本教程详细指导如何在Spring Boot应用中正确配置与连接MongoDB Atlas集群。我们将重点讲解如何获取并使用正确的Atlas连接URI,安全地处理用户认证信息,以及准确指定目标数据库。通过实例代码和常见错误排查,帮助开发者避免连接失败,确保应用与MongoDB Atlas的顺畅集成。 …

    2026年9月22日
    600
  • AdobeFresco的AI功能如何裁剪图片?教你轻松实现图像裁剪

    AdobeFresco的AI功能如何裁剪图片?教你轻松实现图像裁剪AdobeFresco的AI功能如何裁剪图片?教你轻松实现图像裁剪AdobeFresco的AI功能如何裁剪图片?教你轻松实现图像裁剪AdobeFresco的AI功能如何裁剪图片?教你轻松实现图像裁剪

    Adobe Fresco通过变换工具与智能选择功能组合实现精准裁剪,先激活变换工具调整区域,再利用像素选择或套索工具智能识别主体,提升裁剪效率与精度。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ Adobe Fresco在图片裁剪方面,虽…

    2026年9月22日 用户投稿
    600
  • 抖音商品投入福袋奖池对商家有哪些收益?

    抖音上线福袋奖品池功能,助力商家实现GMV增长。那么,加入福袋奖品池后商家能获得哪些好处?又该如何将商品加入福袋奖品池呢? 首先,关于把商品放入福袋奖品池的益处: 达人通过自主预算采购你的商品,并以抽奖方式发放给直播间的观众,为你带来精准流量! 无需复杂操作,只需入驻福袋奖品池,即可借助达人的粉丝资…

    2026年9月22日
    900
  • MySQL在Sublime中高亮配置指南_实现关键词提示与语法检查功能

    MySQL在Sublime中高亮配置指南_实现关键词提示与语法检查功能MySQL在Sublime中高亮配置指南_实现关键词提示与语法检查功能MySQL在Sublime中高亮配置指南_实现关键词提示与语法检查功能MySQL在Sublime中高亮配置指南_实现关键词提示与语法检查功能

    要配置sublime text以更好地处理mysql代码,需安装package control、sql语法包(如sqltools或sublimesql)、sublimelinter及sqlfluff进行语法检查,并可选装格式化与数据库连接插件。1. 安装package control是前提;2. 通…

    2026年9月22日 用户投稿
    500
  • 准星助手如何开启准星

    在许多游戏中,准星对玩家的操作体验有着重要影响,它能有效提升瞄准精度,增强游戏中的反应效率。而准星助手则是一款帮助玩家在游戏中显示准星的辅助工具。那么,如何通过准星助手开启准星功能呢? 首先,确保你已经成功下载并安装了准星助手应用。你可以通过手机的应用商店搜索“准星助手”进行下载,也可以访问其官方网…

    2026年9月22日
    500
  • 苹果手机录音功能如何操作_苹果手机录音功能使用指南

    苹果手机可通过语音备忘录、控制中心、Siri指令和轻点背面四种方式快速录音,并支持调整录音质量、启用立体声和降噪功能以优化音频效果。 如果您需要在苹果手机上录制音频,但不确定如何快速启动或设置最佳录音模式,可能是由于不熟悉系统内置工具或快捷方式。以下是解决此问题的步骤: 本文运行环境:iPhone …

    2026年9月22日
    000
  • 如何在CorelDRAW导出AI生成的分层图片?保存矢量图像的步骤

    CorelDRAW无法直接将AI生成的位图导出为分层矢量图,需先导入位图,使用PowerTRACE功能进行描摹矢量化,手动取消组合并按元素类型创建图层分类整理,最后导出AI格式时勾选“保留图层和页面”并设置文本转曲线以确保完整性。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用…

    2026年9月22日
    000
  • windows11连接Wi-Fi时显示“无Internet,安全”怎么办_windows11 Wi-Fi已连接无网修复方法

    首先确认其他设备是否同样无法上网,若均无网络则重启路由器;使用Windows 11内置疑难解答工具检测修复;启动WLAN AutoConfig和Network Setup Service服务;通过网络重置功能恢复默认配置;更改DNS为8.8.8.8和8.8.4.4;最后更新或重装无线网卡驱动以解决连…

    2026年9月22日
    100
  • VSCode搭建RISC-V开发环境(结合FPGA,嵌入式开发指南)

    首先安装RISC-V GCC工具链并配置环境变量,接着在VSCode中安装C/C++和RISC-V GDB扩展,然后配置launch.json实现调试,结合OpenOCD支持FPGA JTAG调试,使用Makefile管理编译,选择稳定工具链版本,通过命令行测试GDB连接排查问题,利用ILA和仿真工…

    2026年9月22日
    300
  • windows蓝屏代码kernel_data_inpage_error如何修复_KERNEL_DATA_INPAGE_ERROR蓝屏的修复指南

    蓝屏错误“KERNEL_DATA_INPAGE_ERROR”通常由硬盘、内存或驱动问题引起,需依次检查硬盘健康(chkdsk)、运行内存诊断(mdsched.exe)、更新/回滚存储驱动、禁用页面文件压缩及扫描系统文件(sfc /scannow与DISM修复)。 如果您在使用Windows系统时遇到…

    2026年9月22日
    500

发表回复

登录后才能评论
关注微信