Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $YECBGYFECGEAFWHA as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2

Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $BBWFDDBHHYHDXXAB as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2
2D人体姿态关键点数据处理:JSON格式解析与模型适配策略_创想鸟

2D人体姿态关键点数据处理:JSON格式解析与模型适配策略

2d人体姿态关键点数据处理:json格式解析与模型适配策略

本文探讨了在2D人体姿态估计中,如何处理和适配特定JSON格式的关键点数据。针对用户自定义的`[x, y, confidence]`扁平化列表格式,文章指出直接寻找原生输出此格式的模型存在挑战。核心策略是理解现有数据结构,并根据目标姿态估计模型的输入要求进行数据重格式化。教程将提供JSON解析示例,并讨论关键点顺序、坐标归一化等重格式化要点,旨在帮助开发者高效地将自定义数据应用于主流姿态估计框架。

在2D人体姿态估计任务中,获取图像中人物的关键点坐标是核心目标。开发者常会遇到现有关键点数据(无论是标注数据还是其他模型输出)采用特定JSON格式,而主流姿态估计模型(如YOLOv8-pose、OpenPose、MediaPipe等)通常有其预定义的输入或输出格式。本文将针对类似以下示例的JSON格式数据,探讨如何进行解析、理解,并提出将其适配到主流姿态估计模型的方法。

理解自定义关键点JSON格式

我们首先分析提供的JSON数据结构。该格式将人体关键点表示为一个扁平化的列表,其中每个关键点由三个浮点数组成:[x坐标, y坐标, 置信度]。

{  "version": 1.0,  "people": [    {      "face_keypoints": [],      "pose_keypoints": [        104.81, 34.44, 0.91, // Keypoint 1 (x, y, confidence)        83.90, 80.05, 0.72, // Keypoint 2        // ... more keypoints ...        0, 0, 0,            // Missing or undetected keypoint        93.98, 28.16, 0.93  // Last keypoint      ],      "hand_right_keypoints": [],      "hand_left_keypoints": []    }  ]}

在这个结构中:

version: 版本信息。people: 一个列表,每个元素代表检测到的一个人。pose_keypoints: 包含人体姿态关键点的列表。这是一个扁平化的数组,每三个元素构成一个关键点 (x, y, confidence)。如果某个关键点未被检测到,其坐标和置信度可能为 0, 0, 0。face_keypoints, hand_right_keypoints, hand_left_keypoints: 同样用于存储面部和手部关键点,在本例中为空。

这种扁平化列表的格式在某些场景下(例如OpenPose的早期输出或自定义数据集)较为常见,但其关键点的具体语义(例如第一个三元组代表鼻子,第二个代表左眼等)需要额外的映射表来定义。

直接寻找原生输出模型的挑战

开发者常常希望找到一个模型能够直接输出与其现有数据完全匹配的JSON格式。然而,这在实践中往往是困难的。

标准化差异: 不同的姿态估计模型和数据集(如COCO、MPII)定义了不同的关键点集合和顺序。例如,COCO数据集定义了17个关键点,而OpenPose可能定义了25个。输出结构多样性: 模型的输出格式多种多样,可能是原始的张量、特定API对象、或者不同结构的JSON/CSV文件。直接匹配到 [x, y, confidence] 的扁平化列表并非通用标准。后处理: 大多数模型在推理后都会进行后处理,将原始模型输出转换为更易读或标准化的格式。即使模型内部生成了类似的数据,最终暴露给用户的API输出也可能不同。

因此,与其寻找一个原生输出完全匹配的模型,更实际的方法是采用数据重格式化策略。

策略:数据重格式化以适配模型

核心思想是:将现有自定义格式的关键点数据,转换为目标姿态估计模型所要求的输入格式,或者在模型输出后,将其结果转换为期望的自定义格式。

1. 解析自定义JSON数据

首先,我们需要编写Python代码来解析上述自定义JSON格式,将其转换为更易于处理的结构,例如一个包含 (x, y, confidence) 元组的列表。

import jsondef parse_custom_keypoints_json(json_data_str):    """    解析自定义JSON字符串,提取人体姿态关键点。    """    data = json.loads(json_data_str)    people_keypoints_list = []    for person_data in data.get("people", []):        pose_keypoints_flat = person_data.get("pose_keypoints", [])        # 将扁平化列表转换为 (x, y, confidence) 元组列表        keypoints = []        for i in range(0, len(pose_keypoints_flat), 3):            if i + 2 < len(pose_keypoints_flat):                x = pose_keypoints_flat[i]                y = pose_keypoints_flat[i+1]                confidence = pose_keypoints_flat[i+2]                keypoints.append((x, y, confidence))        people_keypoints_list.append(keypoints)    return people_keypoints_list# 示例JSON数据(来自问题内容)example_json_str = """{"version": 1.0, "people": [{"face_keypoints": [], "pose_keypoints": [104.818897637795, 34.4436363636364, 0.915185123682022, 83.9055118110236, 80.0581818181818, 0.723944239318371, 42.5826771653543, 79.8254545454545, 0.618412546813488, 34.7716535433071, 142.661818181818, 0.757904663681984, 31.244094488189, 204.8, 0.52992781996727, 122.456692913386, 81.2218181818182, 0.589333228766918, 125.48031496063, 145.92, 0.702833116054535, 131.527559055118, 192, 0.366538248956203, 58.7086614173228, 193.861818181818, 0.298667620576452, 0, 0, 0, 0, 0, 0, 107.842519685039, 196.421818181818, 0.324830377765466, 0, 0, 0, 0, 0, 0, 93.9842519685039, 28.16, 0.932040095329285, 107.086614173228, 26.9963636363636, 0.939965099096298, 71.3070866141732, 32.5818181818182, 0.885046675801277, 0, 0, 0], "hand_right_keypoints": [], "hand_left_keypoints": []}]} """parsed_keypoints = parse_custom_keypoints_json(example_json_str)# print(parsed_keypoints) # 输出解析后的关键点列表

这段代码将原始的扁平化列表转换为更结构化的关键点列表,每个关键点是一个 (x, y, confidence) 元组。

2. 目标模型的数据格式要求

以Ultralytics YOLOv8-pose为例,其姿态估计任务的标注格式通常是文本文件(.txt),每行代表一张图片中的一个目标,格式如下:class_id bbox_x_center bbox_y_center bbox_width bbox_height keypoint1_x keypoint1_y keypoint1_visibility keypoint2_x keypoint2_y keypoint2_visibility …

其中:

所有坐标(bbox和keypoint)都必须是相对于图像宽度和高度的归一化值(0到1之间)。visibility(可见性)通常是0(未标注)、1(遮挡但可见)、2(可见)。在推理场景下,这通常被替换为置信度或直接省略。关键点的顺序必须与模型训练时使用的顺序一致(例如COCO关键点顺序)。

这意味着,如果您想使用现有数据训练YOLOv8-pose,或者将YOLOv8-pose的输出转换为您的格式,您需要进行以下转换:

关键点顺序映射: 将您的自定义关键点顺序映射到目标模型(如COCO)的关键点顺序。这通常需要一个预定义的映射表。坐标归一化: 将绝对像素坐标 (x, y) 转换为相对于图像尺寸的归一化坐标 (x_norm, y_norm)。x_norm = x / image_widthy_norm = y / image_height边界框信息: 如果目标模型需要,您可能需要从关键点估算或从其他来源获取每个人的边界框 (bbox_x_center, bbox_y_center, bbox_width, bbox_height)。置信度/可见性: 根据目标模型的具体要求处理关键点的置信度。

3. 示例:将解析数据适配到YOLOv8-pose(概念性)

假设我们已经解析了自定义JSON数据,并获得了 keypoints = [(x1, y1, c1), (x2, y2, c2), …]。现在我们将其转换为YOLOv8-pose所需的格式。

def reformat_for_yolov8_pose(parsed_keypoints_list, image_width, image_height, coco_keypoint_map):    """    将解析后的关键点数据转换为YOLOv8-pose兼容的格式。    此函数仅为概念性示例,需要根据实际情况进行完善。    Args:        parsed_keypoints_list: parse_custom_keypoints_json 的输出。        image_width: 原始图像宽度。        image_height: 原始图像高度。        coco_keypoint_map: 一个字典,将自定义关键点索引映射到COCO关键点索引。                           例如:{custom_idx: coco_idx, ...}    Returns:        一个列表,包含每个人的YOLOv8-pose格式字符串。    """    yolov8_labels = []    for person_keypoints in parsed_keypoints_list:        # 1. 估算边界框 (这里简化处理,实际可能需要更精确的算法)        # 排除 (0,0,0) 的关键点来估算边界框        valid_keypoints = [(x, y) for x, y, c in person_keypoints if c > 0]        if not valid_keypoints:            continue # 没有有效关键点,跳过此人        min_x = min(kp[0] for kp in valid_keypoints)        max_x = max(kp[0] for kp in valid_keypoints)        min_y = min(kp[1] for kp in valid_keypoints)        max_y = max(kp[1] for kp in valid_keypoints)        bbox_width = (max_x - min_x) / image_width        bbox_height = (max_y - min_y) / image_height        bbox_x_center = ((min_x + max_x) / 2) / image_width        bbox_y_center = ((min_y + max_y) / 2) / image_height        # 2. 准备关键点列表并进行归一化和排序        # 假设我们有25个关键点,且已知道它们的COCO映射        # 这里需要一个更复杂的映射逻辑,将原始关键点与COCO 17个关键点对应        # 简化为直接使用原始关键点,并假设其顺序与某个标准匹配        # 填充COCO 17个关键点,如果原始数据有更多,需要选择性映射        # 如果原始数据有25个关键点,需要根据COCO的17个关键点进行筛选和排序        # 示例中假设 person_keypoints 的顺序与COCO关键点大致对应或可映射        # 为了演示,我们假设自定义数据的前17个关键点与COCO顺序一致        # 实际应用中,需要根据具体的关键点定义进行精确映射        keypoints_formatted = []        for i in range(17): # 假设目标是COCO 17个关键点            if i  0 else 0                 keypoints_formatted.extend([x_norm, y_norm, visibility])            else:                # 如果自定义数据关键点不足17个,则填充0                keypoints_formatted.extend([0.0, 0.0, 0])        # 3. 组合成YOLOv8-pose的标签行        # class_id 0 通常代表 "person"        label_line = f"0 {bbox_x_center:.6f} {bbox_y_center:.6f} {bbox_width:.6f} {bbox_height:.6f}"        label_line += " " + " ".join([f"{val:.6f}" for val in keypoints_formatted])        yolov8_labels.append(label_line)    return yolov8_labels# 假设图像尺寸和COCO关键点映射(需要根据实际情况定义)# 这是一个简化的映射示例,实际需要根据您的自定义关键点和COCO关键点对应关系来构建# 例如:{0: 0, 1: 1, ... 16: 16} 假设前17个关键点直接对应COCOcoco_keypoint_mapping_example = {i: i for i in range(17)} image_w, image_h = 640, 480 # 假设图像尺寸# 转换数据yolov8_formatted_labels = reformat_for_yolov8_pose(parsed_keypoints, image_w, image_h, coco_keypoint_mapping_example)# for label in yolov8_formatted_labels:#     print(label)

注意事项:

关键点语义和顺序: 最关键的一步是理解您的自定义JSON中每个 (x, y, confidence) 三元组代表哪个身体部位,并将其与目标模型(如COCO)所定义的关键点进行精确映射。如果关键点数量不一致,需要进行增删和排序。坐标归一化: 几乎所有现代深度学习模型都要求输入坐标是归一化的。边界框: 许多姿态估计模型(特别是基于检测的模型,如YOLOv8-pose)需要边界框信息。如果您的原始数据中没有,您需要从关键点中估算。可见性/置信度: 目标模型可能对关键点的可见性或置信度有特定的编码要求。

选择和适配姿态估计模型

在完成数据重格式化后,您可以选择适合您需求的姿态估计模型:

YOLOv8-pose: Ultralytics YOLOv8系列提供了姿态估计功能。它易于使用,性能良好,并且有详细的文档说明如何准备数据集。OpenPose:

以上就是2D人体姿态关键点数据处理:JSON格式解析与模型适配策略的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1381250.html

赞 (0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
Python itertools:生成固定首尾元素的序列排列
上一篇 2025年12月14日 22:48:04
Mac 如何配置 zsh 与 Python
下一篇 2025年12月14日 22:48:19

相关推荐

  • Java中如何区分逻辑错误和系统异常

    系统异常是程序运行中由JVM抛出的RuntimeException,如空指针、数组越界,会导致程序中断并打印堆栈;逻辑错误是程序语法正确但结果不符预期,如条件写反、循环次数错误,不会崩溃但行为异常。两者区别在于是否抛出异常、是否中断执行及调试方式不同,需通过防御性编程、单元测试和日志调试加以防范。 …

    2026年9月22日
    000
  • 如何查询命令所属包 yum provides反向查找

    如何查询命令所属包 yum provides反向查找如何查询命令所属包 yum provides反向查找如何查询命令所属包 yum provides反向查找如何查询命令所属包 yum provides反向查找

    使用 yum provides 可以查找某个命令或文件属于哪个软件包,解决“command not found”问题。1. 使用时建议带上完整路径,如 yum provides /usr/sbin/ifconfig;2. 支持通配符模糊查找,如 yum provides */python3;3. 若…

    2026年9月22日 • 用户投稿
    000
  • Karate框架中处理带方括号和日期范围的GET请求参数

    本文旨在解决Karate框架中构建包含复杂、带方括号(如filters[start_date])及日期范围的GET请求参数时遇到的URL编码问题。通过对比直接定义查询对象和使用param关键字的方法,详细阐述了如何正确地构造URL,确保参数格式符合预期,从而有效进行API测试。 1. 问题背景与挑战…

    2026年9月22日
    000
  • 谷歌浏览器窗口透明边框显示异常如何修复

    首先尝试修改快捷方式添加–disable-gpu –disable-software-rasterize参数,若可正常运行则关闭硬件加速,并重置chrome://flags实验功能及清除ShaderCache缓存文件。 谷歌浏览器出现窗口透明边框显示异常,通常和硬件加速或GP…

    2026年9月22日
    000
  • VSCode配合Quartus开发FPGA(环境设置教程,提高开发效率)

    使用VSCode配合Quartus开发FPGA可提升效率,核心是结合VSCode的代码编辑功能与Quartus的编译仿真能力。首先安装Quartus、VSCode及Python,再安装VHDL/Verilog插件和Makefile Tools等扩展。配置系统环境变量,将Quartus命令路径加入PA…

    2026年9月22日
    100
  • 如何在Dask中训练AI大模型?分布式数据处理的AI训练技巧

    如何在Dask中训练AI大模型?分布式数据处理的AI训练技巧如何在Dask中训练AI大模型?分布式数据处理的AI训练技巧如何在Dask中训练AI大模型?分布式数据处理的AI训练技巧如何在Dask中训练AI大模型?分布式数据处理的AI训练技巧

    Dask在处理超大规模数据集时的独特优势在于其Python原生的分布式计算能力,能无缝扩展Pandas和NumPy的工作流,突破单机内存限制,实现高效的数据预处理与模型训练。它通过惰性计算、分块处理和内存溢写机制,支持TB级数据的并行操作,相比Spark提供了更贴近Python数据科学生态的API和…

    2026年9月22日 • 用户投稿
    100
  • php-gd怎么应用复古滤镜_php-gd图像怀旧色调处理

    使用PHP-GD库实现复古滤镜主要通过色调偏移和色彩调整模拟老照片效果。1. 色调偏黄褐色:先转灰度,再用imagefilter添加棕黄色调;2. 手动像素级调整:逐像素计算灰度并赋予暖色系值,降低饱和度;3. 增强质感:结合对比度降低与轻微模糊提升真实感;4. 示例流程包括加载图像、应用滤镜、输出…

    2026年9月22日
    100
  • VSCode调试FPGA的UART通信(串口数据分析,调试技巧)

    使用VSCode调试FPGA的UART通信,核心是通过其扩展生态集成串口监视与数据分析。首先确保FPGA的UART模块正常工作并输出调试信息,然后在VSCode中安装“Serial Monitor”等串口扩展,配置波特率、端口号以捕获数据。为解析十六进制或自定义协议数据,可结合Python脚本通过t…

    2026年9月22日
    000
  • win10无法修改默认应用_Win10设置中更改默认程序失败的解决方法

    首先通过“设置”应用重新分配默认程序,若无效则使用PowerShell移除预装应用障碍,最后可手动修改注册表重置文件关联,三步解决Windows 10默认程序无法保存问题。 如果您尝试在Windows 10的设置中更改文件类型的默认打开程序,但发现设置无法保存或立即恢复为原程序,则可能是由于系统策略…

    2026年9月22日
    500
  • 如何在mysql中监控用户操作日志

    MySQL默认不记录用户操作日志,但可通过启用通用查询日志记录所有SQL操作,或使用二进制日志追踪数据变更,也可部署审计插件实现细粒度监控,结合独立账号管理和日志轮转策略提升安全性与可追溯性。 MySQL 本身不默认记录用户的所有操作日志,但可以通过启用特定的日志功能来实现对用户行为的监控。以下是几…

    2026年9月22日
    100
  • Android自定义开关UI实现教程

    本文详细介绍了在Android应用中实现自定义开关UI的两种主要方法:一是通过集成第三方库如StickySwitch,快速实现美观且功能丰富的开关;二是通过结合Drawable XML和ToggleButton,实现高度定制化的开关外观。文章提供了详细的代码示例和配置说明,旨在帮助开发者灵活地创建符…

    2026年9月22日
    000
  • 宇宙级编辑器VSCode你真的会用吗?这些隐藏功能让效率翻倍​​

    VSCode的真正潜力在于深度使用命令面板、多光标编辑、用户代码片段、集成终端与任务、自定义快捷键及扩展生态,通过主动探索设置、状态栏功能、官方文档与社区资源,结合个性化主题与高效扩展,将其从基础编辑器升级为高度定制化、自动化、无缝集成的专属开发利器,显著提升编码效率与体验。 你可能以为自己会用VS…

    2026年9月22日
    000
  • Qoder上线提示词增强功能 将开发者从“提示词”的负担中解放出来

    在 agentic coding 的新时代,一个关键挑战日益凸显:要得到卓越的答案,你必须先提出卓越的问题。 对开发者而言,这意味着需要投入大量时间去精心设计给ai的“提示词”。一句笼统的指令,比如“帮我写个函数”,往往只能换来一段简陋甚至存在安全隐患的代码;而一条清晰、结构完整、细节丰富的提示,则…

    2026年9月22日
    000
  • 为什么不应该在多个网站重复使用同一个密码,撞库攻击的原理是什么?

    撞库攻击利用用户重复使用密码的习惯,黑客通过泄露的账号密码批量尝试登录其他网站,一旦某个小网站密码泄露,相同密码的高价值账户也可能被攻破,因此每个网站应使用独立复杂密码并开启双重验证以提升安全。 不建议在多个网站用同一个密码,核心原因就是防范“撞库攻击”。这种攻击利用了用户重复使用密码的习惯,让黑客…

    2026年9月22日
    700
  • 递增一个未定义变量在PHP中会发生什么_PHP未定义变量递增行为解析

    递增未定义变量时PHP会自动初始化为0并触发Notice警告,例如$count++在未定义时值变为1;该机制虽可运行但易引发类型错误和维护难题,建议使用前显式初始化或isset检查以提升代码可靠性。 在PHP中,递增一个未定义的变量不会导致致命错误,而是会触发自动初始化并完成操作。这种行为虽然方便,…

    2026年9月22日
    800
  • 定制Spring Boot Kafka自动配置:构建可复用的配置注解

    本文深入探讨了在Spring Boot应用中,如何通过自定义注解实现Kafka配置的自动化与简化。面对传统@PostConstruct方法注册KafkaTemplate导致Bean无法注入的问题,文章详细介绍了两种更健壮的解决方案:利用META-INF/spring.factories实现真正的自动…

    2026年9月22日
    100
  • VSCode极简配置Python:中文界面、代码补全、虚拟环境

    安装中文语言包实现界面汉化;2. 通过Microsoft官方Python扩展启用Pylance获得智能补全;3. 使用VSCode内置功能创建并管理项目级虚拟环境;4. 推荐Black、isort、GitLens等插件提升开发效率。 用VSCode配置Python开发环境,想要做到中文界面、流畅的代…

    2026年9月22日
    300
  • safari浏览器阅读列表如何使用_safari浏览器阅读列表使用方法

    可通过Safari阅读列表保存网页以便离线阅读。在iPad Air(iPadOS 17)中,打开网页后点击分享按钮,选择“添加到阅读列表”即可缓存页面;之后点击底部书本图标进入阅读列表,查看或管理已保存文章;向左滑动条目可删除,或通过“编辑”批量清理;开启iCloud同步后,登录同一Apple ID…

    2026年9月22日
    500
  • Laravel控制器怎么创建_Laravel控制器创建与请求处理

    Laravel控制器处理请求,使用Artisan命令php artisan make:controller创建,带–resource参数可生成CRUD方法;通过引入Request类获取输入并验证数据,在路由文件中绑定URL与控制器方法,实现请求响应流程。 在 Laravel 中,控制器是…

    2026年9月22日
    600
  • google浏览器如何导入其他浏览器的书签和密码_google浏览器导入书签和密码方法

    首先使用Google浏览器内置导入功能迁移书签和密码,选择源浏览器并勾选数据类型后导入;若无法识别,则通过HTML文件导入书签;密码可手动导出为CSV文件并在密码管理器中导入。 如果您需要将其他浏览器中的书签或密码迁移到 Google 浏览器,可以通过内置的导入功能快速完成数据转移。该操作适用于更换…

    2026年9月22日
    700

发表回复

登录后才能评论
关注微信