在Python中合并并可视化多个groupby聚合条形图

程序猿 • 2025年12月14日 15:12:55 • 用户投稿 • 阅读 0

本文详细介绍了如何使用Pandas和Matplotlib将两个基于相同分组但聚合方式不同的数据集（例如，平均值和总和）合并，并在一个条形图中进行并排可视化。通过数据框合并、Matplotlib的子图功能以及精细的轴标签设置，用户可以清晰地对比不同聚合结果，提升数据分析报告的可读性和专业性。

在数据分析工作中，我们经常需要对数据进行分组聚合，并对不同聚合结果进行比较。例如，我们可能需要同时查看某个类别下数据的平均值和总和。虽然pandas的groupby().agg().plot.barh()可以方便地生成单个聚合的条形图，但要将两个或更多聚合结果并排展示在一个图中，则需要更灵活的方法。本教程将指导您如何通过数据合并和matplotlib的强大功能实现这一目标。

问题场景

假设我们有一个名为day_df的数据集，其中包含年份（yr）、季节（season）和天气情况（weathersit）等分类变量，以及一个数值变量cnt（计数）。我们希望同时可视化按这三个分类变量分组后的cnt的平均值和总和。

直接尝试将两个groupby().agg().plot.barh()的结果合并到一个图中通常会失败，因为它们生成的是独立的图表。此外，如果尝试手动使用plt.bar()或plt.barh()，可能会遇到索引对齐和标签设置的挑战，尤其是在处理多层索引时。

解决方案核心思路

解决此问题的关键在于：

独立聚合数据： 分别计算每个分组的平均值和总和。合并聚合结果： 将这些独立的聚合结果合并到一个Pandas DataFrame中。使用Matplotlib绘制： 利用Matplotlib的barh()（或bar()）函数在同一个坐标轴上绘制合并后的数据，并通过调整条形的位置和宽度实现并排显示。

详细步骤与代码示例

1. 准备数据并进行分组聚合

首先，我们需要对原始数据进行两次分组聚合，一次计算cnt的平均值，另一次计算cnt的总和。为了方便后续合并，聚合后需要使用reset_index()将多层索引转换为普通列。

立即学习“Python免费学习笔记（深入）”；

import pandas as pdimport numpy as npimport matplotlib.pyplot as plt# 假设 day_df 是您的原始数据框# 为了教程的可运行性，这里创建一个模拟数据框data = {    'yr': np.random.choice([0, 1], 100),    'season': np.random.choice([1, 2, 3, 4], 100),    'weathersit': np.random.choice([1, 2, 3], 100),    'cnt': np.random.randint(100, 1000, 100)}day_df = pd.DataFrame(data)# 计算每个分组的平均值并重置索引day_mean_dataframe = day_df.groupby(by=["yr", "season", "weathersit"]).agg({"cnt": "mean"}).reset_index()# 计算每个分组的总和并重置索引day_sum_dataframe = day_df.groupby(by=["yr", "season", "weathersit"]).agg({"cnt": "sum"}).reset_index()print("平均值数据框（部分）：")print(day_mean_dataframe.head())print("n总和数据框（部分）：")print(day_sum_dataframe.head())

2. 合并聚合后的数据框

接下来，我们将这两个聚合后的数据框合并。由于它们共享相同的分组键（yr, season, weathersit），我们可以使用pd.merge()函数进行内连接。为了区分聚合结果，我们使用suffixes参数为cnt列添加后缀。

# 合并两个数据框merged_df = pd.merge(day_mean_dataframe, day_sum_dataframe,                      on=["yr", "season", "weathersit"],                      suffixes=('_mean', '_sum'))print("n合并后的数据框（部分）：")print(merged_df.head())

merged_df现在包含每个分组的cnt_mean和cnt_sum两列，方便我们进行统一绘图。

3. 使用Matplotlib绘制并排条形图

现在，我们可以使用Matplotlib的barh()函数来绘制水平并排条形图。

# 创建图和子图对象fig, ax = plt.subplots(figsize=(12, 8)) # 调整图大小以适应更多标签# 为每个分组创建一个位置数组r1 = np.arange(len(merged_df))height1 = 0.4 # 设置条形的高度，用于 barh# 绘制平均值条形ax.barh(r1, merged_df["cnt_mean"], height=height1, label='平均值 (Mean)', color='skyblue')# 绘制总和条形，将其位置偏移，实现并排效果ax.barh(r1 + height1, merged_df["cnt_sum"], height=height1, label='总和 (Sum)', color='lightcoral')# 设置Y轴刻度标签# 将刻度放在两个条形之间ax.set_yticks(r1 + height1 / 2) # 生成可读性强的Y轴标签，结合所有分组键ax.set_yticklabels([f'年份: {row.yr}, 季节: {row.season}, 天气: {row.weathersit}'                     for _, row in merged_df.iterrows()])# 添加图例、轴标签和标题ax.set_xlabel('计数 (Count)')ax.set_ylabel('分组类别 (Group Categories)')ax.set_title('不同分组下计数平均值与总和的对比')ax.legend()# 调整布局，防止标签重叠plt.tight_layout()plt.show()

代码说明与注意事项

reset_index()的重要性： 在groupby().agg()之后调用reset_index()是关键一步。它将多层索引转换为普通列，使得后续的pd.merge()操作更加直接，并且在设置yticklabels时也能方便地访问各个分组键。pd.merge()的suffixes参数： 使用suffixes=(‘_mean’, ‘_sum’)可以避免合并后出现同名列冲突，并清晰地标识出每个聚合结果的来源。np.arange(len(merged_df))： 这创建了一个等差数列，作为每个分组在Y轴上的基准位置。height1和位置偏移： height1定义了每个水平条形的高度。通过将第二个条形的位置设置为r1 + height1，可以使其紧邻第一个条形并排显示。如果使用plt.bar()绘制垂直条形图，则需要调整width和x轴位置。ax.set_yticks()和ax.set_yticklabels()： 对于水平条形图，Y轴代表分组类别。我们需要手动设置Y轴的刻度位置（r1 + height1 / 2将刻度标签置于两个条形之间）和刻度标签。通过遍历merged_df并格式化字符串，可以创建包含所有分组信息的清晰标签。plt.tight_layout()： 这个函数会自动调整子图参数，以给定的填充方式，使之适应图的布局，通常用于防止标签或标题重叠。可读性： 选择合适的figsize、height（或width）、颜色和字体大小，可以显著提升图表的可读性。对于分组类别较多的情况，水平条形图（barh）通常比垂直条形图（bar）更适合显示长标签。

总结

通过上述步骤，我们成功地将两个基于相同分组但聚合方式不同的数据集（平均值和总和）合并，并在一个清晰的水平条形图中进行了并排可视化。这种方法不仅解决了直接绘制的难题，还提供了高度的灵活性和定制性，使您能够创建专业且易于理解的数据分析图表。掌握这种技术，对于进行多维度数据比较和报告展示非常有价值。

以上就是在Python中合并并可视化多个groupby聚合条形图的详细内容，更多请关注创想鸟其它相关文章！

版权声明：本文内容由互联网用户自发贡献，该文观点仅代表作者本人。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容，请发送邮件至 chuangxiangniao@163.com 举报，一经查实，本站将立刻删除。
发布者：程序猿，转转请注明出处：https://www.chuangxiangniao.com/p/1375654.html

go igs python

打赏

微信扫一扫

支付宝扫一扫

0 0

关于作者

程序猿签约作者

414.1K 文章

0 评论

2 粉丝

这个人很懒，什么都没有留下～

python中如何安装pyenv

上一篇 2025年12月14日 15:12:49

Python数据可视化：组合多聚合结果的条形图

下一篇 2025年12月14日 15:12:58

用户投稿

如何解决本地图片在使用 mask JS 库时出现的跨域错误？

如何跨越localhost使用本地图片？问题: 在本地使用mask js库时，引入本地图片会报跨域错误。解决方案: 要解决此问题，需要使用本地服务器启动文件，以http或https协议访问图片，而不是使用file://协议。例如： python -m http.server 8000 然后，可以…

程序猿
2025年12月24日
4000
用户投稿

使用 Mask 导入本地图片时，如何解决跨域问题？

跨域疑难：如何解决 mask 引入本地图片产生的跨域问题？在使用 mask 导入本地图片时，你可能会遇到令人沮丧的跨域错误。为什么会出现跨域问题呢？让我们深入了解一下： mask 框架假设你以 http(s) 协议加载你的 html 文件，而当使用 file:// 协议打开本地文件时，就会产生跨域…

程序猿
2025年12月24日
3000
用户投稿

正则表达式在文本验证中的常见问题有哪些？

正则表达式助力文本输入验证在文本输入框的验证中，经常遇到需要限定输入内容的情况。例如，输入框只能输入整数，第一位可以为负号。对于不会使用正则表达式的人来说，这可能是个难题。下面我们将提供三种正则表达式，分别满足不同的验证要求。 1. 可选负号，任意数量数字如果输入框中允许第一位为负号，后面可输入…

程序猿
2025年12月24日
3000
用户投稿

为什么多年的经验让我选择全栈而不是平均栈

在全栈和平均栈开发方面工作了 6 年多，我可以告诉您，虽然这两种方法都是流行且有效的方法，但它们满足不同的需求，并且有自己的优点和缺点。这两个堆栈都可以帮助您创建 Web 应用程序，但它们的实现方式却截然不同。如果您在两者之间难以选择，我希望我在两者之间的经验能给您一些有用的见解。在这篇文章中，我…

程序猿
2025年12月24日
3000
用户投稿

姜戈顺风

本教程演示如何在新项目中从头开始配置 django 和 tailwindcss。 django 设置创建一个名为 .venv 的新虚拟环境。 # windows$ python -m venv .venv$ .venvscriptsactivate.ps1(.venv) $# macos/linu…

程序猿
2025年12月24日
1000
用户投稿

花 $o 学习这些编程语言或免费

→ Python → JavaScript → Java → C# → 红宝石 → 斯威夫特 → 科特林 → C++ → PHP → 出发 → R → 打字稿 []https://x.com/e_opore/status/1811567830594388315?t=_j4nncuiy2wfbm7ic…

程序猿
2025年12月24日
0000
用户投稿

html5怎么导视频_html5用video标签导出或Canvas转DataURL获视频【导出】

HTML5无法直接导出video标签内容，需借助Canvas捕获帧并结合MediaRecorder API、FFmpeg.wasm或服务端协同实现。MediaRecorder适用于WebM格式前端录制；FFmpeg.wasm支持MP4等格式及精细编码控制；服务端方案适合高负载场景。如果您希望在网页…

程序猿
2025年12月23日
4000
用户投稿

如何查看编写的html_查看自己编写的HTML文件效果【效果】

要查看HTML文件的浏览器渲染效果，需确保文件以.html为扩展名保存、用浏览器直接打开、利用开发者工具调试、必要时启用本地HTTP服务器、或使用编辑器实时预览插件。如果您编写了HTML代码，但无法直观看到其在浏览器中的实际渲染效果，则可能是由于文件未正确保存、未使用浏览器打开或文件扩展名设置错误…

程序猿
2025年12月23日
4000
用户投稿

HTML5怎么制作广告_HTML5用动画与交互制横幅或弹窗广告吸引点击【制作】

可利用HTML5结合CSS3动画、Canvas、Web Animations API、Intersection Observer和video标签制作互动广告：一用@keyframes实现横幅入场动画；二用Canvas绘制并响应悬停；三用Web Animations API控制弹窗时序；四用Inter…

程序猿
2025年12月23日
3000
用户投稿

html5怎么打包运行_HT5用Webpack或Gulp打包后浏览器打开运行【打包】

应通过 HTTP 服务运行打包后的 HTML5 页面，而非双击打开：一、Webpack 配 webpack-dev-server 启动本地服务；二、Gulp 配 BrowserSync 提供实时重载；三、用 Python/Node.js 轻量 HTTP 工具托管 dist 目录；四、仅当必须双击运行…

程序猿
2025年12月23日
1000
用户投稿

html5文件运行不出来怎么回事_析html5文件运行失败原因【解析】

首先检查文件扩展名和编码格式，确保为.html且使用UTF-8编码；接着验证HTML5结构完整性，包含及正确闭合的标签；然后排查外部资源路径是否正确，利用开发者工具查看404错误；排除浏览器兼容性问题，优先在现代浏览器中测试并避免未广泛支持的API；检查JavaScript语法错误与执行顺序，确保脚…

程序猿
2025年12月23日
1000
用户投稿

html5怎么插入文档_HT5用object或iframe嵌入PDF/Word文档显示【插入】

可在HTML5中用iframe或object标签嵌入PDF，需设宽高及可访问路径；Word文档需借OneDrive等第三方服务代理渲染；须处理跨域限制并提供下载降级方案。如果您希望在HTML5页面中嵌入PDF或Word文档并直接显示，可以使用或标签实现。以下是几种可行的嵌入方法：一、使用ifra…

程序猿
2025年12月23日
3000
用户投稿

html5怎么引入字体_HTML5用@font-face引入本地或网络字体文件【引入】

需用CSS的@font-face规则加载自定义字体，步骤包括：准备WOFF2/WOFF/TTF多格式文件并存放至项目目录；在CSS中为每种字重和样式单独声明@font-face；通过font-family应用字体；可选Google Fonts外链方式；添加font-display: swap缓解FO…

程序猿
2025年12月23日
1000
用户投稿

怎么用html5链接_html5用a标签href属性给文字或图片加跳转链接【使用】

HTML5中使用a元素配合href属性实现跳转：可为文字、图片添加超链接；支持绝对URL、相对路径及页面内锚点；通过target=”_blank”和rel=”noopener”可在新标签页安全打开链接。如果您希望在网页中为文字或图片添加可点击的跳转功…

程序猿
2025年12月23日
4000
用户投稿

如何运行html代码_html代码运行方法【步骤】

HTML代码需保存为.html文件并用浏览器打开才能正确显示；若含AJAX或外部资源则需本地服务器；临时测试可用开发者工具；在线编辑器支持即时预览。如果您编写了一段HTML代码，但无法在浏览器中正确显示效果，则可能是由于文件未以正确的格式保存或未通过浏览器打开。以下是运行HTML代码的具体步骤： …

程序猿
2025年12月23日
1000
用户投稿

html如何学好_学好HTML的关键点与练习【关键】

学好HTML需掌握基础语法结构、熟记语义化标签、通过真实项目练习、验证代码规范性并拆解优质网页源码。具体包括：标准HTML5骨架、正确使用header/nav/main等标签、构建个人页与新闻页、W3C校验及阅读mozilla.org源码。如果您希望掌握HTML语言并能熟练构建网页结构，则需要聚焦…

程序猿
2025年12月23日
2000
用户投稿

flash怎么变为html5_用Swiffy或CreateJS将Flash动画转HTML5【转换】

可采用四种方法迁移Flash动画至HTML5：一、用Swiffy转换SWF为Canvas/JS；二、用CreateJS从Animate导出HTML5 Canvas；三、用Lottie+Bodymovin将AE版动画转JSON播放；四、用Ruffle模拟器直接运行原SWF。如果您希望将现有的Flas…

程序猿
2025年12月23日
1000
用户投稿

html5怎样插入可预览文档_html5文档预览功能实现与控件选择【步骤】

HTML5文档预览有五种方式：一、用iframe嵌入Google Docs等在线服务；二、用embed/object标签加载同源PDF；三、集成PDF.js实现自定义渲染；四、用FileReader配合Office Online Viewer预览Office文件；五、后端转HTML再前端加载。如果…

程序猿
2025年12月23日
1000
用户投稿

html如何上传到空间_将HTML文件上传到网站空间步骤【步骤】

HTML文件无法上网访问是因为未上传至网站空间，需通过FTP客户端、主机控制面板、Git部署或SFTP命令行四种方式之一上传到服务器根目录。如果您已经编写完成一个HTML文件，但无法在互联网上访问它，则可能是由于该文件尚未上传至网站空间。以下是将HTML文件上传到网站空间的具体步骤：一、使用FT…

程序猿
2025年12月23日
4000
用户投稿

如何敲代码html5_正确敲写HTML5代码的步骤与规范【步骤】

编写HTML5代码需遵循五步规范：一、声明并构建含lang属性、head与body的结构；二、用header、nav、main等语义化元素替代div；三、正确嵌套文本元素，空元素不闭合斜杠且img必有alt；四、link引入CSS，script合理使用async/defer；五、通过W3C验证并确保…

程序猿
2025年12月23日
3000