使用Pandas高效进行DataFrame多列映射与合并

程序猿 • 2025年12月14日 23:58:19 • 好文分享 • 阅读 1

本文详细介绍了如何使用Pandas库将多个DataFrame的列数据进行转换、映射和合并，以实现复杂的数据重构需求。教程涵盖了列赋值、字符串操作、列删除以及DataFrame垂直拼接等核心操作，旨在帮助读者高效地整合不同结构的数据，并处理合并过程中可能出现的缺失值。

在数据分析和处理过程中，我们经常会遇到需要从不同来源或不同结构的DataFrame中提取、转换并合并数据的情况。例如，一个DataFrame可能包含主信息，而另一个DataFrame则包含补充信息，我们需要将这些补充信息映射到主信息的特定列，并最终整合到一起。本教程将通过一个具体的示例，详细讲解如何利用Pandas库实现这种多列映射与DataFrame合并的操作。

1. 准备初始数据

首先，我们创建两个示例DataFrame，分别命名为 df1 和 df2，它们代表了我们即将操作的原始数据。

import pandas as pdimport numpy as np# 第一个DataFramedata1 = {    'name': ['smith row', 'sam smith', 'susan storm'],    'age': [26, 30, 25],    'sex': ['male', 'male', 'female']}df1 = pd.DataFrame(data1)print("df1 (原始数据):")print(df1)print("-" * 30)# 第二个DataFrame，包含额外的'nick_name'列data2 = {    'name': ['smith row', 'sam smith', 'susan storm'],    'age': [26, 30, 25],    'sex': ['male', 'male', 'female'],    'nick_name': ['smity', 'sammy', 'suanny']}df2 = pd.DataFrame(data2)print("df2 (包含昵称的补充数据):")print(df2)print("-" * 30)

输出示例:

df1 (原始数据):        name  age     sex0  smith row   26    male1  sam smith   30    male2  susan storm  25  female------------------------------df2 (包含昵称的补充数据):          name  age     sex nick_name0    smith row   26    male     smity1    sam smith   30    male     sammy2  susan storm   25  female    suanny------------------------------

我们的目标是将 df2 中的 nick_name 列作为新的 name 信息，同时将 sex 列简化为首字母，并最终与 df1 合并，形成一个统一的DataFrame。

2. 对第二个DataFrame进行数据转换与列映射

为了达到预期的合并效果，我们需要对 df2 进行一系列的转换操作。这些操作包括：

将 nick_name 列的值赋给 name 列。将 sex 列的值转换为其首字母。删除不再需要的 age 和 nick_name 列。

# 步骤1: 将'nick_name'列的值赋给'name'列df2_transformed = df2.copy() # 创建副本以避免修改原始df2df2_transformed['name'] = df2_transformed['nick_name']# 步骤2: 将'sex'列的值转换为其首字母# 使用.str[0]可以方便地提取字符串的第一个字符df2_transformed['sex'] = df2_transformed['sex'].str[0]# 步骤3: 删除不再需要的'age'和'nick_name'列df2_transformed = df2_transformed.drop(columns=['age', 'nick_name'])print("df2_transformed (转换后的数据):")print(df2_transformed)print("-" * 30)

输出示例:

df2_transformed (转换后的数据):     name sex0   smity   m1   sammy   m2  suanny   f------------------------------

经过这些转换，df2_transformed 现在只包含 name 和 sex 列，并且数据格式符合我们合并的要求。

3. 合并DataFrame

现在，我们可以使用 pd.concat() 函数将 df1 和转换后的 df2_transformed 进行垂直合并。

# 使用pd.concat()进行垂直合并# ignore_index=True 会重置合并后的索引，使其从0开始连续编号final_df = pd.concat([df1, df2_transformed], ignore_index=True)print("final_df (最终合并结果):")print(final_df)

输出示例:

final_df (最终合并结果):          name   age     sex0    smith row  26.0    male1    sam smith  30.0    male2  susan storm  25.0  female3        smity   NaN       m4        sammy   NaN       m5       suanny   NaN       f

4. 结果分析与注意事项

观察最终合并结果 final_df，我们可以看到：

df1 的所有行都被完整保留。df2_transformed 的行被追加到了 df1 的下方。由于 df2_transformed 在合并前已经移除了 age 列，因此在合并后的 final_df 中，对应 df2_transformed 来源的行在 age 列显示为 NaN（Not a Number），表示缺失值。这是 pd.concat() 处理列不匹配时的默认行为。sex 列的数据类型在合并后可能会因为 male/female 和 m/f 的混合而变为 object 类型，这是符合预期的。

注意事项与最佳实践：

列名一致性： 在进行 pd.concat() 垂直合并时，如果两个DataFrame的列名不完全一致，Pandas会默认进行外连接（union），即保留所有唯一的列名，并在缺失的列位置填充 NaN。因此，在合并前确保目标列名一致是关键。数据类型： 合并操作可能会导致列的数据类型发生变化，尤其是在存在 NaN 的情况下，整数列可能会被转换为浮点数类型。在合并后，如果需要，可能需要进行数据类型转换（例如，使用 df[‘age’].fillna(0).astype(int) 来填充 NaN 并转换为整数）。缺失值处理： 合并后产生的 NaN 值通常需要进一步处理，例如使用 fillna() 填充默认值，或使用 dropna() 删除含有 NaN 的行。具体处理方法取决于业务需求。ignore_index=True： 这个参数在垂直合并时非常有用，它会生成一个新的、连续的索引，避免了原始DataFrame索引重复或混乱的问题。动态映射： 虽然本示例是硬编码的列操作，但在实际应用中，如果需要处理大量或结构相似的DataFrame，可以考虑编写函数或使用循环来动态执行列的映射、转换和删除操作，从而提高代码的复用性和灵活性。

总结

本教程详细演示了如何利用Pandas库对DataFrame进行多步操作，包括列的赋值、字符串处理、列的删除以及最终的DataFrame垂直合并。通过这些技术，我们可以有效地重构和整合不同来源的数据，以满足复杂的数据分析需求。理解这些核心操作及其对数据结构和数据类型的影响，是进行高效数据清洗和预处理的关键。

以上就是使用Pandas高效进行DataFrame多列映射与合并的详细内容，更多请关注创想鸟其它相关文章！

版权声明：本文内容由互联网用户自发贡献，该文观点仅代表作者本人。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容，请发送邮件至 chuangxiangniao@163.com 举报，一经查实，本站将立刻删除。
发布者：程序猿，转转请注明出处：https://www.chuangxiangniao.com/p/1382492.html

数据清洗编码

打赏

微信扫一扫

支付宝扫一扫

0 0

关于作者

程序猿签约作者

414.1K 文章

0 评论

2 粉丝

这个人很懒，什么都没有留下～

优化Pandas Groupby操作：提升大数据处理效率的策略

上一篇 2025年12月14日 23:58:13

从特定父级Div中高效提取Anchor标签的Href属性

下一篇 2025年12月14日 23:58:30

好文分享

css怎么设置文件编码

在css中，可以使用“@charset”规则来设置编码，语法格式“@charset “字符编码类型”;”。“@charset”规则可以指定样式表中使用的字符编码，它必须是样式表中的第一个元素，并且不能以任何字符开头。本教程操作环境：windows7系统、CSS3&&…

程序猿
2025年12月24日
0000
好文分享

响应式HTML5按钮适配不同屏幕方法【方法】

实现响应式HTML5按钮需五种方法：一、CSS媒体查询按max-width断点调整样式；二、用rem/vw等相对单位替代px；三、Flexbox控制容器与按钮伸缩；四、CSS变量配合requestAnimationFrame优化的JS动态适配；五、Tailwind等框架的响应式工具类。如果您希望H…

程序猿
2025年12月23日
1000
好文分享

html5怎么导视频_html5用video标签导出或Canvas转DataURL获视频【导出】

HTML5无法直接导出video标签内容，需借助Canvas捕获帧并结合MediaRecorder API、FFmpeg.wasm或服务端协同实现。MediaRecorder适用于WebM格式前端录制；FFmpeg.wasm支持MP4等格式及精细编码控制；服务端方案适合高负载场景。如果您希望在网页…

程序猿
2025年12月23日
4000
好文分享

html5怎么加php_html5用Ajax与PHP后端交互实现数据传递【交互】

HTML5不能直接运行PHP，需通过Ajax与PHP通信：前端用fetch发送请求，PHP接收处理并返回JSON，前端解析响应更新DOM；注意跨域、编码、CSRF防护和输入过滤。 HTML5 本身是前端标记语言，不能直接运行 PHP 代码，但可以通过 Ajax（异步 JavaScript）与 PHP…

程序猿
2025年12月23日
3000
html5怎么引用js_HTML5用外链或内嵌JS代码引用脚本【引用】

HTML5中执行JavaScript需通过外链或内嵌方式引入：一、外链用，支持defer/async；二、内嵌将代码写入间，推荐置于body底部；三、type属性默认可省略；四、模块化使用type=”module”支持ES6 import/export。 <img sr…

程序猿
好文分享 2025年12月23日
1000
好文分享

html5文件运行不出来怎么回事_析html5文件运行失败原因【解析】

首先检查文件扩展名和编码格式，确保为.html且使用UTF-8编码；接着验证HTML5结构完整性，包含及正确闭合的标签；然后排查外部资源路径是否正确，利用开发者工具查看404错误；排除浏览器兼容性问题，优先在现代浏览器中测试并避免未广泛支持的API；检查JavaScript语法错误与执行顺序，确保脚…

程序猿
2025年12月23日
1000
好文分享

html5怎么读取文件_html5用FileReader API读取本地文件内容或属性【读取】

HTML5的FileReader API支持读取本地文件内容及获取基本信息：一、通过input type=”file”获取File对象；二、用readAsText读取文本；三、用readAsDataURL生成Data URL预览资源；四、用readAsArrayBuffer读…

程序猿
2025年12月23日
1000
好文分享

html5怎么写css_html5用style标签内嵌或外部css文件编写样式【编写】

可通过内嵌CSS、引入外部CSS文件或使用行内style属性为HTML5页面元素添加样式：一、用标签在中写CSS；二、用标签引用外部.css文件；三、在元素标签中直接写style属性。如果您希望在HTML5文档中为页面元素添加样式，则可以通过内嵌CSS或引入外部CSS文件来实现。以下是具体操作方法…

程序猿
2025年12月23日
0000
好文分享

html5怎么引入字体_HTML5用@font-face引入本地或网络字体文件【引入】

需用CSS的@font-face规则加载自定义字体，步骤包括：准备WOFF2/WOFF/TTF多格式文件并存放至项目目录；在CSS中为每种字重和样式单独声明@font-face；通过font-family应用字体；可选Google Fonts外链方式；添加font-display: swap缓解FO…

程序猿
2025年12月23日
1000
好文分享

html5怎么引用图标_html5用iconfont或img标签引用图标文件显示【引用】

HTML5图标显示异常可因路径错误、引用不当或字体未加载，解决方法包括：一、用iconfont类名引用；二、用Unicode字符引用；三、用img标签引用位图；四、内联SVG图标；五、预加载字体文件。如果您在HTML5页面中需要显示图标，但图标无法正常加载或显示效果不符合预期，则可能是由于图标文件…

程序猿
2025年12月23日
0000
好文分享

html5如何插入txt纯文本_html5txt文本嵌入与编码设置【实操】

可通过iframe、fetch+pre、object标签或服务端预处理四种方式在HTML5中显示外部TXT文件，需重点处理字符编码（如UTF-8声明、BOM、响应头）并防范XSS风险。如果您希望在HTML5页面中显示外部TXT纯文本文件的内容，浏览器默认不支持直接嵌入TXT文件为可渲染内容，必须通…

程序猿
2025年12月23日
0000
好文分享

怎么用html5链接_html5用a标签href属性给文字或图片加跳转链接【使用】

HTML5中使用a元素配合href属性实现跳转：可为文字、图片添加超链接；支持绝对URL、相对路径及页面内锚点；通过target=”_blank”和rel=”noopener”可在新标签页安全打开链接。如果您希望在网页中为文字或图片添加可点击的跳转功…

程序猿
2025年12月23日
4000
好文分享

如何运行html代码_html代码运行方法【步骤】

HTML代码需保存为.html文件并用浏览器打开才能正确显示；若含AJAX或外部资源则需本地服务器；临时测试可用开发者工具；在线编辑器支持即时预览。如果您编写了一段HTML代码，但无法在浏览器中正确显示效果，则可能是由于文件未以正确的格式保存或未通过浏览器打开。以下是运行HTML代码的具体步骤： …

程序猿
2025年12月23日
1000
好文分享

html5怎么全部加密_html5用JS混淆或webpack加密工具打包加密代码【加密】

可通过五种技术实现HTML5中JS混淆加密：一、javascript-obfuscator工具；二、Webpack+webpack-obfuscator插件；三、Terser插件高级配置；四、HTML内联Base64动态解密；五、服务端Node.js实时混淆注入。如果您希望对 HTML5 页面中的…

程序猿
2025年12月23日
0000
好文分享

html5音频怎么写_HT5用audio标签src引音频加controls播放【编写】

HTML5的标签可嵌入音频并提供播放控制：基础写法用src+controls；增强兼容性需嵌套多个带type的标签；提升可访问性应添加fallback文本及autoplay等布尔属性。如果您希望在网页中嵌入一段音频并提供播放控制功能，则可以使用 HTML5 的标签。以下是实现该功能的具体方法： …

程序猿
2025年12月23日
0000
好文分享

html5怎么交css_html5用link外链或style内嵌引入css样式生效【引入】

CSS样式未生效时，应依次检查link外链路径与MIME类型、style内嵌位置与语法、行内style属性格式，并通过开发者工具的Elements、Styles和Computed面板验证加载与优先级。如果您在HTML5文档中尝试引入CSS样式但页面未按预期渲染，则可能是由于CSS引入方式不正确或路…

程序猿
2025年12月23日
0000
好文分享

html5怎么插入空格_HTML5用或CSS white-space保留空格不换行【插入】

HTML5中多个空格被合并为一个，可用、标签、CSS white-space属性、margin/padding或Unicode空格解决：适合少量空格；保留所有空白和换行；white-space: pre/pre-wrap控制空格与换行；margin/padding用于布局对齐；Unicode空格…

程序猿
2025年12月23日
0000
好文分享

html5怎么换颜色_HT5用JS改CSS color或background-color切换颜色【更换】

可通过操作DOM元素的style属性动态修改文本或背景颜色，方法包括：一、直接修改内联样式；二、切换预定义CSS类；三、修改CSS自定义属性；四、用getComputedStyle读取并智能计算新颜色；五、通过setAttribute设置style字符串。如果您希望在HTML5页面中通过JavaS…

程序猿
2025年12月23日
1000
好文分享

如何敲代码html5_正确敲写HTML5代码的步骤与规范【步骤】

编写HTML5代码需遵循五步规范：一、声明并构建含lang属性、head与body的结构；二、用header、nav、main等语义化元素替代div；三、正确嵌套文本元素，空元素不闭合斜杠且img必有alt；四、link引入CSS，script合理使用async/defer；五、通过W3C验证并确保…

程序猿
2025年12月23日
1000
好文分享

如何制作html5_制作符合HTML5标准的网页设计指南【设计】

符合HTML5规范的网页需：一、用和等结构；二、以替代div；三、用及嵌入媒体并设备用文本；四、用type=”email”/required等增强表单；五、正确使用Canvas与SVG绘图。如果您希望创建一个符合HTML5规范的网页，但不确定如何正确使用语义化标签、文档结构…

程序猿
2025年12月23日
0000