如何序列化和反序列化一个Python对象(pickle)?

pickle能序列化几乎所有Python对象,包括自定义类实例、函数等,但无法处理文件句柄、网络连接等外部资源,且存在跨版本兼容性问题;其反序列化过程可执行任意代码,因此不适用于不信任的数据源,易导致安全风险;相比JSON,pickle支持更丰富的Python类型且性能更高,但缺乏跨语言兼容性和安全性,JSON则更适合安全、可读、跨平台的数据交换场景。

如何序列化和反序列化一个python对象(pickle)?

Python的

pickle

模块是标准库中一个非常强大的工具,它能将几乎任何Python对象序列化(即转换为字节流,以便存储到文件或通过网络传输)和反序列化(即从字节流中恢复原始对象)。这个过程就像是给你的Python对象拍了一张“快照”,然后可以在需要的时候再“还原”出来。

使用

pickle

进行序列化和反序列化其实非常直观。你需要用到

pickle.dump()

来将对象序列化并写入文件,以及

pickle.load()

来从文件中读取字节流并反序列化回对象。

import pickle# 假设我们有一个复杂的Python对象class MyCustomObject:    def __init__(self, name, value):        self.name = name        self.value = value        self.data = {'key': [1, 2, 3], 'status': True}    def greet(self):        return f"Hello, I'm {self.name} with value {self.value}."    def __repr__(self):        return f"MyCustomObject(name='{self.name}', value={self.value})"my_object = MyCustomObject("示例对象", 123.45)another_data = {'numbers': [10, 20, 30], 'text': '这是一个字典'}# 1. 序列化 (Pickling)# 将对象写入文件,通常使用二进制写入模式 'wb'file_path = 'my_data.pickle'try:    with open(file_path, 'wb') as f:        pickle.dump(my_object, f)        pickle.dump(another_data, f) # 可以在同一个文件中dump多个对象    print(f"对象已成功序列化到 '{file_path}'")except Exception as e:    print(f"序列化失败: {e}")# 2. 反序列化 (Unpickling)# 从文件读取字节流并反序列化回对象,使用二进制读取模式 'rb'try:    with open(file_path, 'rb') as f:        loaded_object = pickle.load(f)        loaded_data = pickle.load(f) # 注意:需要按照dump的顺序load    print(f"n对象已成功从 '{file_path}' 反序列化。")    print(f"加载的自定义对象: {loaded_object}")    print(f"对象类型: {type(loaded_object)}")    print(f"调用方法: {loaded_object.greet()}")    print(f"加载的字典数据: {loaded_data}")except FileNotFoundError:    print(f"错误: 文件 '{file_path}' 未找到。")except Exception as e:    print(f"反序列化失败: {e}")# 如果只是想将对象序列化成字节串而不是写入文件,可以使用 pickle.dumps() 和 pickle.loads()# dumps (dump string)pickled_bytes = pickle.dumps(my_object)print(f"n对象序列化为字节串: {pickled_bytes[:50]}...") # 只显示前50个字节# loads (load string)restored_object_from_bytes = pickle.loads(pickled_bytes)print(f"从字节串反序列化的对象: {restored_object_from_bytes}")print(f"调用方法: {restored_object_from_bytes.greet()}")
pickle

到底能序列化哪些类型的对象?它有什么限制吗?

在我看来,

pickle

的强大之处在于它几乎可以序列化Python中所有内建的数据类型——列表、字典、元组、集合、数字、字符串、布尔值,这些自然不在话下。更厉害的是,它还能处理自定义类的实例、函数、方法,甚至是模块。这意味着你可以保存一个程序的运行状态,包括各种复杂的数据结构和它们的行为,然后在未来某个时间点精确地恢复它们。我曾经用它来保存机器学习模型的训练状态,这样就不必每次都从头开始训练了,非常方便。

立即学习“Python免费学习笔记(深入)”;

不过,它也不是万能的,有一些限制需要注意。首先,它不能序列化那些依赖于操作系统资源的对象,比如打开的文件句柄、网络连接、数据库连接等。这些对象的状态通常是瞬态的,并且与外部环境紧密耦合,无法简单地打包和恢复。其次,如果你的自定义类实例中包含了C扩展模块创建的对象,那么这些对象可能无法正确序列化,除非C扩展本身提供了特殊的处理机制。再者,当你在一个Python版本中序列化了一个对象,试图在另一个不同版本(尤其是大版本差异)的Python环境中反序列化时,可能会遇到兼容性问题,因为Python内部的对象表示方式可能发生了变化。这就像你用一个老版本的软件保存的文件,新版本可能无法完全兼容。

为什么说使用

pickle

序列化“不安全”?我们应该如何规避风险?

提到

pickle

,安全性是一个绕不开的话题,而且这真的很重要,我个人觉得甚至比它的功能本身更值得关注。为什么不安全?简单来说,反序列化一个

pickle

字节流,本质上就是在执行这段字节流所代表的Python代码。

pickle

的设计允许它在恢复对象时执行任意Python代码,这是它能够处理复杂对象图的关键所在。如果这个字节流来自一个不信任的源,那么攻击者就可以构造恶意的

pickle

数据,当你的程序对其进行反序列化时,就可能导致任意代码执行,比如删除文件、窃取数据,甚至完全控制你的系统。这可不是开玩笑的。

规避风险的核心原则就一个字:“信”。你绝不能反序列化来自不信任或未知来源的

pickle

数据。这一点怎么强调都不过分。如果你的应用需要接收外部数据,并且你无法保证这些数据的来源是绝对安全的,那么就不要使用

pickle

。退一步讲,如果你真的需要在受控环境中处理来自外部的

pickle

数据(这种情况很少见且风险极高),你可能需要考虑在沙箱环境中进行反序列化,或者严格限制

pickle.load

可以加载的类(Python 3.8+的

pickle.Unpickler

提供了

find_class

方法来做这个,但实现起来非常复杂且容易出错)。但我个人建议,只要有其他选择,就不要去冒这个险。对于外部数据交换,JSON、Protocol Buffers或YAML等是更安全、更通用的选择。

pickle

和 JSON 在序列化场景下各有什么优势和劣势?什么时候该用哪个?

pickle

和JSON都是序列化工具,但它们的设计哲学和适用场景大相径庭,我经常看到有人把它们混淆,或者在不合适的场景下使用。理解它们的差异,才能做出正确的选择。

pickle

的优势:

Python原生对象的支持: 它可以序列化几乎所有Python对象,包括自定义类的实例、函数、方法等,无需额外的编码/解码逻辑。这对于需要在Python程序内部持久化复杂对象非常方便。性能: 对于复杂的Python对象结构,

pickle

通常比JSON更快,因为它直接操作Python的内部表示。保持对象完整性: 它能完整地保存Python对象的类型信息和结构,反序列化后能得到一个功能完全相同的对象。

pickle

的劣势:

安全性: 如前所述,反序列化不信任的

pickle

数据是巨大的安全隐患。语言绑定:

pickle

是Python特有的。它生成的字节流无法被其他编程语言直接理解和反序列化。如果你需要跨语言数据交换,

pickle

完全不适用。可读性差: 生成的是二进制数据,不具备人类可读性,不方便调试。

JSON的优势:

跨语言兼容性: JSON(JavaScript Object Notation)是一种轻量级的数据交换格式,几乎所有主流编程语言都支持解析和生成JSON。这是它最大的优势。安全性: JSON只支持基本的数据类型(字符串、数字、布尔值、数组、对象、null),不包含任何可执行代码,因此从安全角度来看,处理来自不信任源的JSON数据要比

pickle

安全得多。人类可读性: JSON是文本格式,结构清晰,易于阅读和调试。

JSON的劣势:

数据类型限制: JSON只能表示基本的数据类型。它无法直接序列化Python的自定义类实例、函数、日期时间对象、集合等。如果你想序列化这些,需要编写自定义的编码器和解码器,将它们转换为JSON支持的类型。性能: 对于非常复杂的Python对象,如果需要大量自定义编码,其性能可能不如

pickle

什么时候该用哪个?

我的建议是:

使用

pickle

的场景:当你需要在纯Python环境中持久化复杂的Python对象(例如机器学习模型、复杂的配置对象、程序状态),并且你完全信任数据来源时。你不需要与其他语言进行数据交互。使用JSON的场景:当你需要在不同编程语言或系统之间交换数据时。这是JSON的黄金应用场景。当你需要处理来自外部或不信任来源的数据时。当你只需要序列化基本的数据类型,或者可以接受为自定义类型编写简单的编码/解码逻辑时。当你希望数据是人类可读的,便于检查和调试。

简单来说,如果数据是“自产自销”且复杂,

pickle

很方便;如果数据要“出口或进口”且注重安全和通用性,JSON是更好的选择。两者各有千秋,没有绝对的优劣,关键在于根据具体需求做出最合适的判断。

以上就是如何序列化和反序列化一个Python对象(pickle)?的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1370236.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2025年12月14日 10:22:10
下一篇 2025年12月14日 10:22:18

相关推荐

  • 如何解决本地图片在使用 mask JS 库时出现的跨域错误?

    如何跨越localhost使用本地图片? 问题: 在本地使用mask js库时,引入本地图片会报跨域错误。 解决方案: 要解决此问题,需要使用本地服务器启动文件,以http或https协议访问图片,而不是使用file://协议。例如: python -m http.server 8000 然后,可以…

    2025年12月24日
    200
  • 使用 Mask 导入本地图片时,如何解决跨域问题?

    跨域疑难:如何解决 mask 引入本地图片产生的跨域问题? 在使用 mask 导入本地图片时,你可能会遇到令人沮丧的跨域错误。为什么会出现跨域问题呢?让我们深入了解一下: mask 框架假设你以 http(s) 协议加载你的 html 文件,而当使用 file:// 协议打开本地文件时,就会产生跨域…

    2025年12月24日
    200
  • Bear 博客上的浅色/深色模式分步指南

    我最近使用偏好颜色方案媒体功能与 light-dark() 颜色函数相结合,在我的 bear 博客上实现了亮/暗模式切换。 我是这样做的。 第 1 步:设置 css css 在过去几年中获得了一些很酷的新功能,包括 light-dark() 颜色函数。此功能可让您为任何元素指定两种颜色 &#8211…

    2025年12月24日
    100
  • 如何在 Web 开发中检测浏览器中的操作系统暗模式?

    检测浏览器中的操作系统暗模式 在 web 开发中,用户界面适应操作系统(os)的暗模式设置变得越来越重要。本文将重点介绍检测浏览器中 os 暗模式的方法,从而使网站能够针对不同模式调整其设计。 w3c media queries level 5 最新的 web 标准引入了 prefers-color…

    2025年12月24日
    000
  • 如何使用 CSS 检测操作系统是否处于暗模式?

    如何在浏览器中检测操作系统是否处于暗模式? 新发布的 os x 暗模式提供了在 mac 电脑上使用更具沉浸感的用户界面,但我们很多人都想知道如何在浏览器中检测这种设置。 新标准 检测操作系统暗模式的解决方案出现在 w3c media queries level 5 中的最新标准中: 立即学习“前端免…

    2025年12月24日
    000
  • 如何检测浏览器环境中的操作系统暗模式?

    浏览器环境中的操作系统暗模式检测 在如今科技的海洋中,越来越多的设备和软件支持暗模式,以减少对眼睛的刺激并营造更舒适的视觉体验。然而,在浏览器环境中检测操作系统是否处于暗模式却是一个令人好奇的问题。 检测暗模式的标准 要检测操作系统在浏览器中是否处于暗模式,web 开发人员可以使用 w3c 的媒体查…

    2025年12月24日
    200
  • 浏览器中如何检测操作系统的暗模式设置?

    浏览器中的操作系统暗模式检测 近年来,随着用户对夜间浏览体验的偏好不断提高,操作系统已开始引入暗模式功能。作为一名 web 开发人员,您可能想知道如何检测浏览器中操作系统的暗模式状态,以相应地调整您网站的设计。 新 media queries 水平 w3c 的 media queries level…

    2025年12月24日
    000
  • 正则表达式在文本验证中的常见问题有哪些?

    正则表达式助力文本输入验证 在文本输入框的验证中,经常遇到需要限定输入内容的情况。例如,输入框只能输入整数,第一位可以为负号。对于不会使用正则表达式的人来说,这可能是个难题。下面我们将提供三种正则表达式,分别满足不同的验证要求。 1. 可选负号,任意数量数字 如果输入框中允许第一位为负号,后面可输入…

    2025年12月24日
    000
  • 我在学习编程的第一周学到的工具

    作为一个刚刚完成中学教育的女孩和一个精通技术并热衷于解决问题的人,几周前我开始了我的编程之旅。我的名字是OKESANJO FATHIA OPEYEMI。我很高兴能分享我在编码世界中的经验和发现。拥有计算机科学背景的我一直对编程提供的无限可能性着迷。在这篇文章中,我将反思我在学习编程的第一周中获得的关…

    2025年12月24日
    000
  • 为什么多年的经验让我选择全栈而不是平均栈

    在全栈和平均栈开发方面工作了 6 年多,我可以告诉您,虽然这两种方法都是流行且有效的方法,但它们满足不同的需求,并且有自己的优点和缺点。这两个堆栈都可以帮助您创建 Web 应用程序,但它们的实现方式却截然不同。如果您在两者之间难以选择,我希望我在两者之间的经验能给您一些有用的见解。 在这篇文章中,我…

    2025年12月24日
    000
  • 姜戈顺风

    本教程演示如何在新项目中从头开始配置 django 和 tailwindcss。 django 设置 创建一个名为 .venv 的新虚拟环境。 # windows$ python -m venv .venv$ .venvscriptsactivate.ps1(.venv) $# macos/linu…

    2025年12月24日
    000
  • 花 $o 学习这些编程语言或免费

    → Python → JavaScript → Java → C# → 红宝石 → 斯威夫特 → 科特林 → C++ → PHP → 出发 → R → 打字稿 []https://x.com/e_opore/status/1811567830594388315?t=_j4nncuiy2wfbm7ic…

    2025年12月24日
    000
  • 揭秘主流编程语言中的基本数据类型分类

    标题:基本数据类型大揭秘:了解主流编程语言中的分类 正文: 在各种编程语言中,数据类型是非常重要的概念,它定义了可以在程序中使用的不同类型的数据。对于程序员来说,了解主流编程语言中的基本数据类型是建立坚实程序基础的第一步。 目前,大多数主流编程语言都支持一些基本的数据类型,它们在语言之间可能有所差异…

    2025年12月24日
    000
  • 深入理解CSS框架与JS之间的关系

    深入理解CSS框架与JS之间的关系 在现代web开发中,CSS框架和JavaScript (JS) 是两个常用的工具。CSS框架通过提供一系列样式和布局选项,可以帮助我们快速构建美观的网页。而JS则提供了一套功能强大的脚本语言,可以为网页添加交互和动态效果。本文将深入探讨CSS框架和JS之间的关系,…

    2025年12月24日
    000
  • 项目实践:如何结合CSS和JavaScript打造优秀网页的经验总结

    项目实践:如何结合CSS和JavaScript打造优秀网页的经验总结 随着互联网的快速发展,网页设计已经成为了各行各业都离不开的一项技能。优秀的网页设计可以给用户留下深刻的印象,提升用户体验,增加用户的黏性和转化率。而要做出优秀的网页设计,除了对美学的理解和创意的运用外,还需要掌握一些基本的技能,如…

    2025年12月24日
    200
  • 学完HTML和CSS之后我应该做什么?

    网页开发是一段漫长的旅程,但是掌握了HTML和CSS技能意味着你已经赢得了一半的战斗。这两种语言对于学习网页开发技能来说非常重要和基础。现在不可或缺的是下一个问题,学完HTML和CSS之后我该做什么呢? 对这些问题的答案可以分为2-3个部分,你可以继续练习你的HTML和CSS编码,然后了解在学习完H…

    2025年12月24日
    000
  • 聊聊怎么利用CSS实现波浪进度条效果

    本篇文章给大家分享css 高阶技巧,介绍一下如何使用css实现波浪进度条效果,希望对大家有所帮助! 本文是 CSS Houdini 之 CSS Painting API 系列第三篇。 现代 CSS 之高阶图片渐隐消失术现代 CSS 高阶技巧,像 Canvas 一样自由绘图构建样式! 在上两篇中,我们…

    2025年12月24日 好文分享
    200
  • 巧用距离、角度及光影制作炫酷的 3D 文字特效

    如何利用 css 实现3d立体的数字?下面本篇文章就带大家巧用视觉障眼法,构建不一样的 3d 文字特效,希望对大家有所帮助! 最近群里有这样一个有意思的问题,大家在讨论,使用 CSS 3D 能否实现如下所示的效果: 这里的核心难点在于,如何利用 CSS 实现一个立体的数字?CSS 能做到吗? 不是特…

    2025年12月24日 好文分享
    000
  • CSS高阶技巧:实现图片渐隐消的多种方法

    将专注于实现复杂布局,兼容设备差异,制作酷炫动画,制作复杂交互,提升可访问性及构建奇思妙想效果等方面的内容。 在兼顾基础概述的同时,注重对技巧的挖掘,结合实际进行运用,欢迎大家关注。 正文从这里开始。 在过往,我们想要实现一个图片的渐隐消失。最常见的莫过于整体透明度的变化,像是这样: 立即学习“前端…

    2025年12月24日 好文分享
    000
  • css实现登录按钮炫酷效果(附代码实例)

    今天在网上看到一个炫酷的登录按钮效果;初看时感觉好牛掰;但是一点一点的抛开以后发现,并没有那么难;我会将全部代码贴出来;如果有不对的地方,大家指点一哈。 分析 我们抛开before不谈的话;其实原理和就是通过背景大小以及配合位置达到颜色渐变的效果。 text-transform: uppercase…

    2025年12月24日
    000

发表回复

登录后才能评论
关注微信