从开发到部署:自动化机器学习

构建机器学习 (ml) 模型既引人入胜又复杂,需要仔细完成一系列步骤。从机器学习模型开发到部署,是人工智能落地的关键阶段。一个基于正确算法和相关数据、经过良好训练的模型,能够涵盖开发阶段,之后的重点将转向部署。

部署机器学习模型可能是一个繁琐的过程:构建 API、容器化、管理依赖项、配置云环境以及设置服务器和集群通常需要付出巨大的努力,但想象一下,如果整个工作流程可以自动化会怎样?在本文中,我们将讨论机器学习部署自动化如何统一和简化所有这些流程。使用通用工具、预配置模块和易于集成的自动化脚本可以简化部署过程。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

从开发到部署:自动化机器学习 - 创想鸟

在本文中,我将向您介绍如何训练 ML 模型、使用 Docker 对其进行容器化以及如何使用 Terraform 将其部署到云端,所有这些都使用自动化脚本,使流程可重用且适合 CI/CD。

自动化机器学习部署带来的好处

 自动化 ML 部署彻底改变了游戏规则:

使机器学习模型能够有效扩展几分钟内将模型投入生产消除耗时的重复步骤减少人为错误

使用的工具

要配置 ML 模型部署,我们需要一些基本工具和库:

Python 3.4+:用于训练和托管模型以及编写脚本来填补空白的核心编程语言scikit-learn:用于机器学习的 Python 库FastAPI:将 ML 模型作为 Web API 托管的 Python 库Docker:运行 Terraform 和 ML 模型Cloud CLI:需要安装才能与 Azure、AWS 和 GCP 等云平台交互Terraform:基础设施即代码(IaC)用于配置云资源

项目设置

现在,让我们设置项目并回顾每个步骤。该项目主要分为三个部分:

机器学习模型训练机器学习工作流程自动化使用 Terraform 的 IaC

该项目的结构如下:

ml_deploy/├── src/│   ├── app.py                  # FastAPI app that serves the ML model│   ├── train_model.py          # Trains and serializes the model│   ├── model.pkl               # Packaged ML model│   ├── requirements.txt        # Python libraries│   └── Dockerfile              # Defines the Docker image├── terraform/│   ├── main.tf                 # Terraform configuration file│   ├── variables.tf│   ├── outputs.tf│   └── terraform.tfvars        # Holds dynamic values like image name├── scripts/│   ├── build_model_and_image.py  # Automates model training + Docker│   └── install_terraform.py      # Runs Terraform inside Docker

机器学习模型训练

该流程的第一步是模型开发、训练模型并构建 API 来为其提供服务:

train_model.py/import picklefrom sklearn.linear_model import LogisticRegressionfrom sklearn.datasets import load_iris# Load dataX, y = load_iris(return_X_y=True)# Initialize and train modelmodel = LogisticRegression(max_iter=200)model.fit(X, y)# Save model to a filewith open("model.pkl", "wb") as f:    pickle.dump(model, f)

在上面的示例中,我们使用 scikit-learn在传统的鸢尾花物种数据集上训练了一个逻辑回归模型。我们使用Pickle 库对模型进行序列化,将所有依赖项封装到一个文件中。然后,FastAPI 服务器加载model.pkl该模型和端点以生成预测:/predictapp.py

app.py/from fastapi import FastAPIimport pickleimport numpy as npapp = FastAPI()model = pickle.load(open("model.pkl", "rb"))@app.get("/")def root():    return {"message": "Model running"}@app.post("/predict")def predict(data):    prediction = model.predict(np.array(data).reshape(1, -1))    return {"prediction": prediction.tolist()}

机器学习工作流自动化

经过训练的机器学习模型可以转化为一种服务,在可靠部署和访问的情况下,能够实时、大规模地交付。手动训练模型、通过构建 Docker 镜像部署模型以及更新配置文件可能是一个繁琐且容易出错的过程。自动化不仅可以提高效率,还可以简化工作流程。

我们使用两个 Python 脚本自动执行这些步骤:

build_model_and_image.py:此 Python 脚本可自动执行模型训练、Docker 镜像构建、推送到 DockerHub 以及更新.tfvarsTerraform 文件并将其组合到单个工作流中。build_model_and_image.py在 GitHub 上查看代码:https://github.com/yraj1457/MLOps/blob/main/scripts/build_model_and_image.py

build_model_and_image.py/import subprocessimport sys# Executes the train model Python codedef train_model():    print("Training the Model")    try:        subprocess.run(["python3", "train_model.py"], check=True, cwd=src_dir)    except Exception as e:        print(f"Error Training the Model: {e}")        sys.exit(1)# Builds the image after training the modeldef build_image():    print(f"Building the Docker Image: {docker_image}")    try:        subprocess.run(["docker", "build", "-t", docker_image, "."], check=True)    except Exception as e:        print(f"Error Building the Docker Image: {e}")        sys.exit(1)

install_terraform.py:此 Python 自动化脚本通过在 Docker 容器中运行 Terraform 来负责配置基础设施,从而确保无需单独安装 Terraform。install_terraform.py在 GitHub 上查看代码:https://github.com/yraj1457/MLOps/blob/main/scripts/install_terraform.py

install_terraform.py/import subprocessimport sysfrom pathlib import Path# Run the Trio, the three Terraform commandsdef run_terraform():    cmd_list = ['init', 'plan', 'apply']    for cmd in cmd_list:        print(f"Running Terraform {cmd}")        try:            subprocess.run(                f"docker run --rm -v {Path(terraform_dir).resolve()}:/workspace "                f"-w /workspace {terraform_image} {cmd}",                shell=True,                check=True            )        except Exception as e:            print(f"Error running Terraform {cmd}: {e}")            sys.exit(1)

这些自动化脚本填补了空白,并使工作流程在插入管道时可重复使用。

使用 Terraform 进行基础设施即代码

生产就绪服务需要部署。我们使用 Terraform 的 IaC,它允许我们定义整个云设置——包括运行模型的容器。它确保部署不仅自动化且一致,而且可跨环境移植。

基础设施由四个 Terraform 配置文件配置:main.tf、、和。Python 脚本使用官方 hashicorp/terraform Docker 镜像来运行 Terraform 命令(、、和),从而无需维护 Terraform 安装或版本,并在开发和部署之间提供了明确的划分variables.tf。outputs.tfterraform.tfvarsinitplanapply

下面的 Terraform 代码片段可以作为一个例子。它提供了一个 Azure 资源组和一个容器实例来托管机器学习 API。

main.tf/provider "azurerm" {  features {}}resource "azurerm_resource_group" "ml_rg" {  name     = var.resource_group_name  location = var.location}resource "azurerm_container_group" "ml_app" {  name                = "ml-model-api"  location            = azurerm_resource_group.ml_rg.location  resource_group_name = azurerm_resource_group.ml_rg.name  os_type             = "Linux"  container {    name   = "mlmodel"    image  = var.container_image    cpu    = "1.0"    memory = "1.5"    ports {      port     = 80      protocol = "TCP"    }  }  ip_address_type = "public"  dns_name_label  = var.dns_label}

该方法的完整代码库(包括所有脚本和配置文件)可在 GitHub 上找到:https://github.com/yraj1457/MLOps

为什么这种方法更有效

自动化脚本将各个流程整合在一起,从而实现更高效的方法,最大限度地减少人工干预,并优雅地记录错误。此外,通过在 Docker 容器中运行工具,我们最大限度地减少了依赖关系,并保证了跨环境的一致性。该架构融合了基础设施自动化、DevOps 和 MLOps 的最佳实践。

结论

本文展示了如何利用最少的工具、更少的依赖和最大程度的自动化,从机器学习模型训练到部署,为数据科学家和 MLOps 工程师节省大量重复性工作。我们利用 Python 编写的自动化脚本,并使用 Docker 封装模型和 Terraform,构建了一个可重用、自动化且可扩展的环境。

这种方法具有高度可移植性,可以插入任何 CI/CD 工具,例如 GitHub Actions 或 Azure DevOps。基础已从这里设置,您可以根据自己的需求进行修改。 

以上就是从开发到部署:自动化机器学习的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/46685.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
多大算小屏?一张图速览 5.4-6.9 差别
上一篇 2025年11月7日 19:34:44
manwa.size可靠漫蛙登录方式-manwa防丢失快速入口2026
下一篇 2025年11月7日 19:36:17

相关推荐

  • 怎样在VSCode中快速生成注释文档?

    安装插件如Document This和Koro File Header,通过快捷键在VSCode中快速生成函数及文件注释,支持自定义模板,提升注释效率与规范性。 在 VSCode 中快速生成注释文档,主要依赖插件和快捷键配合代码语言特性来实现。不同编程语言支持方式略有差异,但核心思路是使用智能提示和…

    2026年9月21日
    000
  • Java中浮点数比较的陷阱:理解double类型的不精确性与正确比较方法

    java中`double`类型因其二进制浮点表示的固有不精确性,即使在相同java版本和架构下,也可能在不同环境中产生微小的数值差异。直接使用`==`比较浮点数是不可靠的,因为它无法容忍这些细微的舍入误差。正确的做法是采用基于容差(epsilon)的比较方法,通过判断两数之差的绝对值是否小于一个预设…

    2026年9月21日
    100
  • 如何下载豆包电脑网页版_豆包电脑网页版正版链接

    豆包AI电脑及网页版可通过官网和官方应用商店安全获取。1、访问https://www.doubao.com登录使用网页版;2、官网下载电脑客户端,支持Windows和macOS;3、通过Microsoft Store或App Store搜索“豆包 AI”,认准北京字节跳动网络技术有限公司开发,确保正…

    2026年9月21日
    100
  • Linux目录结构与文件系统设计理念

    Linux目录结构以根目录为起点,遵循“一切皆文件”理念,通过标准化层级划分(如/bin、/etc、/home等)实现资源统一管理,结合FHS标准、灵活挂载机制与权限模型,提升系统可维护性、安全性和跨发行版兼容性,体现简洁高效的设计哲学。 Linux的目录结构与文件系统设计体现了简洁、统一和高度模块…

    2026年9月21日
    100
  • 如何避免协程中的共享资源竞争?

    避免协程中的共享资源竞争可以通过以下方法:1. 使用锁(locks),如互斥锁或读写锁,确保同一时间只有一个协程访问共享资源。2. 采用无锁数据结构(lock-free data structures),通过原子操作和cas操作提高并发性能。3. 实施消息传递(message passing),通过…

    2026年9月21日
    000
  • 猎豹浏览器官方网址链接入口 猎豹浏览器平台直达访问官方主页

    猎豹浏览器官方网址是http://m.liebao.cn/?f=www,该网站提供极速浏览体验、个性化界面设置和实用功能整合,如双渲染引擎、安全防护、主题皮肤、广告过滤等。 猎豹浏览器官方网址链接入口在哪里?这是不少网友都关注的,接下来由PHP小编为大家带来猎豹浏览器平台直达访问官方主页,感兴趣的网…

    2026年9月21日
    000
  • Java构造方法的执行顺序及注意事项

    构造方法执行顺序为:父类静态代码块→子类静态代码块→父类实例初始化块→父类构造方法→子类实例初始化块→子类构造方法,且super()必须位于子类构造方法首行。 Java构造方法的执行顺序涉及继承关系中父类与子类的初始化过程,理解这一流程对掌握对象创建机制非常重要。当创建一个子类对象时,JVM会自动确…

    2026年9月21日
    000
  • mysql如何配置默认存储引擎

    首先查看当前默认存储引擎,通过SHOW VARIABLES命令确认;然后编辑my.cnf或my.ini文件,在[mysqld]下添加default-storage-engine=InnoDB;接着重启MySQL服务使配置生效;最后验证更改结果并检查建表默认引擎。 MySQL 默认存储引擎的配置可以通…

    2026年9月21日
    000
  • 微软 Windows 10 停服在即,官方升级工具却突然罢工

    10月13日,随着Windows 10的官方支持即将于次日(10月14日)正式终止,微软近期加大了对Windows 11的宣传力度,频繁推出广告和推广活动,强调新系统的多项升级与优势,吸引了不少用户考虑迁移至Windows 11。 然而颇具讽刺意味的是,在这一关键节点,微软自家的关键工具却出现了故障…

    2026年9月21日
    000
  • VSCode怎么生成项目模板_VSCode使用自定义代码片段创建项目模板教程

    答案:VSCode可通过自定义代码片段高效生成文件模板,结合工作区设置与脚手架工具实现项目初始化。利用用户代码片段(User Snippets)定义常用代码结构,如React组件或HTML骨架,通过prefix触发,支持制表位快速编辑;推荐将团队共享片段设为工作区级并提交至Git,确保规范统一;配合…

    2026年9月21日
    600
  • google浏览器开发者工具怎么打开_google浏览器打开开发者工具方法

    1、使用F12或Ctrl+Shift+I快捷键可快速打开开发者工具;2、右键点击页面元素选择“检查”能直接定位HTML节点;3、通过浏览器右上角菜单进入“更多工具”-“开发者工具”也可启动;4、在地址栏输入chrome://inspect可管理远程设备调试并打开对应开发者工具窗口。 如果您在使用 G…

    2026年9月21日
    000
  • win10键盘打字错乱怎么办_win10键盘错乱排查与修复教程

    首先检查Num Lock状态并关闭数字小键盘锁定,接着更新或重装键盘驱动程序,再禁用Program Compatibility Assistant Service服务,最后使用360安全卫士等工具修复系统错误,逐步排查键盘输入混乱问题。 如果您在使用Windows 10系统时,发现键盘输入的字符与按…

    2026年9月21日
    000
  • Jedis jsonGet 方法返回字节数组值末尾出现 .0 的处理策略

    当使用jedis客户端的`jsonget`方法从redis获取json数据时,如果其中包含字节数组(如xml字符串的字节表示),可能会因底层json库(如gson或org.json)的默认行为,导致数字被统一上转型为`double`类型,从而在输出中显示`.0`后缀。本文将深入探讨此问题产生的原因,…

    2026年9月21日
    200
  • Laravel与Vue.js/React前端框架集成

    laravel可以与vue.js或react集成。1) 使用命令“php artisan preset vue”或“php artisan preset react”设置开发环境。2) 在laravel视图中引入编译后的javascript文件。3) 通过laravel的api路由和前端框架的htt…

    2026年9月21日
    000
  • mysql索引的类型和作用有哪些

    MySQL常见索引类型包括:1. 普通索引用于加速查询;2. 唯一索引确保列值唯一;3. 主键索引为唯一非空且自动创建聚簇索引;4. 聚簇索引决定数据物理存储顺序,每表仅一个;5. 非聚簇索引保存主键值,需回表查询;6. 覆盖索引避免回表提升性能;7. 联合索引遵循最左前缀原则;8. 全文索引支持文…

    2026年9月21日
    000
  • AI推文助手如何制作用户指南 AI推文助手的说明文档创作

    AI推文助手如何制作用户指南 AI推文助手的说明文档创作AI推文助手如何制作用户指南 AI推文助手的说明文档创作AI推文助手如何制作用户指南 AI推文助手的说明文档创作AI推文助手如何制作用户指南 AI推文助手的说明文档创作

    答案:配置账户、设定风格模板、生成推文、安排发布时间、监控数据。依次完成绑定社交账号、选择语气类型与关键词、输入主题生成内容、设置定时发布及查看分析仪表板,实现高效创作与优化。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 如果您希望使用A…

    2026年9月21日 用户投稿
    000
  • windows怎么使用放大镜工具_Windows放大镜功能使用方法

    首先通过快捷键Win+加号开启放大镜,再通过设置调整模式与参数;具体包括全屏、镜头、停靠三种视图模式,并支持自定义热键与鼠标联动,提升操作效率。 如果您在使用Windows系统时遇到屏幕内容过小或难以看清的情况,可以借助系统自带的放大镜工具来放大显示区域。以下是关于如何使用Windows放大镜功能的…

    2026年9月21日
    000
  • 安卓跑分第一 Redmi K70 至尊版本月发布

    redmi 今日正式宣布,备受期待的 k70 至尊版将于本月盛大发布,预计将与小米 mix 系列折叠旗舰同台竞技,共同演绎科技之美。据官方最新消息,redmi k70 至尊版将搭载联发科天玑 9300+ 处理器,这款处理器在安兔兔跑分测试中一举突破 238 万分大关,目前稳居安卓性能之巅。天玑 93…

    2026年9月21日
    000
  • 如何为特定语言配置VSCode的语法高亮?

    安装对应语言扩展并关联文件类型,可实现VSCode语法高亮。首先通过扩展面板安装目标语言插件,如Ruby或Rust;若文件扩展名未被识别,需手动将扩展名关联至正确语言;最后可在settings.json中配置editor.tokenColorCustomizations来自定义高亮颜色,确保语法解析…

    2026年9月21日
    000
  • Linux怎么使用systemctl管理服务

    Linux怎么使用systemctl管理服务Linux怎么使用systemctl管理服务Linux怎么使用systemctl管理服务Linux怎么使用systemctl管理服务

    systemctl是Linux中管理systemd服务的核心工具,提供统一命令集来启动、停止、重启、查看服务状态及设置开机自启,支持并行启动、依赖管理与Cgroups资源控制,相比SysVinit更高效;通过创建/etc/systemd/system/下的.service文件可自定义服务,包含[Un…

    2026年9月21日 用户投稿
    100

发表回复

登录后才能评论
关注微信