【机器学习】对 MLOps 的友好的介绍(MLOps1)

 

一、说明

        我对 MLOps 感兴趣已经有一段时间了。我第一次从机器学习工程师那里了解到它,由于我当时还是一名博士生,我并不知道它的存在。然而,我的好奇心被激起了,我开始了解它。回想起来,我很后悔没有早点了解它,以优化我的机器学习工作流程。

        在本文中,我将尝试提供对 MLOps 的初学者友好的介绍,并以简单的方式解释关键概念。作为一个一开始也觉得很难理解的人,我理解需要对这个主题进行更简单的介绍。我希望在阅读本文后,初学者会更自在地阅读有关 MLOps 的更高级文档。

二. 对 MLOps 的动机

        由于机器学习技术在各个研究领域的成功,许多公司都试图将它们整合到他们的软件系统中,以提高效率并解决现实世界的问题。但是,对于许多公司来说,在生产环境中实施机器学习可能是一个具有挑战性且耗时的过程。此外,部署后,必须管理和维护模型,并且必须监视其性能以确保其正常运行。这些任务在大型软件系统中尤其困难。

另一方面,软件工程师使用 DevOps(开发和运营)范式,这是一组促进开发和运营团队之间协作和沟通的实践和工具来开发和管理系统。这有助于保持开发速度和质量。MLOps 旨在将这些 DevOps 原则应用于机器学习系统。考虑到这个背景,MLOps 到底是什么?

2.1  定义

        若要定义 MLOps,让我们首先检查各种定义:

定义1:

“MLOps(机器学习操作)是一种范式,包括最佳实践、概念集等方面,以及机器学习产品的端到端概念化、实现、监视、部署和可伸缩性的开发文化。”[1]

定义2:

“DevOps 方法的扩展,将机器学习和数据科学资产作为 DevOps 生态中的一等公民包括在内” [2]

定义3:

我们可以使用机器学习工程(MLE)的定义,其中MLE是使用机器学习和传统软件工程的科学原理,工具和技术来设计和构建复杂的计算系统。MLE涵盖了从数据收集到模型构建的所有阶段,以使模型可供产品或消费者使用。(作者:A.布尔科夫)[3]。

根据前面的定义,我们可以将 MLOps 理解为一组技术和实践,用于以高效、优化和有组织的方式设计、构建和部署机器学习模型。这些技术和做法通常在 MLOps 生命周期的上下文中进行讨论。

2.2 . MLOps 生命周期

MLOps 生命周期(源) CC BY 4.0

MLOps 生命周期由 MLOps 范例中涉及的步骤和技术组成,从设计和开发机器学习模型到将其部署到生产环境中,以及随着时间的推移对其进行监视和维护。它通常分为三个主要阶段:

  • 第一阶段是设计过程,涉及定义业务问题、模型的需求及其预期用例。这通常涉及创建 AI/ML 画布。
  • 第二阶段是模型开发过程,包括数据和模型工程。
  • 第三阶段是涵盖模型部署和维护的操作流程。

在部署模型后,随着时间的推移保持模型的性能非常重要,因此这些阶段通常以循环方式执行。这可确保模型性能良好,并且仍能满足第一阶段定义的需求。现在,我们已经讨论了 MLOps 生命周期的各个阶段,让我们检查一下 MLOps 工作流,其中概述了在该过程的每个阶段执行的特定任务和活动。

2.3  MLOps 工作流

MLOps 工作流

MLOps 工作流概述了开发、部署和维护机器学习模型要遵循的步骤。在理想情况下,遵循工作流就足够了:首先,了解业务问题,然后选择、训练和部署模型。但是,在现实世界中并非总是如此。在任何时候,都可能需要返回到上一步。此外,部署模型后,必须对其进行维护和监视,这就是为什么了解 MLOps 生命周期和 MLOps 工作流非常重要的原因。

三、MLOps模型实用

3.1. 业务问题

业务问题(工作流程图、AI 画布和 ML 画布均来自源 CC BY 4.0)

MLOps 工作流的第一步是了解业务问题,这涉及定义模型的输入和输出,以及流程及其各种子任务。若要构建此过程,可以使用 AI(人工智能)画布或 ML(机器学习)画布,可以将其视为用于组织 MLOps 工作流的模板。AI 画布通常为 ML/AI 实现提供高级结构,而 ML 画布提供系统的高级描述和细节。您可以在此处阅读有关这些画布的更多信息。

让我们举个例子!假设为了改进其产品,一家乳制品公司有兴趣收集消费者对其的反馈。为此,需要对消费者对社交媒体平台上的产品的评论进行情感分析。机器学习技术可用于训练模型,以将这些评论的情绪分类为正面、负面或中性。这将使公司能够更好地了解客户对其产品的体验,并确定需要改进的领域。此业务问题描述转换为 AI 画布和/或 ML 画布,以获得更清晰的表示:

  • 预测/预测任务:AI系统将分析文本输入并预测文本的情绪(正面,负面或中性)。
  • 判断:系统将使用自然语言处理技术来理解文本的含义和情感。
  • 行动/决策:根据预测的情绪,系统可能会采取不同的行动,例如标记负面评论以供进一步审查,或优先考虑正面的社交媒体帖子以进行推广。
  • 结果:期望的结果是系统准确地对文本输入的情绪进行分类,从而提高客户满意度、更好的社交媒体参与度或其他好处,具体取决于特定用例。
  • 训练:系统将在标记文本数据的数据集上进行训练,其中包含输入文本和相应的情绪标签。
  • 输入/数据源:系统将接受来自各种来源的文本输入,例如社交媒体帖子或客户评论。
  • 输出/进行预测:系统将分析文本输入并预测文本的情绪(正面、负面或中性)。
  • 反馈:系统可以合并来自用户或利益相关者的反馈,以随着时间的推移提高其性能,例如通过调整自然语言处理算法的参数或向训练数据集添加新数据。
  • 离线评估:系统将使用标准评估指标(如精度、召回率和 F1 分数)进行评估,以确保它准确地对文本输入的情绪进行分类。
  • 实时监控:系统将根据需要持续监控和更新,以确保其随着时间的推移继续准确运行。

3.2. 数据工程

数据工程

了解手头的业务问题后,MLOps 工作流的下一步是数据工程过程。这包括数据引入、探索和验证、数据清理、数据标记和数据拆分。

  • 数据引入涉及使用一组技术来收集数据、创建备份、保护私人信息、创建元数据目录和对测试集进行采样,以避免数据侦听偏差。
  • 为了探索和验证数据集,使用了一组统计和可视化技术。
  • 收集的数据通常具有噪声、包含异常值和缺失值。这些问题可能会影响下一个过程,因此应用数据清理步骤来解决这些问题。
  • 当所选模型基于监督学习时,数据标记是必要的。此步骤可以手动、自动或半自动完成。
  • 数据拆分是此过程的最后一步,涉及将数据划分为训练集、验证集和测试集。

3.3. ML 模型工程

机器学习模型工程

MLOps 工作流的第三步是机器学习工程,其中包括模型训练、模型评估、模型测试和模型打包。

  • 训练模型涉及特征工程、代码审查和版本控制以及超参数优化。您可能想知道为什么此步骤中包含特征工程而不是上一步。原因是在此步骤中测试了许多类型和体系结构的模型,因此所有模型的特征工程通常都不相同。值得注意的是,在此步骤中选择最合适的模型之前,会训练和测试多个模型。
  • 模型评估涉及验证模型,以确保它满足业务问题步骤中描述的业务目标。
  • 在模型测试步骤中,使用初始测试集执行模型验收测试
  • 验证和测试模型后,最后一步是以特定格式导出模型,以便将其提供给业务应用程序。

3.4. 代码工程

代码工程

在此步骤中,模型已准备好部署到生产环境。模型部署包括三个步骤:模型服务、性能监视和性能日志记录。

  • 若要提供模型,必须考虑服务模式和部署策略。服务模式是指如何将模型集成到软件中,例如将其集成为服务、依赖项、使用预先计算的服务、按需服务或混合服务。部署策略是指用于包装模型的方法,例如将其部署为 Docker 容器或无服务器函数。
  • 监视模型涉及观察模型的整体行为,例如其预测与先前模型性能的偏差。
  • 性能日志记录涉及将模型预测的结果保存在日志记录中。

四、 结论

        在本文中,我们简要介绍了 MLOps。我们讨论了对 MLOps 的需求,提出了各种定义,解释了 MLOps 生命周期,并介绍了 MLOps 工作流。如果您想了解有关 MLOps 的详细信息,建议 ml-ops.org 以获取更多信息。

        这是关于 MLOps 的第一篇文章,当然不是最后一篇文章!我将编写更多有关 MLOps 及其各种技术的教程,并提供示例,敬请期待。如果您有任何问题或建议,请随时在下面给我留言。

引用

[1] Kreuzberger, D., Kühl, N., & Hirschl, S. Machine Learning Operations (mlops): 概述、定义和架构, 2022.DOI:10.48550。arXiv预印本arXiv.2205.02302

[2] MLOps 路线图 2020

[3] MLOps: Motivation

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.rhkb.cn/news/75504.html

如若内容造成侵权/违法违规/事实不符,请联系长河编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

iOS——锁与死锁问题

iOS中的锁 什么是锁锁的分类互斥锁1. synchronized2. NSLock3. pthread 递归锁1. NSRecursiveLock2. pthread 信号量Semaphore1. dispatch_semaphore_t2. pthread 条件锁1. NSCodition2. NSCoditionLock3. POSIX Conditions 分布式锁NSDistributedLock 读写锁1. dispatch_barri…

css实现卡片的左上角有一个三角形的遮盖效果

需求: 卡片的左上角有一个绿色的三角形标签,用来区分状态 实现: .vCard{position: relative;overflow: hidden; } .vCard::before {content: "";position: absolute;top: 0;left: 0;width: 0;height: 0;border-bottom: 20px solid transparent;border-left: 20px …

Ariadne’s Thread-使用文本提示改进对感染区域的分割胸部x线图像

论文:https://arxiv.org/abs/2307.03942, Miccai 2023 代码:GitHub - Junelin2333/LanGuideMedSeg-MICCAI2023: Pytorch code of MICCAI 2023 Paper-Ariadne’s Thread : Using Text Prompts to Improve Segmentation of Infected Areas fro…

2、Tomcat介绍(下)

组件分类 在Apache Tomcat中&#xff0c;有几个顶级组件&#xff0c;它们是Tomcat的核心组件&#xff0c;负责整个服务器的运行和管理。这些顶级组件包括&#xff1a; Server(服务器)&#xff1a;Tomcat的server.xml配置文件中的<Server>元素代表整个Tomcat服务器实例。每…

vmware网络配置

效果&#xff1a; 虚拟机和物理机网络互通&#xff1b; 虚拟机可以上外网 环境&#xff1a; vmware version 17.0.0 Centos 7.9 配置 1&#xff0c;vmware 菜单 - 编辑 - Virtual Network Edit 2&#xff0c; 选择VMnet8 VMnet information:NAT&#xff1b; 勾选2个…

运输层---概述

目录 运输层主要内容一.概述和传输层服务1.1 概述1.2 传输服务和协议1.3 传输层 vs. 网络层1.4 Internet传输层协议 二. 多路复用与多路分解&#xff08;解复用&#xff09;2.1 概述2.2 无连接与面向连接的多路分解&#xff08;解复用&#xff09;2.3面向连接的多路复用*2.4 We…

Html5播放器按钮在移动端变小的问题解决方法

Html5播放器按钮在移动端变小的问题解决方法 用手机浏览器打开酷播云视频&#xff0c;有时会出现播放器按钮太小的情况&#xff0c;此时只需在<head>中加入下面这段代码即可解决&#xff1a; <meta name"viewport" content"widthdevice-width, initia…

c语言指针的运算

1、通过指针计算数组的元素&#xff08;指针相减&#xff0c;类型需要一致&#xff09;&#xff0c;比如数组元素指针相减得到的是中间相差的元素个数&#xff0c;可以用于计算数组元素的个数等 #include "stdio.h" #include <stdlib.h>int main() {int a[10]…

SuperNova论文赏析

1. 引言 前序博客有&#xff1a; Nova: Recursive Zero-Knowledge Arguments from Folding Schemes学习笔记 卡内基梅隆大学 Abhiram Kothapalli 和 微软研究中心 Srinath Setty 2022年论文《SuperNova: Proving universal machine executions without universal circuits》…

责任链模式

责任链模式 1、定义&#xff1a; 将能够处理同一类请求的对象连成一条链&#xff0c;所提交的请求沿着链传递&#xff0c;链上的对象逐个判断是否有能力处理该请求 &#xff0c;如果能则处理&#xff1b; 如果不能则传递给链上的下一个对象 2、场景&#xff1a; 大学中奖学…

如何用python做自然语言处理

如何用python做自然语言处理 使用Python进行自然语言处理&#xff08;NLP&#xff09;是非常常见和强大的。以下是一些基本步骤&#xff1a; 安装所需的库&#xff1a; 首先&#xff0c;您需要安装一些用于自然语言处理的Python库&#xff0c;如NLTK&#xff08;自然语言工具包…

二十三种设计模式第十九篇--命令模式

命令模式是一种行为设计模式&#xff0c;它将请求封装成一个独立的对象&#xff0c;从而允许您以参数化的方式将客户端代码与具体实现解耦。在命令模式中&#xff0c;命令对象充当调用者和接收者之间的中介。这使您能够根据需要将请求排队、记录请求日志、撤销操作等。 命令模…

(具体解决方案)训练GAN深度学习的时候出现生成器loss一直上升但判别器loss趋于0

今天小陶在训练CGAN的时候出现了绷不住的情况&#xff0c;那就是G_loss&#xff08;生成器的loss值&#xff09;一路狂飙&#xff0c;一直上升到了6才逐渐平稳。而D_loss&#xff08;判别器的loss值&#xff09;却越来越小&#xff0c;具体的情况就看下面的图片吧。其实这在GAN…

arcgis字段计算器

1、两字段叠加。要求待叠加的字段类型为文本或字符串类型。如下&#xff1a; 2、字符串部分提取。

为Win12做准备?微软Win11 23H2将集成AI助手:GPT4免费用

微软日前确认今年4季度推出Win11 23H2&#xff0c;这是Win11第二个年度更新。 Win11 23H2具体有哪些功能升级&#xff0c;现在还不好说&#xff0c;但它会集成微软的Copilot&#xff0c;它很容易让人想到多年前的“曲别针”助手&#xff0c;但这次是AI技术加持的&#xff0c;Co…

编写SPI_Master驱动程序_新方法

编写SPI_Master驱动程序_新方法 文章目录 编写SPI_Master驱动程序_新方法一. SPI驱动框架1.1 总体框架1.2 怎么编写SPI_Master驱动1.2.1 编写设备树1.2.2 编写驱动程序 二、 编写程序2.1 数据传输流程2.2 写代码 致谢 参考资料&#xff1a; 内核头文件&#xff1a;include\lin…

Rookit系列一 【隐藏网络端口】【支持Win7 x32/x64 ~ Win10 x32/x64】

文章目录 Rookit系列一 【隐藏网络端口】【支持Win7 x32/x64 ~ Win10 x32/x64】前言探究隐藏网络端口netstat分析隐藏网络端口的原理关键数据结构隐藏网络端口源码 效果演示 Rookit系列一 【隐藏网络端口】【支持Win7 x32/x64 ~ Win10 x32/x64】 前言 Rookit是个老生常谈的话…

python中*与**的使用

文章目录 前言一、*与**在函数定义时二、*与**在函数调用时 前言 在python中*与**的使用要区分是在函数定义时还是在函数调用时。 一、*与**在函数定义时 def deng(*args,**kwargs):print(args)print(kwargs)deng(1,2,3,a 4,b 5)在函数定义时参数前面使用*&#xff0c;代表…

vue echart3个饼图

概览&#xff1a;根据UI设计需要做3个饼图且之间有关联&#xff0c;并且处理后端返回的数据。 参考链接&#xff1a; echart 官网的一个案例&#xff0c;3个饼图 实现思路&#xff1a; 根据案例&#xff0c;把数据处理成对应的。 参考代码&#xff1a; 1.处理后端数据&am…

Android Tencent Shadow 插件接入指南

Android Tencent Shadow 插件接入指南 插件化简述一、clone 仓库二、编译运行官方demo三、发布Shadow到我们本地仓库3.1、安装Nexus 3.x版本3.2、修改发布配置3.3、发布仓库3.4、引用仓库包 四、编写我们自己的代码4.1、新建项目导入maven等共同配置4.1.1、导入buildScript4.1.…