到底什么是Pipeline?

本文探讨了Pipeline概念在机器学习领域的核心作用,将其比喻为一条龙服务或综合解决方案。通过介绍机器学习构建的典型过程,包括源数据ETL、数据预处理、特征选取及模型训练与验证,阐述了Pipeline如何简化工作流程,提高效率。
部署运行你感兴趣的模型镜像

在各个领域,有一个词眼出现得越来越频繁,即 Pipeline。

开始接触的时候,百思不得其解,觉得作者在 用个 洋名字 在装 高大上,

其实,鲁迅先生说过一句话,太阳底下没有新鲜事

 

一切的一切,都是纸老虎,

Pipeline,你 土味一点 你把它 翻译成  一条龙服务

专业一点,叫 它  综合解决方案,就行。

算法或者大数据分析里的

可重复使用,针对新的数据,直接输入数据,可以得到结果。

 

一个典型的机器学习构建包含若干个过程

 1、源数据ETL
2、数据预处理
3、特征选取
4、模型训练与验证
以上四个步骤可以抽象为一个包括多个步骤的流水线式工作,从数据收集开始至输出我们需要的最终结果。因此,对以上多个步骤、进行抽象建模,简化为流水线式工作流程则存在着可行性,对利用spark进行机器学习的用户来说,流水线式机器学习比单个步骤独立建模更加高效、易用。

管道机制在机器学习算法中得以应用的根源在于,参数集在新数据集(比如测试集)上的重复使用。
 

您可能感兴趣的与本文相关的镜像

Yolo-v8.3

Yolo-v8.3

Yolo

YOLO(You Only Look Once)是一种流行的物体检测和图像分割模型,由华盛顿大学的Joseph Redmon 和Ali Farhadi 开发。 YOLO 于2015 年推出,因其高速和高精度而广受欢迎

### Jenkins Pipeline的定义 Pipeline是一套运行于Jenkins上的工作流框架,将原本独立运行于单个或者多个节点的任务连接起来,实现单个任务难以完成的复杂流程编排与可视化。它是Jenkins的核心功能,提供一组可扩展的工具,通过其DSL语法能完成从简到难的交付流水线实现,且通常通过Jenkinsfile文件来定义执行步骤,如代码拉取、代码检查等 [^2][^4]。 ### 声明式Pipeline与脚本式Pipeline的区别 #### 语法结构 - **声明式Pipeline**:有更严格和结构化的语法,所有的声明式Pipeline都必须包含在一个`pipeline`块中。它贴近传统的Jenkins Web表单形式,段落可映射到常见的Jenkins概念,结构更清晰,例如: ```groovy pipeline { agent any stages { stage('Hello') { steps { echo 'Hello World' } } } } ``` - **脚本式Pipeline**:语法相对灵活,基于Groovy脚本语言,更注重实现逻辑,例如: ```groovy node("master") { def name = 'helloword' stage("valid") { sh ''' echo 'valid start ...' ''' } } ``` #### 可读性与易用性 - **声明式Pipeline**:具有高可读性,更强大的声明内容能力,还可以通过Blue Ocean图形化界面自动生成,对新手较为友好,有更友好的语法检查和错误识别,能提升流水线间的一致性 [^5]。 - **脚本式Pipeline**:对于熟悉Groovy脚本的开发者来说,能更自由地实现复杂逻辑,但对于初学者可能有一定的学习成本。 #### 功能特性 - **声明式Pipeline**:对迭代逻辑支持较弱,对于传统Jenkins中的部分功能缺乏支持,更严格的结构使其较难实现自定义流水线代码,目前对于复杂的流水线和工作流难以胜任 [^5]。 - **脚本式Pipeline**:可以灵活实现复杂的控制逻辑,如循环、条件判断等,更适合处理复杂的业务场景。 #### 适用场景 - **声明式Pipeline**:适用于简单、标准化的流水线场景,能快速搭建基本的持续集成/持续部署流程。 - **脚本式Pipeline**:适用于复杂、定制化需求较高的场景,需要实现复杂逻辑和业务规则的流水线。
评论 9
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

往事如yan

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值