【机器学习】k-fold cross validation（k-折叠交叉验证）

最新推荐文章于 2025-10-09 09:45:41 发布

转载最新推荐文章于 2025-10-09 09:45:41 发布 · 2.8k 阅读

·

0

·

机器学习专栏收录该内容

2 篇文章

订阅专栏

本文深入解析了交叉验证的基本概念及其在模型选择中的关键作用。介绍了k-折叠交叉验证的具体步骤，通过将数据集分为训练集和验证集，评估模型的泛化能力，最终选出最优模型。

交叉验证的目的：在实际训练中，模型通常对训练数据好，但是对训练数据之外的数据拟合程度差。用于评价模型的泛化能力，从而进行模型选择。

交叉验证的基本思想：把在某种意义下将原始数据(dataset)进行分组,一部分做为训练集(train set),另一部分做为验证集(validation set or test set),首先用训练集对模型进行训练,再利用验证集来测试模型的泛化误差。另外，现实中数据总是有限的，为了对数据形成重用，从而提出k-折叠交叉验证。

对于个分类或回归问题，假设可选的模型为。k-折叠交叉验证就是将训练集的1/k作为测试集，每个模型训练k次，测试k次，错误率为k次的平均，最终选择平均率最小的模型Mi。

1、将全部训练集S分成k个不相交的子集，假设S中的训练样例个数为m，那么每一个子集有m/k个训练样例，相应的子集称作{}。

2、每次从模型集合M中拿出来一个，然后在训练子集中选择出k-1个

{}（也就是每次只留下一个），使用这k-1个子集训练后，得到假设函数。最后使用剩下的一份作测试，得到经验错误。

3、由于我们每次留下一个（j从1到k），因此会得到k个经验错误，那么对于一个，它的经验错误是这k个经验错误的平均。

4、选出平均经验错误率最小的，然后使用全部的S再做一次训练，得到最后的。
---------------------
作者：evillist
来源：优快云
原文：https://blog.youkuaiyun.com/evillist/article/details/61912827
版权声明：本文为博主原创文章，转载请附上博文链接！

评论

成就一亿技术人!

拼手气红包6.0元

还能输入1000个字符

添加红包

插入表情

表情包

代码片

HTML/XML
objective-c
Ruby
PHP
C
C++
JavaScript
Python
Java
CSS
SQL
其它

条评论被折叠查看

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。