程序博客网 > python实现神经网络

【机器学习】k-fold cross validation（k-折叠交叉验证）

来源：互联网发布：python实现神经网络编辑：程序博客网时间：2024/04/30 06:37

另一篇博客http://blog.csdn.net/evillist/article/details/76009632

交叉验证的目的：在实际训练中，模型通常对训练数据好，但是对训练数据之外的数据拟合程度差。用于评价模型的泛化能力，从而进行模型选择。

交叉验证的基本思想：把在某种意义下将原始数据(dataset)进行分组,一部分做为训练集(train set),另一部分做为验证集(validation set or test set),首先用训练集对模型进行训练,再利用验证集来测试模型的泛化误差。另外，现实中数据总是有限的，为了对数据形成重用，从而提出k-折叠交叉验证。

对于个分类或回归问题，假设可选的模型为 clip_image008 。k-折叠交叉验证就是将训练集的1/k作为测试集，每个模型训练k次，测试k次，错误率为k次的平均，最终选择平均率最小的模型Mi。

1、将全部训练集S分成k个不相交的子集，假设S中的训练样例个数为m，那么每一个子集有m/k个训练样例，相应的子集称作{}。

2、每次从模型集合M中拿出来一个，然后在训练子集中选择出k-1个

{}（也就是每次只留下一个），使用这k-1个子集训练后，得到假设函数。最后使用剩下的一份作测试，得到经验错误。

3、由于我们每次留下一个（j从1到k），因此会得到k个经验错误，那么对于一个，它的经验错误是这k个经验错误的平均。

4、选出平均经验错误率最小的，然后使用全部的S再做一次训练，得到最后的。

参考

0 0

python实现神经网络

python实现神经网络

原创粉丝点击

热门问题 老师的惩罚人脸识别我在镇武司摸鱼那些年重生之率土为王我在大康的咸鱼生活盘龙之生命进化天生仙种凡人之先天五行春回大明朝姑娘不必设防，我是瞎子婴儿鼻子呛奶宝宝老是呛奶怎么办婴儿呛奶的危害小孩呛奶急救措施什么是呛奶新生儿经常呛奶添奶奶孑揑奶马丽兹的奶朴孝珍的奶廖学秋的奶葛晓凤的奶婴儿从鼻子里呛奶怎么回事新生儿从鼻子呛奶怎么回事如何防止婴儿呛奶宝宝为什么会呛奶如何预防新生儿呛奶呛菜的做法呛鼻子辣菜的做法大全呛莲菜做法呛菜呛虾生呛大虾上海呛虾的做法大全呛虾的做法醉虾呛蟹的做法铁蟹大炸蟹呜咽呜咽拼音呜咽的拼音呜咽的读音呜咽读音呜咽的意思似知人呜咽呜咽灌满固定轮流少年呜咽哭喊大床她呜咽起来他放慢速度呜咽挣扎大床黑化逃跑