Python实现K折交叉验证法的方法步骤


Posted in Python onJuly 11, 2019

学习器在测试集上的误差我们通常称作“泛化误差”。要想得到“泛化误差”首先得将数据集划分为训练集和测试集。那么怎么划分呢?常用的方法有两种,k折交叉验证法和自助法。介绍这两种方法的资料有很多。下面是k折交叉验证法的python实现。

##一个简单的2折交叉验证
from sklearn.model_selection import KFold
import numpy as np
X=np.array([[1,2],[3,4],[1,3],[3,5]])
Y=np.array([1,2,3,4])
KF=KFold(n_splits=2) #建立4折交叉验证方法 查一下KFold函数的参数
for train_index,test_index in KF.split(X):
  print("TRAIN:",train_index,"TEST:",test_index)
  X_train,X_test=X[train_index],X[test_index]
  Y_train,Y_test=Y[train_index],Y[test_index]
  print(X_train,X_test)
  print(Y_train,Y_test)
#小结:KFold这个包 划分k折交叉验证的时候,是以TEST集的顺序为主的,举例来说,如果划分4折交叉验证,那么TEST选取的顺序为[0].[1],[2],[3]。

#提升
import numpy as np
from sklearn.model_selection import KFold
#Sample=np.random.rand(50,15) #建立一个50行12列的随机数组
Sam=np.array(np.random.randn(1000)) #1000个随机数
New_sam=KFold(n_splits=5)
for train_index,test_index in New_sam.split(Sam): #对Sam数据建立5折交叉验证的划分
#for test_index,train_index in New_sam.split(Sam): #默认第一个参数是训练集,第二个参数是测试集
  #print(train_index,test_index)
  Sam_train,Sam_test=Sam[train_index],Sam[test_index]
  print('训练集数量:',Sam_train.shape,'测试集数量:',Sam_test.shape) #结果表明每次划分的数量


#Stratified k-fold 按照百分比划分数据
from sklearn.model_selection import StratifiedKFold
import numpy as np
m=np.array([[1,2],[3,5],[2,4],[5,7],[3,4],[2,7]])
n=np.array([0,0,0,1,1,1])
skf=StratifiedKFold(n_splits=3)
for train_index,test_index in skf.split(m,n):
  print("train",train_index,"test",test_index)
  x_train,x_test=m[train_index],m[test_index]
#Stratified k-fold 按照百分比划分数据
from sklearn.model_selection import StratifiedKFold
import numpy as np
y1=np.array(range(10))
y2=np.array(range(20,30))
y3=np.array(np.random.randn(10))
m=np.append(y1,y2) #生成1000个随机数
m1=np.append(m,y3)
n=[i//10 for i in range(30)] #生成25个重复数据

skf=StratifiedKFold(n_splits=5)
for train_index,test_index in skf.split(m1,n):
  print("train",train_index,"test",test_index)
  x_train,x_test=m1[train_index],m1[test_index]

Python中貌似没有自助法(Bootstrap)现成的包,可能是因为自助法原理不难,所以自主实现难度不大。

以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持三水点靠木。

Python 相关文章推荐
Python生成随机数的方法
Jan 14 Python
python多线程扫描端口示例
Jan 16 Python
Python 使用requests模块发送GET和POST请求的实现代码
Sep 21 Python
Python实现数据库并行读取和写入实例
Jun 09 Python
在Python中分别打印列表中的每一个元素方法
Nov 07 Python
Python OpenCV 调用摄像头并截图保存功能的实现代码
Jul 02 Python
Python二维数组实现求出3*3矩阵对角线元素的和示例
Nov 29 Python
Python 文件数据读写的具体实现
Jan 24 Python
解析pip安装第三方库但PyCharm中却无法识别的问题及PyCharm安装第三方库的方法教程
Mar 10 Python
Anconda环境下Vscode安装Python的方法详解
Mar 29 Python
python 在右键菜单中加入复制目标文件的有效存放路径(单斜杠或者双反斜杠)
Apr 08 Python
利用pandas向一个csv文件追加写入数据的实现示例
Apr 23 Python
Python获取命令实时输出-原样彩色输出并返回输出结果的示例
Jul 11 #Python
将python运行结果保存至本地文件中的示例讲解
Jul 11 #Python
详解python实现交叉验证法与留出法
Jul 11 #Python
python程序运行进程、使用时间、剩余时间显示功能的实现代码
Jul 11 #Python
Python循环中else,break和continue的用法实例详解
Jul 11 #Python
Python 获取 datax 执行结果保存到数据库的方法
Jul 11 #Python
python opencv捕获摄像头并显示内容的实现
Jul 11 #Python
You might like
php生成扇形比例图实例
2013/11/06 PHP
PHP命名空间(Namespace)简明教程
2014/06/11 PHP
Netbeans 8.2将支持PHP7 更精彩
2016/06/13 PHP
thinkPHP框架实现的简单计算器示例
2018/12/07 PHP
php实现的简单多进程服务器类完整示例
2020/02/01 PHP
JS 创建对象(常见的几种方法)
2008/11/03 Javascript
jquery1.4.2 for Visual studio 2010 模板文件
2010/07/14 Javascript
JavaScript字符串String和Array操作的有趣方法
2012/12/18 Javascript
快速解决FusionCharts联动的中文乱码问题
2013/12/04 Javascript
javascript使用shift+click实现选择和反选checkbox的方法
2015/05/04 Javascript
jQuery实现手机自定义弹出输入框
2016/06/13 Javascript
基于JS实现html中placeholder属性提示文字效果示例
2018/04/19 Javascript
在 vue-cli v3.0 中使用 SCSS/SASS的方法
2018/06/14 Javascript
微信小程序项目实践之主页tab选项实现
2018/07/18 Javascript
vue完成项目后,打包成静态文件的方法
2018/09/03 Javascript
jQuery滑动效果实现方法分析
2018/09/05 jQuery
vue控制多行文字展开收起的实现示例
2019/10/11 Javascript
vue iview的菜单组件Mune 点击不高亮的解决方案
2019/11/01 Javascript
JS实现随机抽取三人
2019/11/06 Javascript
angularjs模态框的使用代码实例
2019/12/20 Javascript
深入分析jQuery.one() 函数
2020/06/03 jQuery
JavaScript中跨域问题的深入理解
2021/03/04 Javascript
Linux下Python获取IP地址的代码
2014/11/30 Python
Python求算数平方根和约数的方法汇总
2016/03/09 Python
Python基于matplotlib绘制栈式直方图的方法示例
2017/08/09 Python
Django admin实现图书管理系统菜鸟级教程完整实例
2017/12/12 Python
Python机器学习之决策树算法
2017/12/22 Python
python3中函数参数的四种简单用法
2018/07/09 Python
python pandas库的安装和创建
2019/01/10 Python
python中时间转换datetime和pd.to_datetime详析
2019/08/11 Python
超市促销实习自我鉴定
2013/09/23 职场文书
化验室技术员岗位职责
2013/12/24 职场文书
通信研究生自荐信
2014/02/01 职场文书
机械制造毕业生求职信
2014/03/03 职场文书
早会开场白台词大全
2015/06/01 职场文书
一篇文章带你了解Python和Java的正则表达式对比
2021/09/15 Python