Python实现K折交叉验证法的方法步骤


Posted in Python onJuly 11, 2019

学习器在测试集上的误差我们通常称作“泛化误差”。要想得到“泛化误差”首先得将数据集划分为训练集和测试集。那么怎么划分呢?常用的方法有两种,k折交叉验证法和自助法。介绍这两种方法的资料有很多。下面是k折交叉验证法的python实现。

##一个简单的2折交叉验证
from sklearn.model_selection import KFold
import numpy as np
X=np.array([[1,2],[3,4],[1,3],[3,5]])
Y=np.array([1,2,3,4])
KF=KFold(n_splits=2) #建立4折交叉验证方法 查一下KFold函数的参数
for train_index,test_index in KF.split(X):
  print("TRAIN:",train_index,"TEST:",test_index)
  X_train,X_test=X[train_index],X[test_index]
  Y_train,Y_test=Y[train_index],Y[test_index]
  print(X_train,X_test)
  print(Y_train,Y_test)
#小结:KFold这个包 划分k折交叉验证的时候,是以TEST集的顺序为主的,举例来说,如果划分4折交叉验证,那么TEST选取的顺序为[0].[1],[2],[3]。

#提升
import numpy as np
from sklearn.model_selection import KFold
#Sample=np.random.rand(50,15) #建立一个50行12列的随机数组
Sam=np.array(np.random.randn(1000)) #1000个随机数
New_sam=KFold(n_splits=5)
for train_index,test_index in New_sam.split(Sam): #对Sam数据建立5折交叉验证的划分
#for test_index,train_index in New_sam.split(Sam): #默认第一个参数是训练集,第二个参数是测试集
  #print(train_index,test_index)
  Sam_train,Sam_test=Sam[train_index],Sam[test_index]
  print('训练集数量:',Sam_train.shape,'测试集数量:',Sam_test.shape) #结果表明每次划分的数量


#Stratified k-fold 按照百分比划分数据
from sklearn.model_selection import StratifiedKFold
import numpy as np
m=np.array([[1,2],[3,5],[2,4],[5,7],[3,4],[2,7]])
n=np.array([0,0,0,1,1,1])
skf=StratifiedKFold(n_splits=3)
for train_index,test_index in skf.split(m,n):
  print("train",train_index,"test",test_index)
  x_train,x_test=m[train_index],m[test_index]
#Stratified k-fold 按照百分比划分数据
from sklearn.model_selection import StratifiedKFold
import numpy as np
y1=np.array(range(10))
y2=np.array(range(20,30))
y3=np.array(np.random.randn(10))
m=np.append(y1,y2) #生成1000个随机数
m1=np.append(m,y3)
n=[i//10 for i in range(30)] #生成25个重复数据

skf=StratifiedKFold(n_splits=5)
for train_index,test_index in skf.split(m1,n):
  print("train",train_index,"test",test_index)
  x_train,x_test=m1[train_index],m1[test_index]

Python中貌似没有自助法(Bootstrap)现成的包,可能是因为自助法原理不难,所以自主实现难度不大。

以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持三水点靠木。

Python 相关文章推荐
python实现自动登录人人网并访问最近来访者实例
Sep 26 Python
python修改注册表终止360进程实例
Oct 13 Python
通过Python使用saltstack生成服务器资产清单
Mar 01 Python
编写Python爬虫抓取暴走漫画上gif图片的实例分享
Apr 20 Python
Windows下python2.7.8安装图文教程
May 26 Python
Python安装Numpy和matplotlib的方法(推荐)
Nov 02 Python
浅谈python正则的常用方法 覆盖范围70%以上
Mar 14 Python
python统计多维数组的行数和列数实例
Jun 23 Python
python模糊图片过滤的方法
Dec 14 Python
Python中的十大图像处理工具(小结)
Jun 10 Python
关于Python形参打包与解包小技巧分享
Aug 24 Python
如何用Python和JS实现的Web SSH工具
Feb 23 Python
Python获取命令实时输出-原样彩色输出并返回输出结果的示例
Jul 11 #Python
将python运行结果保存至本地文件中的示例讲解
Jul 11 #Python
详解python实现交叉验证法与留出法
Jul 11 #Python
python程序运行进程、使用时间、剩余时间显示功能的实现代码
Jul 11 #Python
Python循环中else,break和continue的用法实例详解
Jul 11 #Python
Python 获取 datax 执行结果保存到数据库的方法
Jul 11 #Python
python opencv捕获摄像头并显示内容的实现
Jul 11 #Python
You might like
基于mysql的论坛(4)
2006/10/09 PHP
php导出csv数据在浏览器中输出提供下载或保存到文件的示例
2014/04/24 PHP
php 升级到 5.3+ 后出现的一些错误,如 ereg(); ereg_replace(); 函数报错
2015/12/07 PHP
php array_pop 删除数组最后一个元素实例
2016/11/02 PHP
php file_get_contents取文件中数组元素的方法
2017/04/01 PHP
php慢查询日志和错误日志使用详解
2021/02/27 PHP
js或css实现滚动广告的几种方案
2010/01/28 Javascript
jQuery拖动图片删除示例
2013/05/10 Javascript
原始的js代码和jquery对比体会
2013/09/10 Javascript
js实现点小图看大图效果的思路及示例代码
2013/10/28 Javascript
Jquery解析json数据详解
2013/12/26 Javascript
利用jQuery和CSS将背景图片拉伸
2015/10/16 Javascript
基于JS实现密码框(password)中显示文字提示功能代码
2016/05/27 Javascript
JavaScript对象数组如何按指定属性和排序方向进行排序
2016/06/15 Javascript
angular.js + require.js构建模块化单页面应用的方法步骤
2017/07/19 Javascript
React Native如何消除启动时白屏的方法
2017/08/08 Javascript
JS获取月的第几周和年的第几周实例代码
2018/12/05 Javascript
微信小程序用户登录和登录态维护的实现
2020/12/10 Javascript
[01:19:46]EG vs Secret 2019国际邀请赛淘汰赛 胜者组 BO3 第二场 8.21.mp4
2020/07/19 DOTA
python按综合、销量排序抓取100页的淘宝商品列表信息
2018/02/24 Python
python求最大值最小值方法总结
2019/06/25 Python
python 实现读取csv数据,分类求和 再写进 csv
2020/05/18 Python
python3中编码获取网页的实例方法
2020/11/16 Python
Python 打印自己设计的字体的实例讲解
2021/01/04 Python
HTML5 CSS3实现一个精美VCD包装盒个性幻灯片案例
2014/06/16 HTML / CSS
HTML5 manifest离线缓存的示例代码
2018/08/08 HTML / CSS
英国排名第一的LED灯泡网站:LED Bulbs
2019/09/03 全球购物
预备党员思想汇报范文
2013/12/29 职场文书
六查六看剖析材料
2014/02/15 职场文书
银行柜员求职自荐书
2014/06/18 职场文书
三严三实心得体会范文
2014/10/13 职场文书
2014普法依法治理工作总结
2014/12/18 职场文书
2016年党课培训学习心得体会
2016/01/07 职场文书
2016小学教师读书心得体会
2016/01/13 职场文书
SQL Server 数据库实验课第五周——常用查询条件
2021/04/05 SQL Server
详解JS WebSocket断开原因和心跳机制
2021/05/07 Javascript