编程 Python

Pandas中Series和DataFrame的索引实现

Posted in Python onJune 27, 2019

正文

在对Series对象和DataFrame对象进行索引的时候要明确这么一个概念：是使用下标进行索引，还是使用关键字进行索引。比如list进行索引的时候使用的是下标，而dict索引的时候使用的是关键字。

使用下标索引的时候下标总是从0开始的，而且索引值总是数字。而使用关键字进行索引，关键字是key里面的值，既可以是数字，也可以是字符串等。

Series对象介绍：

Series对象是由索引index和值values组成的，一个index对应一个value。其中index是pandas中的Index对象。values是numpy中的数组对象。

import pandas as pd
s1 = pd.Series([2,3,4,5], index=['a', 'b', 'c', 'd'])
print(s1)
结果：
a  2
b  3
c  4
d  5
dtype: int64

print(s1.index)
结果：
Index(['a', 'b', 'c', 'd'], dtype='object')

print(s1.values)
结果：
[2 3 4 5]

如何对Series对象进行索引？

1：使用index中的值进行索引

print(s1['a'])
结果：
2

print(s1[['a','d']])
结果：
a  2
d  5
dtype: int64


print(s1['b':'d'])
结果（注意，切片索引保存最后一个值）：
b  3
c  4
d  5
dtype: int64

2：使用下标进行索引

print(s1[0])
结果：
2

print(s1[[0,3]])
结果：
a  2
d  5
dtype: int64

print(s1[1:3])
结果（注意：这里和上面不同的是不保存最后一个值，与正常索引相同）：
b  3
c  4
dtype: int64

3：特殊情况：

上面的index为字符串，假如index为数字，这个时候进行索引是按照index值进行还是按照下标进行？

s1 = pd.Series([2,3,4,5], index=[1,2,3,4])
print(s1[2])
结果：
3
print(s1[0]) 会报错

print(s1[[2,4]])
结果：
2  3
4  5
dtype: int64

print(s1[1:3])
结果：
2  3
3  4
dtype: int64

可以看出来，当index为整数的时候，那么前两种选择是使用index的值进行索引，而后一种切片选择使用的是下标进行索引。

4:使用布尔Series进行索引

使用布尔Series进行索引的时候，其实是要求布尔Series和我们的索引对象有相同的index。

s1 = pd.Series([2,3,4,5], index=['a', 'b', 'c', 'd']
print(s1 > 3)
结果（这是一个bool Series）：
a  False
b  False
c   True
d   True
dtype: bool

print(s1[s1 > 3])
结果（只需要把bool Series 传入Series就可以实现索引）：
c  4
d  5
dtype: int64

5：使用Index对象来进行索引

使用Index对象进行索引的时候，和使用值索引没有本质的区别。因为Index里面也存入了很多值，可以把Index看做一个list。

DataFrame对象介绍：

DataFrame对象是一个由行列组成的表。DataFrame中行由columns组成，列由index组成，它们都是Index对象。它的值还是numpy数组。

data = {'name':['ming', 'hong', 'gang', 'tian'], 'age':[12, 13, 14, 20], 'score':[80.3, 88.2, 90, 99.9]}
df1 = pd.DataFrame(data)

print(df1.index)
结果：
RangeIndex(start=0, stop=4, step=1)

print(df1.columns)
结果：
Index(['age', 'name', 'score'], dtype='object')

print(df1.values)
结果：
[[12 'ming' 80.3]
 [13 'hong' 88.2]
 [14 'gang' 90.0]
 [20 'tian' 99.9]]

如何对DataFrame对象进行索引

1：使用columns的值对列进行索引

直接使用columns中的值进行索引，得到的是一列或者是多列的值

print(df1['name'])
结果：
0  ming
1  hong
2  gang
3  tian
Name: name, dtype: object

print(df1[['name','age']])
结果：
name age
0 ming  12
1 hong  13
2 gang  14
3 tian  20
注意：不可以直接使用下标对列进行索引，除非该columns当中包含该值。如下面的操作是错误的
print(df1[0])
结果： 错误

2：切片或者布尔Series对行进行索引

使用切片索引，或者布尔类型Series进行索引：

print(df1[0:3])
使用切片进行选择，结果：
age name score
0  12 ming  80.3
1  13 hong  88.2
2  14 gang  90.0

print(df1[ df1['age'] > 13 ])
使用布尔类型Series进行索引，其实还是要求布尔Series和DataFrame有相同的index，结果：
age name score
2  14 gang  90.0
3  20 tian  99.9

3：使用loc和iloc进行索引

本质上loc是用index和columns当中的值进行索引，而iloc是不理会index和columns当中的值的，永远都是用从0开始的下标进行索引。所以当你搞懂这句话的时候，下面的索引就会变得非常简单：

print(df1.loc[3])
结果：
name   hong
score  88.2
Name: 3, dtype: object

print(df1.loc[:,'age'])
结果：
1  12
3  13
4  14
5  20
Name: age, dtype: int64

print(df1.iloc[3])
结果：
age    20
name   tian
score  99.9
Name: 5, dtype: object

print(df1.iloc[:,1])
结果：
1  ming
3  hong
4  gang
5  tian
Name: name, dtype: object

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持三水点靠木。

Pandas中Series和DataFrame的索引实现

- Author -

小舔哥

声明：登载此文出于传递更多信息之目的，并不意味着赞同其观点或证实其描述。

Python 相关文章推荐

Python中装饰器的一个妙用

Feb 08 Python

Python中处理时间的几种方法小结

Apr 09 Python

Python脚本在Appium库上对移动应用实现自动化测试

Apr 17 Python

Python判断文本中消息重复次数的方法

Apr 27 Python

Python 2.x如何设置命令执行的超时时间实例

Oct 19 Python

在CentOS6上安装Python2.7的解决方法

Jan 09 Python

Python格式化字符串f-string概览(小结)

Jun 18 Python

Django对接支付宝实现支付宝充值金币功能示例

Dec 17 Python

解决在keras中使用model.save()函数保存模型失败的问题

May 21 Python

python json.dumps() json.dump()的区别详解

Jul 14 Python

序列化Python对象的方法

Aug 01 Python

Python3利用openpyxl读写Excel文件的方法实例

Feb 03 Python

Python中使用双下划线防止类属性被覆盖问题

Jun 27 #Python

PyTorch的深度学习入门教程之构建神经网络

Jun 27 #Python

PyTorch的深度学习入门之PyTorch安装和配置

Jun 27 #Python

解决pycharm remote deployment 配置的问题

Jun 27 #Python

python turtle库画一个方格和圆实例

Jun 27 #Python

Python实现的对一个数进行因式分解操作示例

Jun 27 #Python

python pytest进阶之xunit fixture详解

Jun 27 #Python

You might like

骨王战斗力在公会成员中排不进前五，却当选了会长，原因竟是这样

2020/03/02 日漫

刚才在简化php的库，结果发现很多东西

2006/12/31 PHP

PHP使用PDO连接ACCESS数据库

2015/03/05 PHP

php通过文件头判断格式的方法

2016/05/28 PHP

PHP入门教程之字符串处理技巧总结(转换,过滤,解析,查找,截取,替换等)

2016/09/11 PHP

CSS中简写属性要注意TRouBLe的顺序问题(避免踩坑)

2021/03/09 HTML / CSS

九种js弹出对话框的方法总结

2013/03/12 Javascript

通过$(this)使用jQuery包装后的方法或属性

2014/05/18 Javascript

node.js中的Socket.IO使用实例

2014/11/04 Javascript

jQuery自动添加表单项的方法

2015/07/13 Javascript

学习JavaScript设计模式(继承)

2015/11/26 Javascript

JS实现百度搜索接口及链接功能实例代码

2018/02/02 Javascript

详解Immutable及 React 中实践

2018/03/01 Javascript

讲解vue-router之什么是动态路由

2018/05/28 Javascript

bootstrap table合并行数据并居中对齐效果

2018/10/17 Javascript

jQuery实现侧边栏隐藏与显示的方法详解

2018/12/22 jQuery

NodeJS实现一个聊天室功能

2019/11/25 NodeJs

如何在现代JavaScript中编写异步任务

2021/01/31 Javascript

Python设置Socket代理及实现远程摄像头控制的例子

2015/11/13 Python

Python的面向对象编程方式学习笔记

2016/07/12 Python

名片管理系统python版

2018/01/11 Python

Django项目实战之用户头像上传与访问的示例

2018/04/21 Python

Python理解递归的方法总结

2019/01/28 Python

python实现上传文件到linux指定目录的方法

2020/01/03 Python

python爬虫筛选工作实例讲解

2020/11/23 Python

python实现经典排序算法的示例代码

2021/02/07 Python

CSS Grid布局教程之浏览器开启CSS Grid Layout汇总

2014/12/30 HTML / CSS

手工制作的男士奢华英国鞋和服装之家：Goodwin Smith

2019/06/21 全球购物

美国传奇滑手Paul Rodriguez创办的街头滑板品牌：Primitive Skateboarding

2019/10/29 全球购物

渔夫的故事教学反思

2014/02/14 职场文书

小学优秀教育工作者事迹材料

2014/05/09 职场文书

计算机网络专业自荐书

2014/06/09 职场文书

民政局办理协议离婚（范本）

2014/10/25 职场文书

2014年法院工作总结

2014/11/24 职场文书

小学生通知书评语

2014/12/31 职场文书

OpenCV实现反阈值二值化

2021/11/17 Java/Android