对Python 2.7 pandas 中的read_excel详解


Posted in Python onMay 04, 2018

导入pandas模块:

import pandas as pd

使用import读入pandas模块,并且为了方便使用其缩写pd指代。

读入待处理的excel文件:

df = pd.read_excel('log.xls')

通过使用read_excel函数读入excel文件,后面需要替换成excel文件所在的路径。读入之后变为pandas的DataFrame对象。DataFrame是一个面向列(column-oriented)的二维表结构,且含有列表和行标,对excel文件的操作就转换为对DataFrame操作。另外,如果一个excel含有多个表,如果你只想读入其中一个可以:

df = pd.read_excel('log.xls', sheetname=1)

增加了一个参数sheetname,表示的是第几个表,从0开始计数。我上面设置的是1,也就是第二个表。

读入之后,可以先查看表头信息和每一列的数据类型:

df.dtypes

输出如下:

Member   object
Unnamed: 1 float64
Unnamed: 2 float64
Unnamed: 3 float64
Unnamed: 4 float64
Unnamed: 5 float64
家内外活动类型  object
Unnamed: 7  object
activity  object
dtype: object

提取每个member连续出现的最后一行数据:

new_df = df.drop_duplicates(subset='Member', keep='last')

以上语句的意思是根据Member字段去除掉多余的行,并且保留相同行的最后一行数据。这些就得到了每一个member最后一行的数据了,返回了经过筛选后的DataFrame。

接下来需要将处理后的结果,保存为excel文件:

out = pd.ExcelWriter('output.xls')
new_df.to_excel(out)
out.save()

output.xls是你要保存的文件名,可以任取;然后将DataFrame的内容保存到该文件,最后保存该文件到系统的磁盘上。

接下来,你就可以在当前目录看到一个新的文件,可以直接使用excel打开查看。

Pandas还提供了很多的API,可以根据具体的任务,查找API文档,找到合适的函数来完成任务。

附:一个完整的示例

#coding=utf-8
import pandas as pd
 
# 读入excel文件中的第2个表
df = pd.read_excel('log.xls', sheetname=1)
# 查看表的数据类型
print df.dtypes
# 查看Member列的数据
print df['Member']
 
'''
# 新建一列,每一行的值是Member列和activity列相同行值的和
for i in df.index:
 df['activity_2'][i] = df['Member'][i] + df['activity'][i]
'''
 
# 根据Member字段去除掉多余的行,并且保留相同行的最后一行数据
new_df = df.drop_duplicates(subset='Member', keep='last')
# 导出结果
out = pd.ExcelWriter('output.xls')
new_df.to_excel(out)
out.save()

以上这篇对Python 2.7 pandas 中的read_excel详解就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持三水点靠木。

Python 相关文章推荐
python基础教程之常用运算符
Aug 29 Python
在Python中使用模块的教程
Apr 27 Python
python实现JAVA源代码从ANSI到UTF-8的批量转换方法
Aug 10 Python
Python程序员面试题 你必须提前准备!
Jan 16 Python
Python面向对象之继承代码详解
Jan 29 Python
Python实现的维尼吉亚密码算法示例
Apr 12 Python
Python+pandas计算数据相关系数的实例
Jul 03 Python
用Python和WordCloud绘制词云的实现方法(内附让字体清晰的秘笈)
Jan 08 Python
numpy linalg模块的具体使用方法
May 26 Python
PyCharm 配置远程python解释器和在本地修改服务器代码
Jul 23 Python
Django实现celery定时任务过程解析
Apr 21 Python
7个关于Python的经典基础案例
Nov 07 Python
Python3读取Excel数据存入MySQL的方法
May 04 #Python
详解Django之admin组件的使用和源码剖析
May 04 #Python
Python实现正弦信号的时域波形和频谱图示例【基于matplotlib】
May 04 #Python
使用python3+xlrd解析Excel的实例
May 04 #Python
对python中的xlsxwriter库简单分析
May 04 #Python
使用实现XlsxWriter创建Excel文件并编辑
May 04 #Python
Python实现获取前100组勾股数的方法示例
May 04 #Python
You might like
解析thinkphp中的M()与D()方法的区别
2013/06/22 PHP
php的ajax简单实例
2014/02/27 PHP
用javascript实现兼容IE7的类库 IE7_0_9.zip提供下载
2007/08/08 Javascript
javascript 实用的文字链提示框效果
2010/06/30 Javascript
JQuery文本框高亮显示插件代码
2011/04/02 Javascript
JS 添加千分位与去掉千分位的示例
2013/07/11 Javascript
JS操作Cookies的小例子
2013/10/15 Javascript
JavaScript避免内存泄露及内存管理技巧
2014/09/05 Javascript
node.js中的buffer.Buffer.isBuffer方法使用说明
2014/12/14 Javascript
纯js代码实现未知宽高的元素在指定元素中垂直水平居中显示
2015/09/12 Javascript
jQuery获取table行数并输出单元格内容的实现方法
2016/06/30 Javascript
Nodejs实现爬虫抓取数据实例解析
2018/07/05 NodeJs
五句话帮你轻松搞定js原型链
2020/12/09 Javascript
Python入门篇之列表和元组
2014/10/17 Python
Python ftp上传文件
2016/02/13 Python
python用reduce和map把字符串转为数字的方法
2016/12/19 Python
Python学习入门之区块链详解
2017/07/25 Python
Python语言描述最大连续子序列和
2017/12/05 Python
如何使用django的MTV开发模式返回一个网页
2019/07/22 Python
Python栈的实现方法示例【列表、单链表】
2020/02/22 Python
python能否java成为主流语言吗
2020/06/22 Python
canvas 绘图时位置偏离的问题解决
2020/09/16 HTML / CSS
Html5基于canvas实现电子签名并生成PDF文档
2020/12/07 HTML / CSS
简述安装Slackware Linux系统的过程
2012/01/12 面试题
企业厂长岗位职责
2013/12/17 职场文书
行政副总岗位职责
2014/02/23 职场文书
婚礼主持结束词
2014/03/13 职场文书
公证委托书模板
2014/04/03 职场文书
优质服务演讲稿
2014/05/14 职场文书
志愿者事迹材料
2014/12/26 职场文书
单位实习鉴定评语
2015/01/04 职场文书
恋恋笔记本观后感
2015/06/16 职场文书
行为规范主题班会
2015/08/13 职场文书
python 定义函数 返回值只取其中一个的实现
2021/05/21 Python
使用 Docker Compose 构建复杂的多容器App
2022/04/30 Servers
Python编写车票订购系统 Python实现快递收费系统
2022/08/14 Python