对Python 2.7 pandas 中的read_excel详解

更新时间：2018年05月04日 09:48:15 作者：G_66_hero

今天小编就为大家分享一篇对Python 2.7 pandas 中的read_excel详解，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧

导入pandas模块：

import pandas as pd

使用import读入pandas模块，并且为了方便使用其缩写pd指代。

读入待处理的excel文件：

df = pd.read_excel('log.xls')

通过使用read_excel函数读入excel文件，后面需要替换成excel文件所在的路径。读入之后变为pandas的DataFrame对象。DataFrame是一个面向列(column-oriented)的二维表结构，且含有列表和行标，对excel文件的操作就转换为对DataFrame操作。另外，如果一个excel含有多个表，如果你只想读入其中一个可以：

df = pd.read_excel('log.xls', sheetname=1)

增加了一个参数sheetname，表示的是第几个表，从0开始计数。我上面设置的是1，也就是第二个表。

读入之后，可以先查看表头信息和每一列的数据类型：

df.dtypes

输出如下：

Member   object
Unnamed: 1 float64
Unnamed: 2 float64
Unnamed: 3 float64
Unnamed: 4 float64
Unnamed: 5 float64
家内外活动类型  object
Unnamed: 7  object
activity  object
dtype: object

提取每个member连续出现的最后一行数据：

new_df = df.drop_duplicates(subset='Member', keep='last')

以上语句的意思是根据Member字段去除掉多余的行，并且保留相同行的最后一行数据。这些就得到了每一个member最后一行的数据了，返回了经过筛选后的DataFrame。

接下来需要将处理后的结果，保存为excel文件：

out = pd.ExcelWriter('output.xls')
new_df.to_excel(out)
out.save()

output.xls是你要保存的文件名，可以任取；然后将DataFrame的内容保存到该文件，最后保存该文件到系统的磁盘上。

接下来，你就可以在当前目录看到一个新的文件，可以直接使用excel打开查看。

Pandas还提供了很多的API，可以根据具体的任务，查找API文档，找到合适的函数来完成任务。

附：一个完整的示例

#coding=utf-8
import pandas as pd
 
# 读入excel文件中的第2个表
df = pd.read_excel('log.xls', sheetname=1)
# 查看表的数据类型
print df.dtypes
# 查看Member列的数据
print df['Member']
 
'''
# 新建一列，每一行的值是Member列和activity列相同行值的和
for i in df.index:
 df['activity_2'][i] = df['Member'][i] + df['activity'][i]
'''
 
# 根据Member字段去除掉多余的行，并且保留相同行的最后一行数据
new_df = df.drop_duplicates(subset='Member', keep='last')
# 导出结果
out = pd.ExcelWriter('output.xls')
new_df.to_excel(out)
out.save()

以上这篇对Python 2.7 pandas 中的read_excel详解就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持脚本之家。

您可能感兴趣的文章:

解决pycharm回车之后不能换行或不能缩进的问题
今天小编就为大家分享一篇解决pycharm回车之后不能换行或不能缩进的问题，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2019-01-01
pytorch无法使用GPU问题的解决方法
这篇文章主要介绍了如何解决pytorch 无法使用GPU 的问题,文中通过代码和图文给大家讲解的非常详细,对大家的学习或工作有一定的帮助,需要的朋友可以参考下
2024-02-02
Python实现bilibili时间长度查询的示例代码
这篇文章主要介绍了Python实现bilibili时间长度查询的示例代码，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面随着小编来一起学习学习吧
2020-01-01
Python3.6 之后字典是有序的?
字典数据是有序的, 但是这个序不是由外部控制, 而是内部字典定位机制的序所以对外来讲, 数据本身是无序的你每次遍历的顺序一样, 是因为枚举结果是按内部排序输出而无序则表示在你无法从外部控制最终的输出顺序，下面我们来学习Python字典有序性的相关资料又当怎样吧
2021-12-12
python模拟登录百度代码分享(获取百度贴吧等级)
python模拟登录百度，实现了登录并读取百度关注贴吧列表，百度登录还是有点麻烦的，由于用的ssl，所以要先获取token，然后再登录，这个用finddle2分析下，还是比较好解决的
2013-12-12
python 实现得到当前时间偏移day天后的日期方法
今天小编就为大家分享一篇python 实现得到当前时间偏移day天后的日期方法，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2018-12-12
CentOS下Python3的安装及创建虚拟环境的方法
这篇文章主要介绍了CentOS下Python3的安装及创建虚拟环境的方法,本文给大家介绍的非常详细，具有一定的参考借鉴价值，需要的朋友可以参考下
2018-11-11
Python实现针对json中某个关键字段进行排序操作示例
这篇文章主要介绍了Python实现针对json中某个关键字段进行排序操作,涉及Python json数组排序及lambda表达式相关操作技巧,需要的朋友可以参考下
2018-12-12
对python中的装包与解包实例详解
今天小编就为大家分享一篇对python中的装包与解包实例详解，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧
2019-08-08
详解anaconda安装步骤
这篇文章主要介绍了详解anaconda安装步骤，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面随着小编来一起学习学习吧
2020-11-11

对Python 2.7 pandas 中的read_excel详解

相关文章

最新评论

大家感兴趣的内容

最近更新的内容

常用在线小工具