对Python 2.7 pandas 中的read_excel详解

作者:G_66_hero 时间:2023-09-10 04:14:49 

导入pandas模块:


import pandas as pd

使用import读入pandas模块,并且为了方便使用其缩写pd指代。

读入待处理的excel文件:


df = pd.read_excel('log.xls')

通过使用read_excel函数读入excel文件,后面需要替换成excel文件所在的路径。读入之后变为pandas的DataFrame对象。DataFrame是一个面向列(column-oriented)的二维表结构,且含有列表和行标,对excel文件的操作就转换为对DataFrame操作。另外,如果一个excel含有多个表,如果你只想读入其中一个可以:


df = pd.read_excel('log.xls', sheetname=1)

增加了一个参数sheetname,表示的是第几个表,从0开始计数。我上面设置的是1,也就是第二个表。

读入之后,可以先查看表头信息和每一列的数据类型:


df.dtypes

输出如下:


Member   object
Unnamed: 1 float64
Unnamed: 2 float64
Unnamed: 3 float64
Unnamed: 4 float64
Unnamed: 5 float64
家内外活动类型  object
Unnamed: 7  object
activity  object
dtype: object

提取每个member连续出现的最后一行数据:


new_df = df.drop_duplicates(subset='Member', keep='last')

以上语句的意思是根据Member字段去除掉多余的行,并且保留相同行的最后一行数据。这些就得到了每一个member最后一行的数据了,返回了经过筛选后的DataFrame。

接下来需要将处理后的结果,保存为excel文件:


out = pd.ExcelWriter('output.xls')
new_df.to_excel(out)
out.save()

output.xls是你要保存的文件名,可以任取;然后将DataFrame的内容保存到该文件,最后保存该文件到系统的磁盘上。

接下来,你就可以在当前目录看到一个新的文件,可以直接使用excel打开查看。

Pandas还提供了很多的API,可以根据具体的任务,查找API文档,找到合适的函数来完成任务。

附:一个完整的示例


#coding=utf-8
import pandas as pd

# 读入excel文件中的第2个表
df = pd.read_excel('log.xls', sheetname=1)
# 查看表的数据类型
print df.dtypes
# 查看Member列的数据
print df['Member']

'''
# 新建一列,每一行的值是Member列和activity列相同行值的和
for i in df.index:
df['activity_2'][i] = df['Member'][i] + df['activity'][i]
'''

# 根据Member字段去除掉多余的行,并且保留相同行的最后一行数据
new_df = df.drop_duplicates(subset='Member', keep='last')
# 导出结果
out = pd.ExcelWriter('output.xls')
new_df.to_excel(out)
out.save()

来源:https://blog.csdn.net/G_66_hero/article/details/71730651

标签:pandas,read,excel,Python,2.7
0
投稿

猜你喜欢

  • SaaS中的用户体验设计

    2009-05-20 12:28:00
  • 详解python中的json和字典dict

    2023-05-16 02:25:26
  • Python实现爬取需要登录的网站完整示例

    2022-08-09 11:40:33
  • keras在构建LSTM模型时对变长序列的处理操作

    2021-12-06 19:17:31
  • Python实现简单的2048小游戏

    2023-04-18 07:19:25
  • Python中itertools的用法详解

    2022-06-05 13:34:52
  • Pytorch模型的保存/复用/迁移实现代码

    2023-12-12 10:37:43
  • Oracle中获取执行计划的几种方法分析

    2023-07-17 15:18:31
  • JS控件ASP.NET的treeview控件全选或者取消(示例代码)

    2024-06-23 17:53:53
  • python的pygal模块绘制反正切函数图像方法

    2021-08-01 18:48:21
  • Python基于os.environ从windows获取环境变量

    2022-09-18 01:42:45
  • php !function_exists("T7FC56270E7A70FA81A5935B72EACBE29"))代码解密

    2023-11-21 14:36:02
  • python中的十大%占位符对应的格式化的使用方法

    2022-04-28 08:54:21
  • Python群发邮件实例代码

    2021-05-05 18:42:35
  • asp连接MYSQL数据库的连接字符串(参数OPTION)

    2009-03-09 18:24:00
  • Python的pdfplumber库将pdf转为图片的实现

    2021-08-31 20:43:27
  • 巧用mysql提示符prompt清晰管理数据库的方法

    2024-01-24 14:05:07
  • Python实现多任务进程示例

    2023-03-04 21:42:09
  • keras回调函数的使用

    2022-08-22 11:42:41
  • 关于Tensorflow中的tf.train.batch函数的使用

    2023-11-04 19:49:54
  • asp之家 网络编程 m.aspxhome.com