百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术资源 > 正文

02《Python 办公自动化教程》操作 Excel 数据表:数据读取

off999 2024-09-20 22:42 44 浏览 0 评论

从这节课开始,我们就正式的进入 Python 办公自动化的学习中去了,上一个小节说过我们的课程划分了四部分。那么这节课就是课程第一部分 “Office 自动化” 的第一课:用 Python 操作 Excel 数据表

Excel 由于其直观的界面、出色的计算功能和图表工具,目前已经成为最流行的个人计算机数据处理软件,在日常办公中必不可少。而借助于 Python 可以让用户更加高效的使用 Excel,减少重复性的工作,我们之前也说过,Python 拥有大量的第三方库可以帮助我们完成丰富的场景,这节课我们将学习用来操作 Excel 的第三方库:xlrd。

1. xlrd 模块

xlrd 是一个用于从 Excel 文件(.xls/.xlsx)读取数据和格式化信息的库。在内容正式开始前,建议先回顾下 Excel 文件中的一些名词概念,即工作簿、工作表、行、列、单元格,如下图所示。

1.1 安装

xlrd 是 Python 的第三方库,使用前需要通过以下命令进行安装:

pip install xlrd

1.2 使用步骤

步骤 1:导入 xlrd 模块

通过 import xlrd 完成导入。

import xlrd

步骤 2:加载 Excel 文件

import xlrd
data = xlrd.open_workbook("data.xlsx")

open_workboox () 方法返回当前工作簿的一个实例,后续的操作都是通过这个实例进行。

步骤 3:读取数据

拿到 Excel 的实例后,即可通过 xlrd 模块提供的方法进行数据的读取。

2. xlrd 模块使用

这部分内容我们将针对 Excel 中常用概念:工作表、列、行、单元格,依次对应介绍 xlrd 模块的操作方法。接下来的所有操作都将围绕工作簿 data.xlsx 进行,data.xlsx 中存放的是一份某店铺的销售明细,data.xlsx 中包括 2 个工作表(sheet),每个工作表内容如下图所示:

2.1 xlrd 操作 Excel 工作表

在一个工作簿中可以定义多个工作表(sheet),而数据真正所存放的位置正是在工作表中,所以在开始读取数据前,首先需要对工作表进行操作,常用属性,见下表:

属性

描述

nsheets

获取工作簿中 sheet 的数量

对应代码中访问,如下所示:

import xlrd
data = xlrd.open_workbook("data.xlsx")
print(data.nsheets) # 输出:2 
代码块123

通过上述代码,可以得知在 data.xlsx 文件中,共有 2 个工作表(sheet)。xlrd 操作工作表(sheet)常用方法,见下表。

方法

描述

sheets()

获取所有 sheet 的对象,以列表形式显示

sheet_by_index(sheetx )

根据索引返回对应的 sheet

sheet_by_name(sheet_name )

通过 sheet 名称返回对应 sheet

sheet_names()

返回工作簿中所有 sheet 名称

sheet_loaded(sheet_name_or_index )

通过 sheet 名称或索引判断该 sheet 是否导入成功,返回值为 bool 类型,True 表示已导入,False 表示未导入

unload_sheet(sheet_name_or_index )

通过 sheet 名称或索引取消 sheet 加载

下面来具体看下每个方法的使用:

sheets () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
print(data.sheets()) 
# 输出:[<xlrd.sheet.Sheet object at 0x02A28EB0>, <xlrd.sheet.Sheet object at 0x02A28F30>, <xlrd.sheet.Sheet object at 0x02A28EF0>]
代码块1234

代码解释:sheets () 方法为获取 excel 中所有的工作表(sheet)对象,目前 data.xlsx 中共包含三个 sheet,所以这里输出返回三个 sheet 对象,后续可以通过每个 sheet 对象来对 sheet 中的行、列、单元格进行操作。

sheet_by_index () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
print(data.sheet_by_index(0))
# 输出:<xlrd.sheet.Sheet object at 0x02A08EB0>

代码解释:sheet_by_index () 方法是根据索引获取 excel 中的工作表(sheet),上述代码中传递 0,表示获取索引为 0 的 sheet 对象,可以通过 sheets () 方法的输出结果与 sheet_by_index () 方法的输出结果进行对比,即可发现,第一个 sheet 在内存中的位置是相同的,都是 0x02A08EB0。

sheet_by_name () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
print(data.sheet_by_name("Sheet1"))
# 输出:<xlrd.sheet.Sheet object at 0x02A08EB0>

代码解释:sheet_by_name () 方法是根据工作表名称来获取 excel 中的工作表(sheet),上述代码中传递 “Sheet1”,对应到 data.xlsx 中即第一个工作表。

sheet_names () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
print(data.sheet_names())
# 输出:['Sheet1', 'Sheet2', 'Sheet3']

代码解释:sheet_names () 方法为返回工作簿中所有工作表的名称,本小节中 data.xlsx 共包含 3 个工作表,固这里返回 [‘Sheet1’, ‘Sheet2’, ‘Sheet3’]。

sheet_loaded () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
print(data.sheet_loaded(0))
# 输出:True

代码解释:sheet_loaded () 方法表示指定工作表是否已导入(加载),返回值为布尔类型,其中参数可以为索引或工作表名称,代码中传递为 0,表示检查第一个工作表是否已导入(加载),xlrd 模块在使用 open_workbook () 方法加载工作簿时,其所有工作表均已加载完成,所以在输出时,输出 True。

unload_sheet () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
print(data.sheet_loaded(0))#输出:True
data.unload_sheet(0)
print(data.sheet_loaded(0))#输出:False
print(data.sheet_loaded(1))#输出:True

代码解释:unload_sheet () 方法表示取消指定工作表导入(加载),其中参数可以为索引或工作表名称,代码中传递为 0,表示取消第一个工作表导入(加载),代码中共做了三次输出,第一次为初始判断第一个工作表是否加载,返回 True,第二次输出时,第一个工作表已经被取消加载,固输出 False,第三次输出为第二个工作表是否加载,输出 True。

2.2 xlrd 操作 Excel 列

xlrd 中在工作表中对 Excel 列进行操作,常用属性,见下表。

属性

描述

ncols

获取指定工作表中总列数

对应代码中访问,如下所示:

import xlrd

data=xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(0) 
print(sheet.ncols) #输出 8

想要对 Excel 列进行操作,首先需要找到具体的工作表,在上述代码中,通过 sheet_by_index 方法得到第一个工作表(sheet),工作表索引从 0 开始,对应工作簿中效果为从左到右排列。得到具体的工作表后,访问 ncols 属性输出 8,即表示在 data.xlsx 文件中第一个工作表(sheet)共有 8 列数据。

xlrd 中操作 Excel 列的常用方法,见下表。

方法

描述

col(colx)

返回给定列所有单元格对象组成的列表

col_values(colx[,start_rowx,end_rowx,])

返回给定列中单元格的值

col_types(colx[,start_rowx,end_rowx,])

返回给定列中单元格类型

下面来具体看下每个方法的使用:

col () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(0)
print(sheet.col(1))
#输出:[empty:'', text:'货号', text:'X0001', text:'X0002', text:'X0003', text:'X0004', text:'X0005', text:'X0006', text:'X0007', text:'X0008', text:'X0009']

代码解释:col () 方法返回指定列所有单元格对象组成的列表,代码中传递 1,表示获取索引为 1 的列,由于索引从 0 开始,即表示获取的是第 2 列的所有单元格对象。

col_values () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(0)
print(sheet.col_values(1))
#输出:['', '货号', 'X0001', 'X0002', 'X0003', 'X0004', 'X0005', 'X0006', 'X0007', 'X0008', 'X0009']

代码解释:col_values () 方法返回指定列所有单元格的值,代码中传递 1,即表示获取的是第 2 列的所有单元格的值,以列表的形式返回。

col_types () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(0)
print(sheet.col_types(4))
#输出:[0, 1, 2, 2, 2, 2, 2, 2, 2, 2, 2]

代码解释:col_types () 方法返回指定列所有单元格的类型,代码中传递 5,表示获取索引为 4 的列,由于索引从 0 开始,即表示获取的是第 5 列的所有单元格的类型。返回结果中,0 表示空,1 表示字符串,2 表示数字。

2.3 xlrd 操作 Excel 行

xlrd 中在工作表中对 Excel 行进行操作,常用属性,见下表。

属性

描述

nrows

获取指定工作表中总行数

对应代码中访问,如下所示:

import xlrd

data=xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(0)
print(sheet.nrows) #输出 4
代码块12345

在上述代码中,通过 sheet_by_index 方法得到第一个工作表(sheet),访问 nrows 属性输出 4,即表示在 data.xlsx 文件中第一个工作表(sheet)共有 4 行数据。

xlrd 中操作 Excel 行的常用方法,见下表。

方法

描述

row(rowx)

返回给定行所有单元格对象

row_values(rowx[,start_colx,end_colx,])

返回给定行中单元格的值

row_types(rowx[,start_colx,end_colx,])

返回给定行中单元格类型

下面来具体看下每个方法的使用:

row () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(1)
print(sheet.row(1))
#输出:[text:'日期', text:'货号', text:'颜色', text:'尺码', text:'原价', text:'折扣', text:'备注']
代码块12345

代码解释:row () 方法返回指定行所有单元格对象组成的列表,代码中传递 1,表示获取索引为 1 的行,由于索引从 0 开始,即表示获取的是第 2 行的所有单元格对象。

row_values () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(1)
print(sheet.row_values(1))
#输出:['日期', '货号', '颜色', '尺码', '原价', '折扣', '备注']
代码块12345

代码解释:row_values () 方法返回指定行所有单元格的值,代码中传递 1,即表示获取的是第 2 行的所有单元格的值,以列表的形式返回。

row_types () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(0)
print(sheet.row_types(3))
#输出:array('B', [1, 1, 1, 1, 2, 2, 1])
代码块12345

代码解释:row_types () 方法返回指定行所有单元格的类型,代码中传递 3,表示获取索引为 3 的行,由于索引从 0 开始,即表示获取的是第 4 行的所有单元格的类型。返回结果中,1 表示空,2 表示数字。

2.4 xlrd 操作 Excel 单元格

单元格即表格中行与列的交叉部分,具体的内容也是写在单元格中,在获取单元格内容时需要通过行和列进行定位。常用操作单元格方法,见下表。

方法

描述

cell(rowx,colx)

返回指定行和列中单元格对象

cell_value(rowx,colx)

返回指定行和列中单元格的值

cell_type(rowx,colx)

返回指定行和列中单元格的类型

下面来具体看下每个方法的使用:

cell () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(0)
print(sheet.cell(1,2))
#输出:text:'颜色'
代码块12345

代码解释:cell () 方法根据指定的行索引和列索引,返回指定单元格对象。代码中传递 1,2,表示获取行所以为 1,列索引为 2 的单元格对象,即第 2 行第 3 列的单元格对象。

cell_value () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(1)
print(sheet.cell_value(1,2))
#输出:颜色
代码块12345

代码解释:cell_value () 方法返回指定行索引和列索引符合条件的单元格的值。代码中传递 1,2,即第 2 行第 3 列的单元格的值。

cell_type () 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(0)
print(sheet.cell_type(1,2))
#输出:1
代码块12345

代码解释:cell_type () 方法返回指定行索引和列索引符合条件的单元格类型。代码中传递 1,2,即第 2 行第 3 列的单元格类型,输出结果 1 表示为字符串类型。

除了上述方法可以获取到单元格中内容之外,也可以在获取到单元格对象后,通过单元格对象属性对单元格的值、类型进行获取,见下表。

属性

描述

ctype

获取单元格数据类型

value

获取单元格中的值

下面来具体看下每个属性的使用:

ctype 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(0)
print(sheet.cell(1,2).ctype)
#输出:1
代码块12345

代码解释:获取到单元格对象后,通过 ctype 属性来获取单元格数据类型。代码中通过 cell (1,2) 表示获取到了行索引为 1,列索引为 2 的单元格对象,通过 ctype 属性获取单元格类型,输出 1 表示为字符串类型。

value 方法

import xlrd
data = xlrd.open_workbook("data.xlsx")
sheet=data.sheet_by_index(0)
print(sheet.cell(1,2).value)
#输出:颜色
代码块12345

代码解释:获取到单元格对象后,通过 value 属性来获取单元格的值。代码中通过 cell (1,2) 表示获取到了行索引为 1,列索引为 2 的单元格对象,通过 value 属性获取单元格的值。

3. 小结

本节课程我们主要学习了 xlrd 模块的使用。本节课程的重点如下:

  • 回顾 Excel 中各名词概念;
  • 了解 xlrd 模块作用及使用步骤;
  • 掌握 xlrd 模块操作 Excel 工作表(sheet)、行、列、单元格的常用属性和方法。

相关推荐

路由器账号和密码忘了怎么办

你好,如果你忘记了路由器的用户名和密码,你可以尝试重置一下路由器,大多数路由器都配备了一个复位按键。在重置路由器之后,用户名和密码将被还原为默认值,你可以在路由器的用户手册或厂家网站上找到默认的用户名...

win10永久禁止自动更新(win10禁止自动更新彻底)

阻止Windows10自动更新的方法如下:使用“本地组策略编辑器”:按下“Win+R”键,输入“gpedit.msc”打开本地组策略编辑器,找到“计算机配置”>“管理模板”>“W...

联想笔记本怎么看配置和型号

联想笔记本看配置的方法如下1、打开电脑,点击桌面的计算机,右键菜单里选择【属性】;打开后,即可看到电脑系统的大概信息;2、如果要看比较详细的设备相关信息,点击桌面的计算机,点击右键,在菜单里选择【系统...

怎样把打印机连接到电脑上(怎么把打印机连接电脑上)
  • 怎样把打印机连接到电脑上(怎么把打印机连接电脑上)
  • 怎样把打印机连接到电脑上(怎么把打印机连接电脑上)
  • 怎样把打印机连接到电脑上(怎么把打印机连接电脑上)
  • 怎样把打印机连接到电脑上(怎么把打印机连接电脑上)
photoshop6序列号(photoshop8.01序列号)
  • photoshop6序列号(photoshop8.01序列号)
  • photoshop6序列号(photoshop8.01序列号)
  • photoshop6序列号(photoshop8.01序列号)
  • photoshop6序列号(photoshop8.01序列号)
win10下载应用商店(win10应用商店打不开)

1、点击Win10系统的开始菜单,然后在点击应用商店;2、打开Win10应用商店后,在搜索框里输入想要搜索的应用软件,然后点击检索;3、点击搜索到的应用,点击安装;4、点击安装后,系统会提示要切换到这...

dell电脑重装系统win10(dell 重装win10系统)

戴尔笔记本重装系统win10的步骤如下:制作好wepe启动盘之后,将win10系统iso镜像直接复制到U盘。在需要重装系统的戴尔电脑上插入pe启动盘,重启后不停按F12启动快捷键,调出启动菜单对话框,...

android升级包下载安装(android 升级包)

打开手机系统更新升级,前提是官方有新系统推送才能更新  哪个大不一定,但一般规律如下:  1、小版本的更新,通常越更新越大。比如3.1更新到3.2,通常是修复bug,代码量通常会增大,体积就会增大。 ...

hdd硬盘和ssd(ssd硬盘和hdd硬盘是什么意思)

HDD硬盘和SSD硬盘是两种不同类型的电脑存储设备,它们有着以下区别:1.工作原理:HDD硬盘使用机械旋转的磁盘和读写磁头来存储和读取数据,而SSD硬盘则使用闪存存储数据,类似于USB闪存盘。2....

电脑免费软件下载大全(电脑上免费的下载软件)

正常情况下,如果我们想要在自己的电脑上面下载一个不要钱的单机游戏,那么我们是可以直接在我们的软件管理中心进行一个下载的,这个时候我们只需要通过一个权限就能够正常的下载,当然我们也是可以在一些小游戏的软...

mpp文件转换excel(mpp转换成pdf)

要将Excel表格转换为MPP格式,您可以按照以下步骤操作:1.打开Excel表格并确保数据按照项目的不同阶段或任务进行组织。2.将Excel表格中的数据复制到一个新的MicrosoftProj...

win7旗舰版开机密码忘记按f2

方法如下:开始-控制面板-用户帐户;在打开的更改用户帐户界面点击要更改的帐户;然后点击帐户左面的更改密码按钮;在打开的页面上,输入一次当前使用的密码,输入2次要更改的新密码然后保存退出就可以了...

笔记本无音频输出设备(笔记本无音频输出设备)

1、没有声卡驱动,解决方法就是找到笔记本的官网,下载电脑声卡的驱动安装即可。2、没有外界的音频播放设备,解决方法就是买一个外界的音频播放设备插到电脑主机的音频接口上即可。笔记本电脑显示未安装任何音频输...

iso文件能用手机打开吗(iso文件能用手机打开吗安全吗)

一般的压缩软件就可以打开的,比如,好压软件,这个打开只是解压形式的,如果你说的是运行iso文件,这个没有,况且安卓系统也不支持iso运行ISO文件一般用于光盘镜像文件的存储,如果想要在手机上运行ISO...

win7系统卡顿怎么优化(win7很慢很卡怎么优化)

1、首先打开安全卫士,进入安全卫士首页,单击软件窗口右下角的“更多”图标,打开扩展应用程序。2、单击选择“我的工具”。3、在我的工具菜单里面找到“人工服务”单击打开人工服务。4、在人工服务对话框有很多...

取消回复欢迎 发表评论: