百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术资源 > 正文

测开不得不会的python之xlrd库读取excel表内容

off999 2024-09-20 22:42 28 浏览 0 评论

学习目录

了解下电脑中的excel表格文件格式

安装xlrd库

xlrd库读取表格内容

1 先准备一个表格‘表格.xls’,表格中包含两个sheet页

2 导入xlrd库

3 用一个图展示下xlrd常用的函数

4 分别展示下表格中按行/按列/按单元格获取的内容

5 拓展内容

excel表格是大家经常用到的文件格式,各行各业都会跟它打交道。本次我们介绍经常用到的两个经典库,xlrd和xlwt,xlrd用于读取excel表格内容,xlwt用于写入excel表格内容。

了解下电脑中的excel表格文件格式

微软或者金山的excel表格编辑保存时一般要选择文件后缀,有xls和xlsx两类。

xls和xlsx后缀文件的主要区别:

  • 文件格式:xls是二进制格式,而xlsx是基于XML的压缩方式。
  • 版本:xls是Excel 2003及以前版本生成的文件格式,而xlsx是Excel 2007及以后版本生成的文件格式。
  • 兼容性:xlsx格式向下兼容,而xls格式不支持向后兼容。

安装xlrd库

pip install xlrd -i https://mirrors.aliyun.com/pypi/simple/

xlrd库默认安装最新的库,新版本的xlrd只支持.xls文件,如果需要读取.xlsx文件时需要安装旧版本(比如指定版本xlrd==1.2.0)。

xlrd库读取表格内容

1 先准备一个表格‘表格.xls’,表格中包含两个sheet页。

2 导入xlrd库

执行import xlrd导入该库

3 用一个图展示下xlrd常用的函数

4 分别展示下表格中按行/按列/按单元格获取的内容

  1. 按行获取内容
  • 获取总行数
#打开表格
data = xlrd.open_workbook('表格.xls')
#获取sheet1的内容
sheet1 = data.sheets()[0]
#行数
sheet1_nrows = sheet1.nrows
print(f'sheet1 行数:{sheet1_nrows}')
#结果
sheet1 行数:4
  • row()函数获取的内容
for i in range(sheet1_nrows):
  sheet1_row_content = sheet1.row(i)
  print(f'sheet1 第{i+1}行内容:{sheet1_row_content}')

#结果:
sheet1 第1行内容:[text:'user', text:'age']
sheet1 第2行内容:[text:'lili', number:21.0]
sheet1 第3行内容:[text:'zhangsan', number:13.0]
sheet1 第4行内容:[text:'lisi', number:35.0]
  • row_values()函数获取的内容
for i in range(sheet1_nrows):
  sheet1_row_content = sheet1.row_values(i)
  print(f'sheet1 第{i+1}行内容:{sheet1_row_content}')
#结果
sheet1 第1行内容:['user', 'age']
sheet1 第2行内容:['lili', 21.0]
sheet1 第3行内容:['zhangsan', 13.0]
sheet1 第4行内容:['lisi', 35.0]
  • get_rows()函数返回一个生成器,也是可迭代对象
for i in sheet1.get_rows():
  print(f'sheet1 中的行内容:{i}')
#结果:
sheet1 中的行内容:[text:'user', text:'age']
sheet1 中的行内容:[text:'lili', number:21.0]
sheet1 中的行内容:[text:'zhangsan', number:13.0]
sheet1 中的行内容:[text:'lisi', number:35.0]

2 按列获取内容

  • 获取总列数
sheet1_ncols = sheet1.ncols
print(f'sheet1 列数:{sheet1_ncols}')
  • col()函数获取的内容
for i in range(sheet1_ncols):
  sheet1_col_content = sheet1.col(i)
  print(f'sheet1 第{i+1}列内容:{sheet1_col_content}')
#结果:
sheet1 第1列内容:[text:'user', text:'lili', text:'zhangsan', text:'lisi']
sheet1 第2列内容:[text:'age', number:21.0, number:13.0, number:35.0]
  • col_values()函数获取的内容
for i in range(sheet1_ncols):
  sheet1_col_content = sheet1.col_values(i)
  print(f'sheet1 第{i+1}列内容:{sheet1_col_content}')
#结果
sheet1 第1列内容:['user', 'lili', 'zhangsan', 'lisi']
sheet1 第2列内容:['age', 21.0, 13.0, 35.0]

3 按单元格获取内容

print(f'sheet1 第1行 第2列内容:{sheet1.cell(0, 1).value}')
print(f'sheet1 第2行 第2列内容:{sheet1.cell_value(1, 1)}')
print(f'sheet1 第1行 第1列内容:{sheet1.row(0)[0].value}')
#结果:
sheet1 第1行 第2列内容:age
sheet1 第2行 第2列内容:21.0
sheet1 第1行 第1列内容:user

5 拓展内容

1)表格中数据类型介绍

0 - empty, 1 - text, 2 - number, 3 - date, 4 - boolean, 5 - error

表格sheet3中有如下内容:

获取数据类型如下:

sheet3 = data.sheets()[2]

row_type = sheet3.row_types(0)
print(row_type)

col_type = sheet3.col_types(1)
print(col_type)

cell_type = sheet3.cell_type(0,3)
print(cell_type)

#结果:
array('B', [0, 1, 2, 3, 4, 1])
[1]
3

2 获取行内容时发现填写的2023年10月8日返回的是数字

cell_content = sheet3.cell(0,3).value
print(cell_content)
#结果:
45207.0

原来excel表中的日期会被python根据一个时间基准计算出相差的的天数(1900-01-01和1904-01-01基准)

解决方法:使用xlrd.xldate.xldate_as_datetime函数处理得到的数字,它会返回datetime对象,用strftime把它转化成指定格式的字符串。

print(xlrd.xldate.xldate_as_datetime(cell_content,0).strftime("%Y/%m/%d"))
结果:2023/10/08


----感谢读者的阅读和学习,谢谢大家。


共勉: 东汉·班固《汉书·枚乘传》:“泰山之管穿石,单极之绠断干。水非石之钻,索非木之锯,渐靡使之然也。”

-----指水滴不断地滴,可以滴穿石头;

-----比喻坚持不懈,集细微的力量也能成就难能的功劳。

相关推荐

Linux 网络协议栈_linux网络协议栈

前言;更多学习资料(包含视频、技术学习路线图谱、文档等)后台私信《资料》免费领取技术点包含了C/C++,Linux,Nginx,ZeroMQ,MySQL,Redis,fastdfs,MongoDB,Z...

揭秘 BPF map 前生今世_bpfdm

1.前言众所周知,map可用于内核BPF程序和用户应用程序之间实现双向的数据交换,为BPF技术中的重要基础数据结构。在BPF程序中可以通过声明structbpf_map_def...

教你简单 提取fmpeg 视频,音频,字幕 方法

ffmpeg提取视频,音频,字幕方法(HowtoExtractVideo,Audio,SubtitlefromOriginalVideo?)1.提取视频(ExtractVi...

Linux内核原理到代码详解《内核视频教程》

Linux内核原理-进程入门进程进程不仅仅是一段可执行程序的代码,通常进程还包括其他资源,比如打开的文件,挂起的信号,内核内部的数据结构,处理器状态,内存地址空间,或多个执行线程,存放全局变量的数据段...

Linux C Socket UDP编程详解及实例分享

1、UDP网络编程主要流程UDP协议的程序设计框架,客户端和服务器之间的差别在于服务器必须使用bind()函数来绑定侦听的本地UDP端口,而客户端则可以不进行绑定,直接发送到服务器地址的某个端口地址。...

libevent源码分析之bufferevent使用详解

libevent的bufferevent在event的基础上自己维护了一个buffer,这样的话,就不需要再自己管理一个buffer了。先看看structbufferevent这个结构体struct...

一次解决Linux内核内存泄漏实战全过程

什么是内存泄漏:程序向系统申请内存,使用完不需要之后,不释放内存还给系统回收,造成申请的内存被浪费.发现系统中内存使用量随着时间的流逝,消耗的越来越多,例如下图所示:接下来的排查思路是:1.监控系统中...

彻底搞清楚内存泄漏的原因,如何避免内存泄漏,如何定位内存泄漏

作为C/C++开发人员,内存泄漏是最容易遇到的问题之一,这是由C/C++语言的特性引起的。C/C++语言与其他语言不同,需要开发者去申请和释放内存,即需要开发者去管理内存,如果内存使用不当,就容易造成...

linux网络编程常见API详解_linux网络编程视频教程

Linux网络编程API函数初步剖析今天我们来分析一下前几篇博文中提到的网络编程中几个核心的API,探究一下当我们调用每个API时,内核中具体做了哪些准备和初始化工作。1、socket(family...

Linux下C++访问web—使用libcurl库调用http接口发送解析json数据

一、背景这两天由于一些原因研究了研究如何在客户端C++代码中调用web服务端接口,需要访问url,并传入json数据,拿到返回值,并解析。 现在的情形是远程服务端的接口参数和返回类型都是json的字符...

平衡感知调节:“系统如人” 视角下的架构设计与业务稳定之道

在今天这个到处都是数字化的时代,系统可不是一堆冷冰冰的代码。它就像一个活生生的“数字人”,没了它,业务根本转不起来。总说“技术要为业务服务”,但实际操作起来问题不少:系统怎么才能快速响应业务需求?...

谈谈分布式文件系统下的本地缓存_什么是分布式文件存储

在分布式文件系统中,为了提高系统的性能,常常会引入不同类型的缓存存储系统(算法优化所带来的的效果可能远远不如缓存带来的优化效果)。在软件中缓存存储系统一般可分为了两类:一、分布式缓存,例如:Memca...

进程间通信之信号量semaphore--linux内核剖析

什么是信号量信号量的使用主要是用来保护共享资源,使得资源在一个时刻只有一个进程(线程)所拥有。信号量的值为正的时候,说明它空闲。所测试的线程可以锁定而使用它。若为0,说明它被占用,测试的线程要进入睡眠...

Qt编写推流程序/支持webrtc265/从此不用再转码/打开新世界的大门

一、前言在推流领域,尤其是监控行业,现在主流设备基本上都是265格式的视频流,想要在网页上直接显示监控流,之前的方案是,要么转成hls,要么魔改支持265格式的flv,要么265转成264,如果要追求...

30 分钟搞定 SpringBoot 视频推拉流!实战避坑指南

30分钟搞定SpringBoot视频推拉流!实战避坑指南在音视频开发领域,SpringBoot凭借其快速开发特性,成为很多开发者实现视频推拉流功能的首选框架。但实际开发中,从环境搭建到流处理优...

取消回复欢迎 发表评论: