百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术资源 > 正文

Python玩转Excel,使用Python读取Excel文件如此简单!

off999 2024-09-20 22:42 32 浏览 0 评论

在数据分析中,常用的Excel文件格式有两种,一种是.xlsx格式,另一种是.csv格式,这里以导入.csv格式的文件为例,借助于Python中的pandas库导入Excel数据。

pandas是一个强大的Python数据分析库,其中包含了很多CSV文件数据的读写操作,这里主要介绍pandas读取CSV文件和写入CSV文件,以下是一些需要掌握的操作:

这里推荐使用jupyter notebook,打开jupyter notebook的界面如下,要写代码可以在new中新建一个Python3。

首先导入pandas包,该数据分析包可以做多种数据处理。

学习一个函数最佳的就是学习其参数,只要掌握其参数含义,就能使用其函数的用法了,这里介绍一个使用jupyter notebook的小技巧,当输入pd.read_csv(),却不知道里面包含哪些参数时,可以在括号()里使用电脑快捷键Shift+Tab键,就可以调出其参数。

比如这里pd.read_csv()包含如下一些参数:

pd.read_csv(filepath_or_buffer: Union[str, pathlib.Path, IO[~AnyStr]], sep=',', delimiter=None, 
            header='infer', names=None, index_col=None, usecols=None, squeeze=False, prefix=None, 
            mangle_dupe_cols=True, dtype=None, engine=None, converters=None, true_values=None, 
            false_values=None, skipinitialspace=False, skiprows=None, skipfooter=0, nrows=None, 
            na_values=None, keep_default_na=True, na_filter=True, verbose=False, skip_blank_lines=True, 
            parse_dates=False, infer_datetime_format=False, keep_date_col=False, date_parser=None, 
            dayfirst=False, cache_dates=True, iterator=False, chunksize=None, compression='infer', 
            thousands=None, decimal: str = '.', lineterminator=None, quotechar='"', quoting=0, 
            doublequote=True, escapechar=None, comment=None, encoding=None, dialect=None, 
            error_bad_lines=True, warn_bad_lines=True, delim_whitespace=False, low_memory=True, 
            memory_map=False, float_precision=None)

1. 读取 CSV 文件:

使用 Pandas 的 read_csv() 方法可以轻松地读取 CSV 文件。需要提供以下参数:

  • filepath_or_buffer: 文件路径,或者是有 read 方法的流对象。
  • sep: 分隔符,默认是逗号。
  • header: 指定哪行作为列的名称,如果没有行作为列名,那么应该设置 header=None,并且设置 names 参数。
  • names: 在 CSV 文件中没有一行来存储列名,可以使用 names 自己指定,并且设置 header=None。
  • index_col: 使用哪一列作为行索引,可以是列的位置,也可以是列的名称。如果没有指定,那么默认会自动生成一个顺序索引。
  • usecols: 加载哪几列。只加载某几列可以使用此参数。

2. 写入 CSV 文件:

Pandas 的 to_csv() 方法可以轻松地将数据写入 CSV 文件,pd.read_csv()包含如下一些参数:

df.to_csv(path_or_buf: Union[str, pathlib.Path, IO[~AnyStr], NoneType] = None, sep: str = ',', 
          na_rep: str = '', float_format: Union[str, NoneType] = None, 
          columns: Union[Sequence[Union[Hashable, NoneType]], NoneType] = None,
          header: Union[bool, List[str]] = True, index: bool = True, 
          index_label: Union[bool, str, Sequence[Union[Hashable, NoneType]], 
          NoneType] = None, mode: str = 'w', encoding: Union[str, NoneType] = None, 
          compression: Union[str, Mapping[str, str], NoneType] = 'infer', 
          quoting: Union[int, NoneType] = None, quotechar: str = '"', 
          line_terminator: Union[str, NoneType] = None, chunksize: Union[int, NoneType] = None, date_format: Union[str, NoneType] = None, doublequote: bool = True, escapechar: Union[str, NoneType] = None, decimal: Union[str, NoneType] = '.', errors: str = 'strict') -> Union[str, NoneType]
  • data: 要写入的数据。
  • sep: 分隔符,默认是逗号。
  • header: 指定哪行作为列的名称,如果没有行作为列名,那么应该设置 header=None,并且设置 names 参数。
  • names: 在 CSV 文件中没有一行来存储列名,可以使用 names 自己指定,并且设置 header=None。
  • index_col: 使用哪一列作为行索引,可以是列的位置,也可以是列的名称。如果没有指定,那么默认会自动生成一个顺序索引。

以上介绍pandas中CSV文件的读写功能,还需大家在实践中加深理解,通过pandas学习,可以看到Python在数据处理中的优势,如果你想学习更多关于Python数据分析的内容,可以关注我,持续分享数据分析内容~

相关推荐

显示器闪屏是什么原因(显示器闪屏是哪里坏了)

解决方法:  一、接触不良导致的显示器闪屏  先查看主机和显示器的电源线连接,是否松动,重新插拔一下电源线。  二、信号干扰导致的显示器闪屏  1、连接显示器的电缆线是否没有屏蔽线圈,如果没有防干扰的...

国产linux操作系统(国产linux操作系统有什么版本)

中国对于操作系统的探索其实并不晚。  早在20世纪60年代中期中国就开始操作系统的研发,那时的比尔·盖茨还只是个迷恋计算机的小字辈,南京大学教授孙钟秀、北京大学杨芙清院士等都是我国操作系统的拓荒者...

免费无需排队的云电脑(不需要排队的云电脑)

目前市场上有一些云游戏平台提供无限时长且无需排队的服务。这些平台通常采用先进的云计算技术和高性能服务器,能够提供稳定流畅的游戏体验。用户可以随时登录并畅玩游戏,无需等待排队。这些平台还提供多种游戏选择...

视频播放器下载量排名(2020视频播放器排行榜)
  • 视频播放器下载量排名(2020视频播放器排行榜)
  • 视频播放器下载量排名(2020视频播放器排行榜)
  • 视频播放器下载量排名(2020视频播放器排行榜)
  • 视频播放器下载量排名(2020视频播放器排行榜)
wps官方下载(wps官方下载官网电脑版网址)

具体的步骤如下:1、首先在电脑上打开浏览器,在浏览器中输入“WPS”,找到WPS官方网站。2、接下来进入WPS官方网站中,找到WPS软件,点击“免费下载”。3、点击下载后在弹出来的对话框中修改下载位置...

win vista与win7有什么区别(win7与vista关系)

WindowsVista和Windows7是微软公司推出的两个桌面操作系统,它们之间有以下主要区别:1.界面设计:Windows7的界面设计更加简洁明了,而WindowsVista的界面...

winxp系统版本(winxp 版本)

1、微软官方3个版本:WINDOWSXPHOME(家庭版)、Professional(专业版)、MediaCenter2005(媒体中心版),每个版本的功能不一样。使用最多的是Professional...

打印机无法共享怎么回事(打印机无法共享出去)

共享打印机无法打印原因一:可能是由于病毒死机解决方法:确定是否由于病毒死机,找一张干净(确信无病毒)的系统盘,从A驱动舒上启动电脑,检查此时打印机和主机能否联机。如果正常联机,估计这种故障是由攻击硬件...

ipv6无网络访问权限怎么解决

ipv6无网络访问权限解决方法如下1、点击电脑左下角的开始,进入到开始的菜单栏,在菜单栏中找到“运行”。或者通过快捷键Windows+R打开运行窗口。  2、打开运行的窗口页面后,在页面上输入“CMD...

office ltsc版(Office LTSC版本区别)

office2021和2021ltsc的区别如下:1.更新策略不同。前者采用每个月月度更新的方法,提供功能更新、安全更新。后者不采用每个月月度更新的方法,且不提供功能更新。2.界面不同。2021采用了...

安装win7需要激活吗(现在安装win7旗舰版还需密钥吗)

要激活  Windows7如果是预装在计算机中的,买来之后便不用激活,这里预装指的是在厂商那里。正版的Windows7安装到计算机中,有三十天的试用期,若要永久使用,就要使...

originos 3升级计划公布(originos升级包)

2023年2月。1.OriginOS3.0系统第一批升级时间为11月25日。2、包含iQOONeo7,X80系列,S15系列,iQOO9、iQOO10系列,以及折叠屏XFold系列和大屏XNo...

鸿蒙系统适配第三方机型(鸿蒙 第三方适配)

最新华为官方公布了鸿蒙系统3.0支持的机型名单,具体如下。鸿蒙系统3.0升级名单:1.Mate系列:MateXs2、MateX2、MateXs、Mate40、Mate40Pro、Mate...

imei怎么下载(imei changer apk)

如果您的steam序列号激活了,可以尝试以下方法下载:1.使用steam自带的下载工具,如“下载工具”,在软件的“下载”选项卡中选择“序列号下载”。2.在下载页面中,选择要下载的游戏,然后点击“下...

电脑系统优化软件哪个好(系统优化软件排行榜)

有必要用,非常好用,WINDOWS优化大师是一个网络上下载率极高的系统维护软件。多年未曾清理过系统和硬盘的电脑,系统内部将产生大量的垃圾文件、临时文件、废旧程序等等win10系统不需要经常更新,关闭...

取消回复欢迎 发表评论: