Numpy第21练:读取文件中的坑,只有理解才能避免!
off999 2024-11-14 16:52 17 浏览 0 评论
在第 20 练中我们了解了如何用numpy读取文本文件及其常用方法的介绍,但其实 Numpy读取文本文件里的细微门道还是挺多的,稍有不注意可能读取的数据就不是自己想要的,我们先来看一个具体的例子:
此时问题就来了,为什么使用dtype为None时得出的ndarray对象是一维的,而将dtype指定为U16时得出的ndarray对象又是二维的呢?
genfromtxt的内部操作
上面的这个疑问其实涉及到了genfromtxt函数如何处理和解析数据,以及dtype参数是如何影响最终数组结构的。
首先,np.genfromtxt是一个用于从文本文件加载数据并按指定格式转换为数组的函数。参数dtype决定了数组中元素的数据类型。当dtype=None时,numpy会尝试为每列数据推断出最合适的数据类型。
当dtype=None时:
在这种情况下,numpy会检查CSV文件中每一列的数据,并尝试为每一列确定一个合适的数据类型。这意味着输出数组中的每一行将会是一个结构化数组的元素,每一列成为结构化元素中的一个字段。因此,虽然物理上存储为一维数组,但逻辑上每个元素实际上包含了多个子元素(对应于原始数据的各个列),从而形成了类似于二维数据的结构。但是,整体来看,这个数组实际上是一维的,每个数组元素是一个复合类型(类似于Python中的元组),包含了不同列的数据。
当指定了特定的dtype(如U16)时:
在这种情况下,你是在告诉numpy将所有的数据都强制转换为指定的数据类型(在这里是长度为16的Unicode字符串类型)。因此,不管原始数据的类型如何,所有的数据都会被读取并转换为字符串。在这种情况下,numpy没有理由将数据读取为结构化数组,因为你已经指定了一个具体的、统一的数据类型。因此,它会生成一个二维数组,其中每行对应文件中的一行,每列对应行中的一个元素。
所以,dtype=None让numpy决定最合适的数据类型,通常会导致生成一个一维结构化数组,每个元素包含了多个数据字段。而指定特定的dtype(如U16)会导致numpy将所有数据读取为这种类型,从而生成一个普通的二维数组。
读取数据
在使用Numpy操作数据时,只要事先明确数组的shape,才能确定相应的数据访问方法,接下来我们设定一道练习题,那就是针对上面的一维数组和二维数组,如何只取第 5 列也就是最后一列的数据?
从上图可知,如果我们只看前 5 行数据,发现一维数组与二维数组的数据长的几乎是一样的,但如果我们只看第一行的数据,差别一下子就会显现出来:
如上图所示,一维数组d_None的每一行其实是一个Python的元组,而二维数组d_Unicode的每一行其实还是Numpy数组:
正是因为这种差别,如果我们只想访问最后一列的数据,对一维数据而言,因为它没有列的概念,所以在每一行中只能通过遍历的方式获取最后一个,而针对二维数组想要读取最后一列,一个切片操作就能搞定:
小结
本次练习主要是强调了dtype对Numpy的重要性以及其内部的类型推理机制,另外同样复习了Python及Numpy数组的切片操作。还是那句话,如果你也想进军 AI,一定要从这些基础的技能开始疯狂练习!
相关推荐
- u盘读取软件下载(u盘读取器下载)
-
手机播放U盘里的视频不用刻意的去安装什么播放器,一般手机里自带的播放器就能够直接播放U盘里的一般常见的视频。只要你要播放的视频,都是平时在电脑上或者电视上能够正常播放的视频,一般在手机里面它的系统自带...
- office2020安装包百度云下载
-
Office2020和Office2019是微软的办公套件产品,两个版本之间有以下区别:1.发布时间:Office2020于2021年10月发布,而Office2019于2018年9月发布。...
- 硬盘恢复分区(硬盘恢复分区怎么删除)
-
1、在电脑上下载DiskGenius软件。2、双击运行该软件,软件会自动识别硬盘。当软件自动识别硬盘之后,右键单击硬盘的盘符,出现下拉菜单栏,选择搜索已丢失分区(重建分区表)选项。3、右键单击硬盘盘符...
-
- edge 浏览器(edge浏览器官网下载)
-
目前没有,如果是平板安装了WIN10是会内置MicrosoftEdge浏览器的。edge是由微软开发的基于Chromium开源项目及其他开源软件的网页浏览器。Edge浏览器主要特点是能够支持目前主流的Web技术,作为Windows10自带...
-
2025-11-18 06:51 off999
-
- 网易163邮箱免费注册(163网易免费邮件注册)
-
163邮箱登录入口页面官方地址:https://mail.163.com/163邮箱登录注册方法1、进入邮箱登入首页,我们点击右下角“去注册”按钮,进入注册界面;2、这里直接填写账号和密码内容,点一下同意那里呈蓝色圆点;再点下一步。3、再填...
-
2025-11-18 06:03 off999
- 苹果商城app下载安装(苹果商店app免费下载)
-
一、苹果手机下载软件显示APP内购买的意思是APP可以免费下载使用,但是该APP内有付费内容,也就是通常所说的收费道具。二、不是所有应用都会提供App内购买项目。如果某个应用提供App内购买...
- 惠普电脑中国官网(惠普手提电脑官网)
-
https://support.hp.com/cn是惠普笔记本售后服务官网。惠普维修服务中心通过整合线上线下相关资源,向国内用户提供方便快捷、安全可靠的优质电子产品维修服务。目前拥有北京6家、全国30...
- windows2003密钥序列号(win2003 密钥)
-
没有密钥就无法完成程序安装。使用或者购买密钥才能安装
- 电脑产品密钥在哪里找win10(电脑产品密钥在哪里找新机)
-
要查看电脑上Windows10的产品密钥,你可以按照以下步骤进行操作:打开“开始”菜单,然后点击“设置”图标(齿轮状图标)。在“设置”窗口中,点击“更新和安全”选项。在左侧导航栏中,选择“激活”选项...
- 电脑有网络但上不到网(电脑有网但是上不了网)
-
如果电脑显示有网但无法上网,可能是网络连接出现问题。这种情况可能是由于以下几个原因导致的:1.路由器或者调制解调器出现故障;2.电脑的网络设置有误;3.网络供应商的服务中断或者限制了你的网络访问...
- 笔记本突然开不了机了是什么情况
-
1.检查笔记本是否有电,当内置电池用完而又没有充电的情况下,会导致笔记本无法开机,插上电源充电即可。2.内置电池损坏维修更换即可。3.开机时按F8,在高级选项中选择最后一次正确的配置即可。4.中病毒可...
- windows11办公软件(windows11的office)
-
1、首先点击电脑底部的Windows图标2、进入开始页面点击office套件中的任意应用,如Word3、页面弹出登录按钮,和创建按钮,如已有账号,点击登录4、接着进入激活office页面,输入offi...
-
- 7z文件怎么打开(7z文件改什么后缀才能打开)
-
7z是一种压缩格式,和我们在Windows平台上看到的rar类似;7z原本是7-zip开源的压缩文件所支持的压缩格式,目前大多数压缩软件也支持打开,如若安装了第三方压缩软件双击即可打开7z。7z文件的打开方式介绍如下: 1、扩展名为...
-
2025-11-18 02:03 off999
- 重装系统后连不上网(重装系统后无法连网)
-
1、首先,在安装系统完成之后,界面右下角网络连接显示不可用?我们需要通过,系统本身自带的诊断系统进行诊断,以避免是否是物理原因造成的网络不能正常链接。2、其次,检测结果如果是显示的未能安装网络适配器,...
- 破解wifi密码有什么办法(破解wifi密码有什么办法幻影)
-
破解路由器admin管理员密码方法:只能间接的破解。 方法一、1、打开浏览器---输入192.168.1.1(一般路由器地址是这个或者查看路由器背面的登录信息)进路由---输入用户名,密码...
欢迎 你 发表评论:
- 一周热门
-
-
抖音上好看的小姐姐,Python给你都下载了
-
全网最简单易懂!495页Python漫画教程,高清PDF版免费下载
-
Python 3.14 的 UUIDv6/v7/v8 上新,别再用 uuid4 () 啦!
-
python入门到脱坑 输入与输出—str()函数
-
飞牛NAS部署TVGate Docker项目,实现内网一键转发、代理、jx
-
宝塔面板如何添加免费waf防火墙?(宝塔面板开启https)
-
Python三目运算基础与进阶_python三目运算符判断三个变量
-
(新版)Python 分布式爬虫与 JS 逆向进阶实战吾爱分享
-
慕ke 前端工程师2024「完整」
-
失业程序员复习python笔记——条件与循环
-
- 最近发表
- 标签列表
-
- python计时 (73)
- python安装路径 (56)
- python类型转换 (93)
- python进度条 (67)
- python吧 (67)
- python的for循环 (65)
- python格式化字符串 (61)
- python静态方法 (57)
- python列表切片 (59)
- python面向对象编程 (60)
- python 代码加密 (65)
- python串口编程 (77)
- python封装 (57)
- python写入txt (66)
- python读取文件夹下所有文件 (59)
- python操作mysql数据库 (66)
- python获取列表的长度 (64)
- python接口 (63)
- python调用函数 (57)
- python多态 (60)
- python匿名函数 (59)
- python打印九九乘法表 (65)
- python赋值 (62)
- python异常 (69)
- python元祖 (57)
